CantoNotes
文章

廣東話轉寫4 分鐘閱讀

中英夾雜轉寫:人名、品牌同夾雜詞點樣留得準

香港口語唔係普通話加外來語。用得着嘅逐字稿,要留低英文術語、廣東話語法,同埋你 CRM 已經用緊嘅人名寫法。

保留人名同品牌嘅中英夾雜會議逐字稿

聽一場真正嘅香港會議三十秒。你會聽到廣東話骨架、一個英文名詞、助詞、品牌、花名,然後用兩套系統講數字。呢個唔係講者有問題,而係呢座城市返工嘅講法。將佢「修正」成單一語言嘅轉寫,已經係在改稿。

跟住團隊用一個鐘改同一類錯:同事英文名被寫成近音漢字、Slack 變成亂嚟嘅音譯、KPI 被展開或者消失、報價喺仍然需要廣東話動詞嘅句子入面變成空泛嘅 quote。逐字稿變成搜唔到——因為冇人會打模型估出嚟嗰套字。

先保留夾雜。正式紀要稍後先決定。

逐字稿同會議紀要任務唔同。逐字稿跟口。如果有人講「我哋下個 sprint 先 lock scope」,呢句仍然應該有 sprint、lock、scope。寫俾美國母公司嘅紀要,可以變成 “Scope to be locked next sprint”。呢啲係兩份文件。喺辨識器度夾埋一份,就會連引文同可搜尋嘅詞一齊冇。

口語都係同一道理。助詞話你知嗰句「好」係咪不情不願。唔好為咗頁面似書面中文,就喺逐字稿刪走。紀要可以收斂語氣。你冇辦法用消毒過嘅句子還原猶豫。

人名要對到 CRM,唔係對近音

香港人名同時活喺兩套文字。在座可能身份證寫陳嘉儀,電郵寫 Karen Chan。客戶可能有中文法定名稱同英文商號。如果逐字稿揀咗「陳」,而 Slack 全部叫 Chan,之後搜尋同 AI 答案都會斷線。

  • 優先用團隊已經存檔嘅寫法:電郵顯示名、CRM、或者 Zoom 參加者名單。
  • 除非對方自己咁寫,唔好將英文名「好心」轉成漢字。
  • 同一場會、同一個工作區,一個人一個拼法。穩定先至搜得到。

品牌同行內詞,用現場講嗰種語言

產品名、律師行名、商場名、內部 code name,最易令通用語音轉文字驚慌。佢會揀個讀音近嘅常用字。你張 invoice 唔會。鎖一細個你在意嘅詞表——客戶名、產品線、你哋永遠用英文講嘅詞(onboarding、SLA、retainer)——用呢啲先判斷逐字稿,而唔係整體「準確率 %」。

中英夾雜喺公司內部其實好穩定,即使外人睇落亂。如果你哋永遠講 meeting 而唔講「會議」,逐字稿寫「會議」並唔係更專業,而係更難搵。每個工作區定一條規則:留英文詞,或者一律用中文詞。然後跟足。

真正有用嘅頭兩分鐘校對

  1. 先掃第一頁所有專有名詞。名錯一次,就會錯成篇。
  2. 搵一句你記得嘅夾雜句。如果中間嗰截英文仲在,其餘大概用得着。
  3. 核對一個數字:價錢、日期、人數。語音模型好鍾意有自信嘅錯數。
  4. 然後先掃意思。未對名就改語氣,係倒過來。
搜唔到嘅準確係裝飾。人名同術語準,先至係產品。

同一個詞永遠都錯嗰陣

有啲錯唔係隨機。客戶名、內部產品、商場、律師行——第一場會錯,第十二場都會錯。喺上下文改一次,留一張屋企詞表。用一份冇你哋人名嘅 demo 檔判斷供應商,就係買咗星期一先出事嘅玩具。

唔好等神話級 99% 分數。等你 invoice 已經用緊嘅名稱,喺嘈雜、中英夾雜嘅 standup 仍然留得住。

CantoNotes 對呢題老實嘅部分

CantoNotes 用 CantoSub 語音 AI,因為嗰套已經為同一條錄音入面嘅廣東話、英文、普通話而做——包括香港辦公室又醜又正常嘅中英夾雜。會議工作區再將逐字稿同紀要、待辦放埋一齊,你就唔使將「清理過」嘅段落貼去冇人 grep 到嘅文件。

罕見品牌第一次仍然可能聽錯。呢個係語音。分別在預設:保留夾雜、標明講者、等人喺上下文改名,而唔係交一份普通話形狀嘅摘要叫本地化。如果你要剪片字幕,嗰個係另一種匯出(收費計劃有 SRT)。會議紀錄本身,睇得明嘅中英夾雜文本先至係功能。

相關文章

唔好再夜晚十一點先寫會議紀要。

立即註冊