如何為遊戲提供機器翻譯

Published: 2023年5月13日

如何為遊戲提供機器翻譯

在先前的文章中,我們討論過什麼是機器翻譯(MT)──本文將探討如何將其整合進遊戲在地化製作流程中。

一般來說,大家對機器翻譯的興趣主要圍繞在以下幾點:節省成本、加快上市速度,以及拓展新語言或新市場。而這些優勢背後的限制門檻,說到底還是翻譯品質。然而,隨著遊戲受眾在數量和成熟度上的增長,對更好、更準確翻譯的需求也隨之增加。糟糕的翻譯品質會嚴重損害遊戲的聲譽,並且直接導致銷量下降。因此,相比以往,開發商和發行商必須以正確的方式將MT納入工作流程,同時深入了解相關細節,並遵守一些基本規則,以確保產出高品質的內容。

不受限於特定系統的MT

我們的MT流程採用不受限於特定系統的方法,根據每個專案的具體情況決定最適合的MT系統。這使我們有能力為合作夥伴提供其所需的快速交件、成本效益和資安保障。這個流程是我們多年實踐經驗累積的最佳方案,但我們仍會持續精進,因為我們始終追求更好的品質。

透過機器翻譯維持品質

先前作品的內容是我們建立品質標準的起點。如果有既有的優良翻譯可供使用,將為未來的專案奠定堅實基礎,因為這些內容已經通過了嚴格的審核。理想的專案包括遊戲續作、MMO(通常具有不斷更新的內容)、線上遊戲(因為這類遊戲傾向持續更新內容),以及其他類似性質的遊戲。相對於創造獨立的新內容,業界現在更重視在既有IP上持續發展,這給了我們很好的機會去建立強大的翻譯資料庫(TM),其中儲存的內容都是經過驗證的高品質翻譯。倘若IP的TM可用,就能大幅提升後續的翻譯效率,特別是那些以原遊戲為基礎的專案。

遊戲在地化的工作流程類型

有三種典型的情況。

  1. 現成型:使用現成或通用的MT引擎,由Side的遊戲語言專家進行譯後編輯。當沒有足夠的TM,卻又需要立即開始工作時,就會採用這種方法。即使如此,我們還是會在專案初期執行可行性測試,以確保在提高生產力的同時,也能維持品質水準。
  2. 半自訂型:在半自訂工作流程中,現成或通用引擎會搭配詞彙表使用,且可能會加入一些微調規則。當沒有足夠的TM,卻又需要立即開始工作時,就會採用這種方法。這可能是針對可行性測試結果不佳(僅使用現成引擎)的解決方案。我們會完全遵循客戶提供的用語和詞彙。
  3. 完全自訂型:第三種可能性是建立一個完全自訂的引擎。這可以在專案啟動前或進行期間執行,前提是標準翻譯已完成,且針對無可用舊資料的遊戲,已審查三分之一內容。

值得注意的是,Side不會偏好任何引擎供應商;我們會根據每個專案的需求,選擇最適合的翻譯引擎。就某些內容或用途而言,考量到神經機器翻譯引擎可能在速度和成本方面有所限制,故目前正積極探索採用GPT-3作為即時翻譯的可行方案。整個MT社群對這方面的研究還在持續進行中。

最後,我們一定會進行機器翻譯後編輯(MTPE)和最終審查。當然,用於訓練自訂引擎的平行語料越多,MT輸出的品質就會越好。這能減少我們遊戲語言專家的譯後編輯工作量,進而提升工作效率。

在此過程中,會考量自訂翻譯引擎所需的工作量。某些語言配對(例如英語翻譯成法語)的翻譯效果較佳;而德語翻譯成韓語這樣的語言配對,很可能需要以英語作為中介語言。

評估特定引擎的效能是決定是否採用該工具的關鍵要素。

前導或可行性測試

前導測試階段有嚴格的評估框架,幫助我們做出決定。訓練引擎的第一步是準備資料,將精選的TM和現有詞彙表導入系統,最終完成MT系統的建置。我們將透過自動化指標分數和人工評估的方式來驗證此MT系統。

人工評估之方式,可涵蓋A/B測試及評級等多種選項。如果時間緊迫或資源不足,但自動化指標分數還不錯,我們就可以跳過人工評估階段,直接進入大量譯後編輯工作。採用這種策略,我們不僅能在實際專案上取得進展,還能為MTPE諮詢收集寶貴的數據(即編輯距離分數)。最終目標是將其部署到CAT(電腦輔助翻譯)工具中。

需要澄清的是,這些流程並非最終的決定因素。MT工具之間的比較也是評估的重要一環。我們會評估多個引擎的結果,以找出最適合特定專案的引擎。然後,我們會針對產出內容進行譯後編輯測試,以衡量譯後編輯人員的效率,並評估機器翻譯的文本是否易於使用。

最終評估與整合

最終,品質數據的評估或包含以下環節:評估流暢度與準確度、標註主要錯誤類型,以及蒐集語言專家(專精於特定領域或體裁的專業翻譯人員/譯後編輯人員)針對該語言的回饋。

這一切的執行都並非毫無關聯,開發商和發行商都密切參與其中。事實上,這是一個各方共同合作的過程。我們的合作夥伴會提供其先前內容的相關參考資料和他們期望的品質,而Side則會建議最適合該專案的MT解決方案(如有)。這種共同合作還包括自訂引擎和品質測試,以確保解決方案符合專案需求。開發商也會分享他們的工作流程,讓Side能夠設計最佳整合方案,進而降低可能發生的延遲狀況。

人工譯後編輯

Side的語言專家都受過神經機器翻譯引擎的譯後編輯訓練。為了減少此類譯後編輯所需的時間和精力,我們採用了「自動譯後編輯」(APE)流程。APE有多項規則,包含性別判斷控制、刪減、審核,以及其他後期流程,而MT檔案在送交語言學家前,都會先經過這些流程處理。當有風格指南或詞彙表可用時,可根據專案需求自訂規則。當然,我們可以協助建立和開發相關詞彙表和風格指南,以供半自訂或全自訂型的MT引擎使用。

我們的譯後編輯人員都受過專業訓練,能提供條理分明的回饋以持續改進MT引擎,並參與專案的籌備和收尾。雖然有時可能找不到遊戲專業人員進行譯後編輯,但建議您的翻譯人員在語域(例如,遊戲內對話可能需要口語化表達,這是曾從事電視劇或電影翻譯的影視翻譯人員所具備的特點)和領域或類型各方面(賽車遊戲當然與街機遊戲不同)都具有豐富經驗。就像MT系統一樣,您的MTPE專案必須選擇最優秀的人才。

持續改進

因此,到目前為止應該已經很清楚,我們將機器翻譯過程視為一場馬拉松,而不是短跑。這是一個不斷累積的過程,所以持續改進──更重要的是,需要預留時間來確認這些改進──是我們能長期做出最好成果的關鍵方法。重要的是不要將MT視為簡單的解決方案,因為MT輸出的品質確實需要持續驗證。

我們深信這個過程的投入是值得的,因為它能確保我們提供給合作夥伴最高品質的產品,並加速產品上市。

Tags