跳至主要內容
雜項

【自製】分享一個螢幕框選翻譯 Overlay 小工具 解決遊戲沒有翻譯的問題

檢視原圖

Translator Overlay 是一個 Windows 上的螢幕翻譯小工具。在遊戲視窗上框出對話框,它會先在本機用 OCR 認出文字,丟給你選的 AI 翻譯,再把譯文蓋回原文的位置。

會做這個,是因為我身邊有一群很愛玩 GalGame 的朋友,我也很想跟著玩,可惜日文不太好。想說現在 AI 這麼厲害,應該可以掏出來試試看,就這樣一路寫下去了 XD

不過做完之後,我覺得最重要的功能其實是開台。譯文可以單獨抓進 OBS,直播玩 GalGame 的時候,看台的大家不用懂日文也能一起圍觀(X

超級 @james58899 的開發(本來想打感謝但發現少掉感謝太超級了就這樣)

另外自首一下,GitHub 上那張「AI Slop」橫幅是認真的。
借用一份應該沒有法律效力的授權條款 Vibe License 裡的一段話:

這個軟體完全是 vibe coding 出來的。沒有任何人類寫過它、設計過它,或用任何經得起交叉詰問的標準審查過它。作者描述了一種感覺,然後軟體就出現了。

但這個工具真的能跑,有問題可以到 GitHub 上開 issues 但不一定會修,要看我額度有沒有剩。

畫面上是平常這軟體工作的樣子,把對話框選起來然後按 Start,譯文就會用 Overlay 的方式顯示在遊戲上。滑鼠可以穿透、可以把譯文單獨撈進 OBS。
(圖是 AI 生成的示範畫面,不是市售遊戲)

翻譯可以丟給電腦上本來就登入著的 Claude Code、Codex、Grok 或 OpenCode,不用另外去申請 API key,也能接 LM Studio、Ollama 在自己電腦上跑。

我自己的設定

我是這樣框的,名字欄一塊、對話框一塊,其他 UI 不框,認錯的字會少很多。

這是控制視窗,右邊會一句一句列出原文和譯文,可以順便檢查人名有沒有翻歪。

我平常翻譯是用 OpenCode 的 Muse Spark 1.3 Contributor Free(opencode/muse-spark-1.3-contributor-free),在免費的模型裡我覺得它最好。OCR 開 medium,顯卡是 9070 XT;電腦要省資源的話,small 其實就很夠用了。OpenCode 的免費模型是限時的,之後可能會換掉,以 OpenCode 官方頁面 為準。

安裝和每一種翻譯來源的設定,我都整理在文章最後面,要用再往下拉就好。

最後

做都做了,有興趣的哥們就裝來玩玩看 😀
回報 bug 的話,附上 Windows 版本、用哪個翻譯來源和截圖,我比較好查。

規格與設定

OBS
新增「視窗擷取」選 Translator Overlay Captions,不要選 Translator Overlay。用「遊戲擷取」的話,要再疊一層視窗擷取放譯文。

下載
GitHub Releases,下載 TranslatorOverlay-*-win-x64.zip,解壓後開 translator-app.exe。原始碼是 Public Domain,詳細說明在 GitHub README。

系統需求

  • Windows 11 x64
  • 遊戲要開視窗或無邊框視窗,獨佔全螢幕不行;日文遊戲的 OCR 要選 small 以上
  • 如果你沒辦法正常啟動這個軟體,檢查有沒有安裝 Windows App Runtime 2.4,沒有的話下載 x64 的 Installer 安裝。
  • 系統缺 C++ 執行階段的話,補裝 Microsoft Visual C++ 可轉散發套件(x64)
  • 第一次開會自動下載 OCR 模型,下載完才能按 Start

基本操作

  1. API 頁選翻譯來源,按 Save
  2. Dashboard 選遊戲視窗,按 Select regions 框對話框(不框就是整個視窗)
  3. 按左下的 Start;卡住按 Retry 重翻,Cancel 取消

翻譯來源

來源費用文字會不會送出去
Claude Code/Codex/Grok CLI用你自己的訂閱額度會
OpenCode CLI+免費模型限時免費,有速率限制;部分模型的資料可能被拿去訓練會
OpenRouter+Luna依用量計費,見 OpenRouter 官方頁面會
LM Studio/Ollama+Gemma 4不用付 API 費用,要有顯卡不會
LM Studio+Hy-MT2不用付 API 費用,要有顯卡不會
  • Claude Code/Codex/Grok:API 頁選對應的 CLI,沿用現有登入。Codex 要 0.154.0 以上。
  • OpenCode:用 Scoop 安裝,指令是 scoop install opencode,目前不用登入。API 頁選 OpenCode CLI,Free 模型這個工具會直接列出來,選就好。作者自己用的是 Muse Spark 1.3 Contributor Free。免費模型名單會變,以 OpenCode Zen 官方頁面 為準;免費模型只能在 OpenCode 裡用,不要填進 OpenAI-compatible。
  • OpenRouter+Luna:API 頁選 OpenAI-compatible,base_url 填 https://openrouter.ai/api/v1,api_key 填 OpenRouter key,model 填 openai/gpt-6-luna 或 openai/gpt-5.6-luna,作者實測兩代表現都很好。選用:model 後面加 :floor,會照單價由低到高挑供應商(包含 flex 端點),可能比較慢。價格請看 OpenRouter 官方頁面:gpt-6-luna、gpt-5.6-luna。
  • LM Studio+Gemma 4:Discover 搜尋 gemma-4 下載,Developer 頁打開伺服器,My Models 齒輪裡關掉 Enable Thinking。API 頁選 OpenAI-compatible,base_url 填 http://localhost:1234/v1,model 填 LM Studio 顯示的名稱,api_key 隨便填,「推理強度」填 none。
  • Ollama+Gemma 4:ollama pull gemma4:12b(其他大小見 Ollama 的 Gemma 4 頁面)。API 頁選 OpenAI-compatible,base_url 填 http://localhost:11434/v1,model 填 gemma4:12b,api_key 填 ollama,「推理強度」填 none。Gemma 4 建議關掉思考,開著的話每一句都要先想過一輪,翻譯會慢很多。如果你的 Gemma 4 跑得到每秒 200 token 以上、第一個字不到 1 秒就出來,那可以開著試試。
  • LM Studio+Hy-MT2(騰訊翻譯專用模型):作者實測在 LM Studio 可以直接跑。官方 GGUF 有 1.8B、7B、30B-A3B,選 Q4_K_M、Q6_K、Q8_0,不要用 1.25bit。1.8B/7B 建議 temperature 0.7、top_p 0.6;top_k 20、重複懲罰 1.05、context 8192 在 LM Studio 的模型齒輪裡設。Translation 頁的「對話上下文回合」調小。
  • 本機模型「結構化輸出」保持開啟;一直出現格式錯誤再關掉。LM Studio 官方提醒 7B 以下的模型不一定做得到。

OCR

  • 日文遊戲用 small(預設)或 medium。tiny 的字典裡沒有假名,認不出日文。
  • 裝置維持 GPU,內顯也可以;CPU 只是 GPU 不能用時的退路。
  • 覺得卡:只框對話框,把 OCR 頁的「擷取間隔」和「穩定等待」調大。
  • 直書:閱讀順序改成「由上到下,再由左到右(欄)」。
  • 換尺寸或裝置後要按 Save 才會重新載入。

顯示

  • 譯文只在遊戲視窗位於最前面時顯示。視窗化全螢幕可以,獨佔全螢幕不行。
  • 譯文背景的顏色和透明度在 Overlay 頁調,調不透明可以把原文蓋掉。
  • 不想蓋在遊戲上,可以只開獨立的翻譯視窗。
  • 介面有繁中、簡中、英文。

其他

  • 不注入遊戲、不讀寫遊戲記憶體,只擷取畫面。線上遊戲的反作弊規則各家不同,請自行判斷。
  • 翻過的句子只記在這次執行,關掉就清空。