玩日服游戏或读生肉漫画时,真正打断体验的往往不是某个单词看不懂,而是整套翻译流程:先截图、切到翻译软件、导入图片,再切回原来的画面。遇到连续对话,这种来回切换很快就会让人失去耐心。
屏译(overlay-translator)换了一种处理方式。它把截屏、OCR 文字识别、翻译和译文显示串在一起,用户留在游戏或漫画 App 内,点击悬浮球后,译文就会显示在原文附近,或者集中放进一个独立浮窗。整个过程无需 ROOT,也不用反复保存截图。
它说的“实时翻译”,具体是怎么实现的?
屏译并不是逐帧修改游戏或漫画画面。它的实际流程是:通过 Android 的 MediaProjection 或可选的 Shizuku 路径截取当前屏幕,再用本地或云端 OCR 识别文字,交给选定的翻译引擎,最后把结果叠加到屏幕上。
默认单击悬浮球可以翻译整屏,也可以切换到划词模式,只框选需要查看的一小块区域。长按悬浮球会打开弧形菜单,用来切换语言、预设、截图区域和循环模式。循环翻译既能按固定时间执行,也能等待对话文字稳定后再开始,并跳过重复画面,连续看剧情时不必每句话都手动点击。
官方说明中的常见等待时间是数秒,但这不是固定值。OCR 模型、翻译引擎、画面文字数量和手机性能都会影响速度;竖排漫画使用精度更高的日漫 OCR,通常也会比普通 UI 文字识别更慢。因此,这里的“实时”更接近点一下或自动循环后,很快在原应用内看到译文,而不是视频字幕那种逐帧同步。
译文贴近原文,也能集中放进悬浮窗口
屏译提供两种主要显示方式。一种是按照 OCR 找到的文字框,把译文放在原文上方、下方或直接覆盖;另一种是把所有内容集中到一个可拖动、缩放的悬浮窗口里。
前者更适合漫画气泡和分散的界面文字,v0.4.0 新增的自动适配画面功能还会根据不同文字区域调整译文颜色、背景和字号,尽量把结果放回对应位置。后者更适合虚拟按键较多的游戏:先把浮窗拖到不挡操作的位置,再锁定窗口,就不容易误触。
针对日漫,屏译还能处理从右向左的竖排阅读顺序,合并被 OCR 拆散的句子,并去掉汉字旁重复识别的小注音。长文本则可以通过滚动显示,避免单行译文被省略号截断。
OCR 和翻译引擎可以自由搭配
屏译比较有价值的地方,不只是支持的引擎数量多,而是识别与翻译是两个独立环节。某个 OCR 对当前字体识别不好时,可以只换 OCR,不必连翻译方案一起推倒重来。
- 端侧 OCR:包括默认的 ML Kit、PaddleOCR v5/v6 和面向竖排日漫的 Manga OCR,可在手机上完成识别。
- 本地或自建 OCR:可以连接局域网中的 Umi-OCR、LunaTranslator OCR,把计算交给电脑。
- 云端 OCR:支持 PaddleOCR AI Studio、百度、腾讯和有道等服务,需要相应的 Token 或 API 凭据,部分服务会按量计费。
- 大模型翻译:可接入 DeepSeek、OpenAI、智谱以及其他 OpenAI 兼容接口,也支持自建 Ollama 等服务。
- 传统机器翻译:提供 DeepL、Google、火山、百度、腾讯和有道图翻等选项,其中部分接口需要账号、密钥、额度或代理环境;免密钥的 Google 方案使用非官方端点,也可能遇到限流或失效。
- 端侧离线翻译:Sakura 适合日语 ACGN、视觉小说翻成简体中文,Hy-MT2 则覆盖更多语言;模型准备完成后可以断网使用。
屏译本身不要求注册账号,但选择云端服务时,仍要遵守对应服务商的账号、额度和收费规则。设置页提供连接测试,建议进入游戏前先确认接口能够正常返回结果。
游戏和漫画,可以这样设置
看日漫或视觉小说:可以先选择内置的“离线日语漫画 OCR → 简中”预设。它会组合日漫 OCR、端侧翻译和适合漫画的显示方式,缺少模型时再按提示下载。Manga OCR 模型约 140 MB;Sakura 端侧翻译模型约 1.26 GB,并且只用于日语翻简体中文。竖排气泡较多时,可优先使用自动方向和自动适配画面。
翻译游戏对话:普通横排 UI 可以先试默认 ML Kit;密排按钮或识别不完整时,再换 PaddleOCR。把识别区域限制在屏幕下半部分,配合“等待文字稳定”循环模式,通常比每次扫描整屏更省时间。虚拟按键较多时,独立悬浮窗口也比贴着每段原文显示更不容易挡操作。
统一人名和专有名词:可以为不同 App 建立术语库,提前固定角色名、地名和组织名。需要注意,这些术语上下文目前主要对 OpenAI 兼容接口和端侧大模型生效,普通机器翻译引擎未必会采用。
划词翻译不只给出一句中文
遇到生词时,可以把悬浮球切到划词模式,框选单词或短语后直接打开翻译卡片;也可以在其他 App 中选中文字,从 Android 系统菜单调用“屏译翻译”。
所有翻译引擎都能返回基础译文。如果使用大语言模型,卡片还可以显示音标、词性、多条释义、例句和难点说明;DeepL、百度、腾讯等传统翻译引擎通常只返回译文,不能把它们当成完整的离线词典。
第一次安装和使用
- 进入项目的 GitHub Releases 页面,下载最新的 ScreenTranslator-x.y.z.apk。项目同时提供 SHA-256 校验文件,安装前可以核对文件完整性。
- 在 Android 设置中允许当前浏览器或文件管理器“安装未知来源应用”,然后安装 APK。当前安装包只支持 64 位 ARM 设备。
- 首次启动时授予悬浮窗和通知权限,再点击“启动截屏服务”,确认 Android 弹出的屏幕捕获授权。
- 选择源语言、目标语言、OCR 与翻译引擎。使用本地模型时先通过 Wi-Fi 下载;使用云端接口时填入自己的凭据并执行连接测试。
- 切换到游戏、漫画阅读器或视觉小说,点击悬浮球开始翻译;长按悬浮球可以快速调整区域、模式、语言和预设。
Shizuku 不是必需组件。安装并授权后,可以改用 Shizuku 截屏路径,减少重复出现的系统截屏授权弹窗。无障碍服务同样是可选项,仅在需要同时按住音量加、音量减来触发翻译时开启即可。
离线可以用,但不是安装后默认“零上传”
如果同时选择端侧 OCR 和 Sakura 或 Hy-MT2,本次截取的画面与识别文字无需离开手机,这是屏译很重要的一项能力。不过,离线模型需要先下载:Sakura 约 1.26 GB,Hy-MT2 约 1.13 GB,Manga OCR 也需要额外模型空间。当前正式推理路径主要依赖 CPU,低内存设备可能加载失败,长时间使用还要考虑速度、发热和耗电。
如果选择云端 OCR、DeepSeek、DeepL 或其他在线服务,截图或识别出的文字就会发送到对应服务商。涉及聊天记录、账号信息、支付页面等敏感内容时,不建议开启屏幕翻译。项目说明 API Key、Token 等凭据会加密保存在本机,导出的配置包也不会包含这些敏感信息,但换机后仍需重新填写。
一个能直接改善大模型译文的设置
使用 OpenAI 兼容翻译接口时,可以修改 Prompt 模板。视觉小说或剧情游戏建议把要求写得短而明确,再配合术语库固定名字,例如:
你是日语视觉小说翻译助手。只输出简体中文译文,不解释,不扩写;保留原文分段、标点和人物语气;人名、地名与组织名严格使用术语表中的译名;发现疑似 OCR 错字时结合上下文保守修正,无法判断的专有名词保留原文。
如果一句话翻得别扭,先检查 OCR 原文是否已经漏字或把两行顺序识别反了,再调整翻译提示词。屏幕翻译的质量由识别和翻译共同决定,单纯更换大模型并不能修复所有 OCR 错误。
使用前还要留意这些限制
- 目前只有 Android arm64-v8a 安装包,不支持 32 位 ARM、x86,也没有 iOS 版本。
- 部分反作弊网游可能把 MediaProjection 截屏识别为异常行为。项目明确更建议用于单机游戏、视觉小说和漫画,不要在有封号风险的游戏中贸然使用。
- 设置了 FLAG_SECURE 的网银、视频等 App 会截到黑屏,项目不会绕过系统保护。
- Android 14 及以上首次启动截屏时会出现系统授权窗口;部分小米、OPPO、vivo 等系统还需要允许后台运行并加入电池白名单。
- 翻译历史和译文朗读目前仍在项目路线图中,不是 v0.4.0 已有功能。
总结
屏译最吸引人的地方,是把“看到外语文字”和“在原画面读到译文”之间的步骤压缩到一次点击或一次自动循环。对日语视觉小说、生肉漫画和单机游戏来说,竖排识别、术语库、原位覆盖与端侧模型都很有针对性。
它也不是装好就完全不用配置的万能翻译器:本地模型对存储和性能有要求,云端方案涉及密钥、费用与隐私,反作弊网游还存在实际风险。如果只是偶尔翻译一张截图,系统自带或常见图片翻译工具可能更省事;如果经常需要连续阅读屏幕内容,屏译则提供了一套更完整、也更可控的开源方案。
官方相关链接
屏译官方 GitHub 仓库
https://github.com/ciddwd/overlay-translator
最新正式版下载入口
https://github.com/ciddwd/overlay-translator/releases/latest
可选组件 Shizuku 官方仓库
https://github.com/RikkaApps/Shizuku



