ciddwd/overlay-translator

★ 871⑂ 35

无需 ROOT 的开源 Android 屏幕实时翻译工具,适合游戏、视觉小说和漫画。支持端侧与云端 OCR、离线 LLM、多种翻译服务和文字朗读(TTS),译文可直接显示在画面上。Open-source no-root Android real-time screen translator for games, visual novels, and manga.

About ciddwd/overlay-translator

ciddwd/overlay-translator is an open-source project on GitHub, mainly written in Kotlin. 无需 ROOT 的开源 Android 屏幕实时翻译工具,适合游戏、视觉小说和漫画。支持端侧与云端 OCR、离线 LLM、多种翻译服务和文字朗读(TTS),译文可直接显示在画面上。Open-source no-root Android real-time screen translator for games It currently holds 871 stars and 35 forks with 0 open issues, and was last pushed on an unknown date (repository created unknown).

Project Overview

AI Homed tracks it on the Local & On-Device AI board.

GitHub Repository Details

Repository ciddwd/overlay-translator · default branch - · size 0 KB · watchers 0 · source: GitHub REST API and repository README

README

简体中文 · English

屏译 · Screen Translator

Android 屏幕实时翻译 · 截屏 → 识字 → 翻译 → 叠加显示 / 朗读

License Release Downloads Stars Issues Android API Kotlin Compose QQ 群 1059655926

通过 MediaProjection / Shizuku 截屏 → 端侧或云端 OCR → LLM / 机器翻译 → 悬浮窗叠加显示。 译文既可以盖在原文附近,也可以用手机语音、自建语音服务或在线音色朗读。 无需 ROOT,单机可用,面向视觉小说、漫画、游戏对话等任意屏上文字的实时翻译。

安装 · 使用 · 配置 · 参与开发 · Releases · Issues

---

✨ 功能

🎯 一句话定位

游戏 / 漫画 / 视觉小说画面在屏,按一下圆球,识别和翻译完成后,目标语言译文盖在原文上;需要时还能直接朗读。

🖼️ 批量翻译相册图片

🖱️ 怎么触发翻译

🔍 识别屏上的文字(OCR)

🌐 翻译引擎

🔊 把译文读出来(TTS)

🔤 划词翻译(按一个词出字典)

不只是翻整屏。框出屏上一个单词或短语,弹卡片一次告诉你:

文字提取:开启「仅提取文字」后,框选即可提取文字,支持复制和朗读,不进行翻译。

🎨 译文怎么显示

🛠️ 用着舒服的小事

🧩 项目特点

屏译将截屏、文字识别、翻译、显示和朗读分成可独立配置的环节:

| 特点 | 说明 | |---|---| | 识别和翻译可以自由组合 | 识字可以在手机完成,也能连接自己的电脑或云服务;翻译方式可以单独选择,不会因为某一家服务不可用就让整套应用失效 | | 朗读方式不受翻译方式限制 | 无论用哪种方式翻译,都可以改用手机系统语音、自建语音服务或在线音色朗读,不需要重新设置 OCR 和翻译 | | 既能实时翻,也能批量处理图片 | 屏幕上的内容可以点悬浮球立即翻译,相册中的图片可以一次选择多张交给后台处理;两种方式都可以直接使用已经保存的预设 | | 输入翻译 | 单击操作球,将输入框里的文字翻译为预设的源语言;双击可选择全屏翻译或划词翻译 | | 可以全离线,也可以完全自建 | 使用本机识别、本机翻译和已下载的系统语音时,截图与文字都能留在手机;也可以把识别、翻译和朗读服务放在自己的电脑或服务器上 | | 专门面向游戏、漫画和视觉小说 | 智能等待文字显示完整、跳过重复画面、优先处理对话框、识别竖排日漫,并让译文跟随原文位置和阅读方向;还可按游戏固定人名与术语 | | 开源且不锁配置 | 代码采用 Apache-2.0;设置、预设、术语和字体可以导出迁移,API Key 不会写进导出文件 |

适合希望自行选择识别、翻译和朗读方式,并兼顾离线使用、竖排漫画与自建服务的用户。

📸 截图

主屏 —— 上半区可上下滑动切换「预设 / 当前状态」,下半区可左右滑动切换「截屏服务 / 批量翻译」。

| 预设与批量翻译 | 当前状态与截屏服务 | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/主屏预设、批量翻译和最近任务 | https://github.com/ciddwd/overlay-translator/blob/HEAD/主屏当前状态和截屏服务 |

实际译文叠加 —— Discord 沟通规则页,OCR 紧贴原文渲染:

| 经典深色主题 | 浅色纸张主题 | 自动适配画面 | |---|---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/经典深色译文叠加 | https://github.com/ciddwd/overlay-translator/blob/HEAD/浅色纸张译文叠加 | https://github.com/ciddwd/overlay-translator/blob/HEAD/Discord 自动适配画面 |

日文漫画自动适配对比 —— 同一张竖排日漫从原版到自动适配画面,并展示将译文改为横排、从左向右后的效果:

| 原版 | 自动适配画面 | 自动适配画面(横排、从左向右) | |---|---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/日文漫画原版 | https://github.com/ciddwd/overlay-translator/blob/HEAD/日文漫画自动适配画面 | https://github.com/ciddwd/overlay-translator/blob/HEAD/日文漫画自动适配画面,译文横排并从左向右 |

游戏场景 —— Sandship UI 同一画面对比:原图、紧贴原文与自动适配画面。

| 显示方式 | 画面 | |---|---| | 原图无处理 | https://github.com/ciddwd/overlay-translator/blob/HEAD/游戏原图无处理 | | 紧贴原文 | https://github.com/ciddwd/overlay-translator/blob/HEAD/游戏译文紧贴原文 | | 自动适配画面 | https://github.com/ciddwd/overlay-translator/blob/HEAD/游戏译文自动适配画面 |

漫画 / 字幕场景 —— 漫画气泡按列识别后译文紧贴覆盖:

| 韩文漫画 | 日文竖排漫画 | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/韩文漫画译文叠加 | https://github.com/ciddwd/overlay-translator/blob/HEAD/日文竖排漫画译文叠加 |

悬浮窗口模式 —— 把所有原文 / 译文集中到一个可拖拽缩放的浮窗里,避免「贴原文」模式下译文挡住游戏操控(虚拟摇杆 / 按键 / 对话推进键)。窗口支持锁定:解锁时可拖动、可缩放、带 X 关闭按钮和底部缩放手柄;锁定后只剩文字内容,不响应任何手势,彻底防误触。

| 解锁(可拖拽 / 缩放 / 关闭) | 锁定(防误触,只剩内容) | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/悬浮窗口解锁状态 | https://github.com/ciddwd/overlay-translator/blob/HEAD/悬浮窗口锁定状态 |

长按悬浮球的弧形子菜单 & 划词翻译卡片 —— 左:长按弹出菜单,循环 / 选区 / 在「全屏翻译」和「划词翻译」之间切换 / 回主页(按钮顺序可在设置里拖动重排);右:圈出屏上一个词后弹出的卡片,连读音、词性、多条释义、例句一起呈现,并可分别朗读原文、译文和词典内容(使用大语言模型时才能拿到这套完整字典)。

| 长按弹出的弧形菜单 | 划词翻译卡片(带字典 / TTS 朗读) | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/长按悬浮球弹出弧形菜单 | https://github.com/ciddwd/overlay-translator/blob/HEAD/支持字典与 TTS 朗读的划词翻译卡片 |

译文块选择 / 复制 / 朗读 —— 把译文块点击动作设为「打开选择面板」后,点击任意译文块即可同时查看原文和译文。拖动选区后可使用系统的「复制 / 全选」,也可一键复制整段原文或译文;点击原文或译文右侧的扬声器按钮,可使用应用内朗读功能播放对应整段内容。

提示:竖排译文暂时不能通过长按来选中一小段朗读;可以改用「点击块选择复制」模式,通过扬声器按钮朗读整段原文或译文。

https://github.com/ciddwd/overlay-translator/blob/HEAD/译文块文字选择、复制与朗读面板

设置页

| 语言 / 主题 / 系统预设 | 翻译后端 | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/设置顶部与系统预设 | https://github.com/ciddwd/overlay-translator/blob/HEAD/翻译后端设置 | | OCR 引擎 | 方向模型设置 | | https://github.com/ciddwd/overlay-translator/blob/HEAD/OCR 引擎设置 | https://github.com/ciddwd/overlay-translator/blob/HEAD/自动方向判别与方向模型设置 | | 译文样式与字体 | 自动适配画面 | | https://github.com/ciddwd/overlay-translator/blob/HEAD/译文显示与字体设置 | https://github.com/ciddwd/overlay-translator/blob/HEAD/自动适配画面设置 | | 弧形菜单按钮 | 悬浮窗口模式选项 | | https://github.com/ciddwd/overlay-translator/blob/HEAD/弧形菜单按钮设置 | https://github.com/ciddwd/overlay-translator/blob/HEAD/悬浮窗口模式设置 | | 悬浮球 | 智能循环翻译 | | https://github.com/ciddwd/overlay-translator/blob/HEAD/悬浮球设置 | https://github.com/ciddwd/overlay-translator/blob/HEAD/智能循环翻译设置 |

| 划词翻译 / 截屏区域 / 输入翻译 | TTS 朗读设置 | |---|---| | https://github.com/ciddwd/overlay-translator/blob/HEAD/划词翻译 / 截屏区域 / 输入翻译 | https://github.com/ciddwd/overlay-translator/blob/HEAD/TTS 朗读引擎、系统音色、语速、音调和测试文本设置 |

📦 安装

1. 到本仓库的 Releases 页下载最新 ScreenTranslator-x.y.z.apk 2. 在 Android 设备上点击安装(首次需在系统设置允许"安装未知来源应用") 3. 启动后依次授予 悬浮窗通知 权限

目前只发布 arm64-v8a(64 位 ARM) 版本,32 位 ARM 和 x86 设备暂不支持。下载前可以先在系统信息或设备资料中确认处理器架构。

每个 APK 同时附带 .sha256 校验文件,可对照本地 Get-FileHash / sha256sum 输出确认下载完整性。

🚀 使用

1. 启动 App,点 启动截屏服务,确认系统弹出的"开始截屏?"对话框 2. 切到任意游戏 / 视觉小说 / 漫画 App 3. 点屏幕上的圆形悬浮按钮 → 识别和翻译完成后显示译文;等待时间取决于手机性能、画面和所选服务 4. 长按悬浮按钮 → 打开弧形菜单,可切换循环模式、重选截图区域、切源语言/目标语言、切翻译预设,或在整屏翻译与划词翻译之间切换(循环可使用固定间隔,也可等待文字稳定后自动翻译) 5. 默认单击译文条隐藏、长按选择复制;也可在设置中改为点击译文块打开原文 / 译文复制面板

可选:

输入翻译

在弧形菜单中切换到「输入翻译」,先点击需要翻译的输入框并输入文字:

需要无障碍权限。仅在点击操作球时读取并替换输入内容,不会读取密码类型的输入框。

⚙️ 配置

启动 App 后进入"设置"。设置页顶部可切换 应用语言主题模式;任意 section 都可用搜索图标按关键字(中英文都行)快速跳转。

OCR 引擎

| 引擎 | 适用场景 | 备注 | |---|---|---| | 端侧 ML Kit (auto / latin / ja / zh / ko) | 默认;日文 / 中文 / 韩文 / 拉丁字符 | 无需外网,端侧推理 | | 端侧 PaddleOCR PP-OCRv5 / v6 | 多语种密排文字、UI 按钮、横排中文 / 英文 | 支持 v5 mobile、v6 tiny / small / medium;首次使用需模型就绪,见下 | | 端侧 PP-OCRv5 韩文 | 韩文文字 | 独立的韩文识别模型,可在设置中选择;首次使用需下载模型 | | 端侧 日漫 OCR | 日语漫画、竖排气泡、手写感字体 | 使用 manga-ocr ONNX,复用 DBNet 检测;约 140 MB,按需下载或本地导入 | | 本地 HTTP Umi-OCR | 已在 PC / 局域网部署 Umi-OCR 的场景 | 填 http://:/api/ocr,手机截图发到你的局域网服务 | | 本地 HTTP LunaTranslator | 已在 PC / 局域网部署 LunaTranslator OCR 的场景 | 填 LunaTranslator OCR HTTP endpoint | | 云端 PP-OCRv6 在线 | 中文、日文及拉丁字母多语种 | 使用 PaddleOCR AI Studio PP-OCRv6 异步任务接口;需 AI Studio Access Token | | 云端 百度 OCR | ML Kit / Paddle 漏检兜底 | 需 API Key + Secret,按量计费;5 个 endpoint(标准/含位置/高精度/含位置高精度/网络图片);图片有尺寸 / 宽高比限制 | | 云端 腾讯 OCR | 同上 | 需 SecretId + SecretKey;3 个 endpoint:GeneralBasic / GeneralAccurate / RecognizeAgent(LLM 智能体,已对接 ParagNo 段落分组合并) | | 云端 有道云 OCR | 简单一键 | 需 应用 ID(API Key)+ 应用密钥;langType 跟随源语言自动映射,无需独立选择 |

端侧 OCR 基准测试

测试条件:

  • 设备:高通骁龙 8 Gen 3,16 GB 内存
  • 测试画面:同一张日文漫画截图,全屏 1440×3200
  • 预处理与文本合并关闭;Debug 构建开启详细性能日志
  • 「OCR 耗时」是引擎内部识别耗时;「完整流程」还包含截屏、方向判断、必要的模型切换和渲染
  • 以下是单台设备、单张画面的实测记录,用于比较本项目内不同端侧模型,不代表所有设备和图片的固定表现

速度优先

| OCR 模型 | OCR 耗时 | 完整流程 | 本次画面识别情况 | |---|---:|---:|---| | PP-OCRv5 Mobile | 平均 1.17 秒 | 平均 2.30 秒 | 34 段;速度尚可,但错字、漏字和乱码较多 | | PP-OCRv6 Tiny | 0.65 秒 | 2.00 秒¹ | 29 段;最快,但本次日文识别基本不可用 | | PP-OCRv6 Small | 0.84 秒 | 2.51 秒¹ | 35 段;PaddleOCR 中综合表现最好,大部分正文正确 | | PP-OCRv6 Medium | 3.60 秒 | 6.36 秒¹ | 35 段;找回部分正文,但仍有错字和拆分问题 | | Manga OCR | 5.54 秒 | 6.45 秒 | 17 个完整气泡;竖排组合、语句完整性和整体准确度最好 |

¹ 完整流程包含从上一个 PaddleOCR 模型切换并加载的时间:Tiny 约 0.44 秒、Small 约 0.77 秒、Medium 约 1.80 秒。

精度优先

| OCR 模型 | OCR 耗时 | 完整流程 | 相比速度优先 | |---|---:|---:|---| | PP-OCRv5 Mobile | 3.08 秒 | 4.24 秒 | 多检出 5 段,但误检和乱码增加 | | PP-OCRv6 Tiny | 1.81 秒 | 3.02 秒 | 多检出文本框,但日文仍基本不可用 | | PP-OCRv6 Small | 4.01 秒 | 5.35 秒 | 找回少量小字,同时新增多处误检 | | PP-OCRv6 Medium | 16.85 秒 | 18.16 秒 | 只多保留 2 段,耗时过高 | | Manga OCR | 平均 5.73 秒 | 平均 7.00 秒 | 21 段;找回更多小字,底部复杂区域有所改善,也增加少量噪声 |

本次画面建议优先使用 PP-OCRv6 Small 速度优先,它在速度和日文识别质量之间最均衡;日漫竖排与准确度优先时使用 Manga OCR。本次测试中,PaddleOCR 的精度优先档均未体现出稳定的准确度收益。

端侧翻译基准测试

测试条件:

  • 设备:高通骁龙 8 Gen 3,16 GB 内存
  • 相同的 18 段日文 OCR 结果,翻译为简体中文
  • 开发者选项开启「禁用翻译缓存」,两组均为 0 个缓存命中
  • CPU 推理线程为 TG=6 / PP=6;JNI 原生 B4 批量翻译,共 5 组(4+4+4+4+2)
  • 每个模型都在强制停止应用后重新启动;开启悬浮翻译时自动加载并预热模型
  • 「开始显示」和「全部完成」从翻译批次开始计时,不包含前面的 OCR;以下结果来自 Debug 构建
| 端侧翻译模型 | 模型文件 | 冷启动预热 | 开始显示 | 18 段全部完成 | 本次翻译情况 | |---|---:|---:|---:|---:|---| | Sakura 1.5B(Q5_K_S) | 约 1.20 GB | 2.99 秒 | 3.40 秒 | 10.30 秒 | 中文较自然,但出现一处否定翻反和时间词误译 | | Hy-MT2 1.8B(Q4_K_M) | 约 1.08 GB | 2.38 秒 | 3.51 秒 | 10.84 秒 | 否定和时间词更准确,但部分语境、长句和中文表达较差 |

Sakura 的首批显示快约 0.11 秒,全部完成快约 0.54 秒;Hy-MT2 的冷启动预热快约 0.61 秒。Sakura 本次中文更自然,Hy-MT2 在个别语义细节上处理得更准确。Hy-MT2 的 KV 缓冲为 512 MiB,Sakura 为 224 MiB,在内存较小的设备上需要注意运行时压力。

补充日漫样本(日文 → 简体中文):

  • 使用同一画面和相同的 13 段 Manga OCR 结果;其中 1 段纯数字直接保留,实际翻译 12 段
  • 从翻译批次开始计时,不包含 OCR;首批有效译文不计纯数字直通结果
  • Sakura 在强制停止应用后冷启动,日志显示 0 个缓存命中,TG=6 / PP=6,JNI 原生 B4 共 3 组
  • ML Kit 在同一应用进程内切换后测试,日文和中文语言模型均已下载;没有独立模型预热阶段,初始化开销计入首批有效译文
| 端侧翻译引擎 | 模型文件 | 模型预热 | 首批有效译文 | 12 段全部完成 | 本次翻译情况 | |---|---:|---:|---:|---:|---| | Sakura 1.5B(Q5_K_S) | 约 1.20 GB | 3.66 秒 | 2.06 秒 | 7.15 秒 | 整体质量较好,个别语义有偏差 | | Google ML Kit(ja → zh-CN) | 日文、中文模型各约 30 MB | 无 | 0.32 秒 | 2.68 秒 | 速度明显更快,整体质量较弱 |

这个样本中,ML Kit 的首批有效译文快约 1.74 秒,全部完成快约 4.47 秒;Sakura 的中文质量明显更好,更适合依赖上下文和人物语气的日漫文本。

PaddleOCR 模型:首次使用需要下载或本地导入,默认选择 PP-OCRv5 mobile。也可以按画面和语言切换版本:

PP-OCRv6 在线:这是云端识别服务,需要填写 AI Studio Access Token,不用下载上面的手机端模型。使用时截图会发送到 PaddleOCR 的在线服务。

方向模型:用于判断画面是否旋转、文字是否倒置,已经随应用提供。显示「已就绪」时无需重复下载。

日漫 OCR 模型:第一次使用需要下载或本地导入,模型来源主要在 Hugging Face;网络无法访问时可以使用代理、自定义镜像或本地导入。

模型下载与就绪状态:PaddleOCR、日漫 OCR、方向模型和离线翻译模型都可以在后台下载。离开设置页后任务仍会继续,应用和系统通知会同步显示进度;可以随时取消,网络中断后会自动重试并接着下载。显示「已就绪」后即可使用;如需更换模型,先删除现有模型。

自动方向判别:默认开启,会根据画面和语言选择横排或竖排。遇到误判时,可以手动指定横排、日漫竖排或其它方向。

检测速度与精度:默认使用「速度优先」。遇到小字、浅色字或细长竖排漏检时,可以改为「精度优先」,但识别时间会更长。OCR 高级设置一般保持默认即可;只有持续漏字或误识别过多时再逐步调整,并可一键恢复默认。

手机端性能:本地识别和翻译会根据手机性能自动调整工作量。性能较好的手机等待更短,低端设备可能需要更长时间,无需手动设置线程数量。

百度 OCR 注意事项:图片限制为 最长边 ≤ 4096px、最短边 ≥ 15px、宽高比 1:4 ~ 4:1、base64 后 < 4MB。本项目对前两条会自动缩放兜底,宽高比超限只能调小 / 重画截屏区。

翻译引擎

先按使用场景选,不需要把每个参数都看一遍:

| 引擎 | 适合什么 | 需要准备 | 使用前要知道 | |---|---|---|---| | Sakura(端侧) | 日语漫画、视觉小说、galgame 翻成简中 | 下载约 1.26 GB 模型 | 仅用于日语 → 简中;离线可用,但依赖手机性能 | | Hy-MT2(端侧) | 多语种离线翻译 | 下载约 1.13 GB 模型 | 源语言和目标语言跟随设置;低内存设备可能加载失败 | | Google ML Kit(本机) | 想要更快、免账号的离线翻译 | 首次使用时下载对应语言包 | 速度通常较快,但游戏对话和漫画语境的翻译质量可能不如大语言模型 | | OpenAI 兼容 | 已有 DeepSeek、OpenAI、智谱、SiliconFlow、Ollama 等账号或服务 | Base URL、API Key、模型名 | 可流式显示并自定义提示词;费用和限流由服务商决定 | | Anthropic 兼容 | 已有 Claude 或支持 Anthropic 方式的服务 | 服务地址、API Key、模型名 | 可流式显示并使用自定义提示词;费用和限流由服务商决定 | | DeepL / DeepLX | 想用传统机器翻译,或已有自建 DeepLX | DeepL Auth Key,或 DeepLX 服务地址 | 官方 DeepL 自动匹配 free / pro;测试连接可查看额度 | | 小牛翻译 | 通用文本翻译 | API Key;Flash 还需填写 App ID | 可选择 Flash 或 Pro;Pro 支持边翻译边显示 | | 有道图翻 | 漫画、整张图片和大量文字框 | 有道应用 ID + 应用密钥 | 直接翻整张截图,选择后不再使用上方 OCR 引擎 | | Google | 临时尝试、不想填写密钥 | 无 | 使用非官方端点,国内通常需要代理,可能随时限流或失效 | | 火山引擎 | 长时间循环翻译 | 已开通机器翻译的 AK / SK | 保持默认地区即可;属于联网服务 | | 百度翻译 | 通用文本翻译 | 百度翻译开放平台 APPID + 密钥 | 与百度 OCR 不是同一个产品和账号体系 | | 腾讯翻译 | 通用文本翻译,或已经配置腾讯 OCR | 腾讯 SecretId + SecretKey | 可直接复用腾讯 OCR 的同一组密钥 |

所有联网引擎都可以先点「测试连接」,确认配置正确后再进入游戏。

翻译模式速度参考

| 翻译引擎 | 快速 | 同屏 | 连续 | 推荐用法 | |---|---|---|---|---| | OpenAI 兼容 | 约 1~3 秒,稳定 | 约 2~3 秒,整体表现最好 | 约 2~3 秒,可参考上一画面 | 网络可用时优先选择;推荐同屏 | | Sakura | 约 7~9 秒,比较稳定 | 约 5~11 秒,长页面偶尔需要重试 | 约 6~10 秒,可延续上一画面对话 | 适合离线日文漫画;优先快速,需要连贯性时开启同屏或连续 | | Hy‑MT2 | 约 5~8 秒 | 约 19~35 秒 | 约 20~71 秒 | 适合离线翻译;目前建议使用快速 |

测试时间来自同一台手机和固定画面,仅用于比较不同模式。实际速度会受到设备、画面文字数量、网络和所选模型影响。快速模式等待更短;同屏会结合当前画面的其他文字;连续还会参考上一画面,但可能增加等待时间,也可能延续之前的翻译错误。
OpenAI 兼容接口怎么填?
  • 快速设置:可选择魔搭 ModelScope、OpenRouter、AIHubMix、302.AI、国家超算互联网等服务商;部分服务可选择中国大陆或国际地址
  • Base URL:填写服务商给出的 OpenAI 兼容地址,通常以 /v1/ 结尾
  • API Key:填写服务商生成的密钥;自建服务没有密钥时可留空
  • 模型名:照服务商控制台或自建服务中的名称填写,不要凭示例猜测
  • Prompt 模板:默认是适合游戏对话的口语化翻译提示词;可以修改。未自定义时会跟随界面语言,已经改过的内容不会被自动覆盖
端侧模型下载与性能说明
  • 支持 Hugging Face、hf-mirror、自定义镜像和本地模型导入;后台下载提供通知进度、取消、失败重试和断点续传
  • 使用移动网络或无法判断网络类型时,下载大模型前会先提醒流量风险
  • 启动截屏服务后,已选择并下载好的日漫 OCR、Sakura 或 Hy-MT2 会提前做好准备,减少第一次识别和翻译的等待
  • 一张画面里有多段文字时,Sakura / Hy-MT2 会尽量一起处理;设备不适合时会自动改为逐段处理
  • 手机端翻译目前主要使用 CPU;Sakura 的 Vulkan 加速仍是默认关闭的实验功能,不保证所有设备都能使用或更快
  • Sakura / Hy-MT2 只在受支持的 64 位设备和系统版本上开放

把译文读出来(TTS)

想听译文时,在设置里打开 TTS 并选择一种语音方式:

| 方式 | 适合谁 | 使用说明 | |---|---|---| | 手机系统语音 | 想直接使用手机自带朗读 | 不需要注册账号,也不会产生接口费用;可以选择手机里已有的音色,并调整语速和音调 | | 自建语音服务 | 已经在电脑或局域网运行兼容的语音服务 | 填写服务地址后使用,声音和服务都由自己管理 | | 火山引擎 | 已经开通火山语音服务 | 填写账号信息,可使用预置音色或自己的复刻音色;可能产生费用 | | MiniMax | 想使用更多音色,或自己复刻、设计音色 | 可以搜索、试听和选用音色,也能上传录音复刻声音,或用文字描述设计新音色 | | MiMo | 已经使用 MiMo 语音服务 | 支持预置音色、音色设计和音色复刻,也可以用文字说明想要的说话风格 |

术语与应用上下文

批量导入术语

在术语列表点击「+」,选择「批量导入」,再选择 JSON 文件。文件只需填写原文和固定译名:

[
  {"source": "梓ちゃん", "target": "梓酱"},
  {"source": "先輩", "target": "前辈"}
]

也支持使用中文字段:

[
  {"原文": "梓ちゃん", "译文": "梓酱"}
]

词典库

在「翻译库 → 词典库」中管理查询方式:

循环翻译

显示

预设与悬浮菜单

配置备份与迁移

无障碍与诊断

⚠️ 已知限制

🗺️ 路线图

✅ 现在已经能用

| 功能 | 用户实际能做什么 | |---|---| | 悬浮翻译 | 在游戏、漫画或视觉小说上点悬浮球,直接把译文显示在原文附近或独立悬浮窗口中 | | 输入翻译 | 单击操作球,将输入框里的文字翻译为预设的源语言;双击可选择全屏翻译或划词翻译 | | 快捷开关 | 在手机下拉快捷设置中,直接开启或关闭截屏服务 | | 相册批量翻译 | 一次选择多张图片,离开页面后继续处理;可在任务列表查看进度、原文和译文,并按任务中的样式另存为译图 | | 自动适配画面 | 自动选择译文颜色、背景和字号;漫画场景使用内置气泡检测、原文擦除、背景修复与形状感知排版,失败时安全回退 | | 自动循环 | 固定间隔翻译,或等报幕文字显示完整后再翻;相同画面自动跳过,也可优先识别下半屏对话框 | | 多种 OCR | 使用手机端 ML Kit / PaddleOCR / 日漫 OCR,可单独选择 PP-OCRv5 韩文;也能连接局域网 OCR 或百度、腾讯、有道、PP-OCRv6 在线服务 | | 横排与竖排 | 自动识别旋转画面、横排和竖排日漫;译文可以跟随识别结果,也能手动指定排列和阅读方向 | | 画面方向修正 | 用于画面方向与设备方向不一致的场景 | | 多种翻译方式 | 使用 Google ML Kit 端侧翻译、OpenAI 兼容接口、De

GitHub Stars & Activity

871Stars
35Forks
0Open issues
KotlinLanguage

GitHub Popularity

GitHub stars871
Forks35
Open issues0
Primary languageKotlin
License-
Stars gained today0
Created-
Last pushed-

Trending History

Trending statusnot on today's boards

Related AI Projects

1

agents-io / PokeClaw

Kotlin★ 1,062⑂ 149
2

Pangu-Immortal / MagicWX

Kotlin★ 857⑂ 362
3

jegly / Box

Kotlin★ 845⑂ 53
4

ollama / ollama

Go★ 181,337⑂ 17,947
5

open-webui / open-webui

Python★ 152,659⑂ 22,336
6

HKUDS / nanobot

Python★ 48,435⑂ 8,555
7

chatchat-space / Langchain-Chatchat

Python★ 38,654⑂ 6,265
8

Zackriya-Solutions / meetily

Rust★ 30,978⑂ 3,365

More AI Rankings