截图翻译
中文English

使用手册

对应版本 0.1.0

一、安装与授权

把「截图翻译」拖进「应用程序」文件夹,双击打开。它是菜单栏应用—— 不会出现在程序坞里,图标在屏幕右上角菜单栏,长得像一本合起来的书。

屏幕录制权限

第一次框选时,系统会要求授予「屏幕录制」权限。这是 macOS 的硬性规定: 任何要读取屏幕像素的程序都得先拿到它,否则截出来是一片空白。

授权路径:系统设置 → 隐私与安全性 → 屏幕录制,勾上「截图翻译」, 然后重启一次本应用(这一步是系统要求的,不重启不生效)。

如果列表里已经勾了却仍然报错,多半是应用被重新编译过、签名变了, 旧的授权记录失效。在列表里用「−」把它删掉再重新添加即可。

二、两种翻译方式

做什么默认快捷键什么时候用
框选翻译⌥A屏幕上有看不懂的字,框一下
输入翻译⌥D想不起某个词的外文,自己敲进去查

快捷键可以在设置 → 快捷键里改。设好之后按一次试试: 没反应多半是被别的应用抢走了——第三方注册的全局快捷键系统不提供查询接口, 我们检测不到,但设置界面会对能查到的冲突给出提示。

框选翻译

按下快捷键后屏幕变暗,拖出一个矩形。松手就开始识别和翻译。

框选期间本应用自己的窗口会暂时隐去,免得挡住你要框的内容—— 拿到画面后立刻恢复,不会一直空着。

输入翻译

打开一个输入框,敲字或粘贴进去,⌘↩ 翻译。结果就在同一个窗口里往下铺, 不会再弹一个面板。

三、翻译通道

设置 → 翻译通道。所有已启用的通道会同时翻译,结果一起展示, 不用等最慢的那家。

三类通道,各有各的用处:

类型代表特点
系统内置系统本地翻译零配置、离线、免费不限量;质量低于云端,作兜底
传统机器翻译DeepL、Microsoft、百度、腾讯快、免费额度大;语种由服务商定死
大模型OpenAI、Claude、Gemini、Grok、Mistral、DeepSeek、Kimi、智谱、豆包,以及「自定义 AI 渠道」长文连贯、语种不受限;按量计费

列表顺序

可以拖动排序,右键也能上移下移。顺序决定两件事:面板上从上到下的展示次序, 以及哪一家的译文写进历史和单词本(排最前的那家)。 系统本地翻译固定展示在最前,因为它最快出结果。

四、各通道怎么配

每一条通道的详情页里都有「去申请密钥」按钮,直接跳到对应的控制台。 下面按从易到难排。

系统本地翻译(不用配)

macOS 自带,装好就能用,永远排在兜底位置。唯一要做的是下载语言包: 翻译时如果缺包,结果里会写明缺哪一对语言,旁边点「安装」直接打开系统的下载面板。

也可以提前下:系统设置 → 语言与地区 → 翻译语言

腾讯云翻译(每月 500 万字符免费)

  1. 打开 腾讯云 API 密钥管理,点「新建密钥」。
  2. 弹窗里 SecretIdSecretKey 会一起给出。 SecretKey 只在这一次可见,关掉就再也查不到—— 先「下载 CSV 文件」或「复制」存好,再勾选确认。
  3. 把两个值分别粘进应用里对应的两栏。
  4. 还要在腾讯云控制台开通「机器翻译 TMT」服务。 只建密钥不开通服务,调用会直接报错。

「地域」一栏保持默认 ap-beijing 即可。

腾讯支持 18 门语言。语言对有方向性——印地语只能与英语互译, 中译印地语走不通。遇到不支持的方向,结果里会灰着写明。

百度翻译(高级版每月 100 万字符免费)

  1. 打开 百度翻译开放平台,注册并进入开发者管理。
  2. 开通「通用翻译 API」,拿到 APP ID密钥
  3. 把两个值填进应用。

标准版有免费额度但语种较少;高级版每月 100 万字符免费,需要完成个人实名认证。

百度标准版支持 28 门语言(中、英、日、韩、法、西、德、意、葡、俄、泰、阿拉伯、 荷兰、波兰、希腊、捷克、丹麦、瑞典、匈牙利、罗马尼亚、保加利亚、爱沙尼亚、芬兰、 斯洛文尼亚、越南、粤语、文言文、繁体中文)。 土耳其语、印地语、印尼语等需要更高档位,标准版调用会被拒。

DeepSeek

  1. 打开 DeepSeek 开放平台,创建 API Key。
  2. 把 Key 填进应用。
  3. 模型一栏点右边的 → 从服务商获取,选一个即可。

接口地址保持默认 https://api.deepseek.com

Kimi(月之暗面)

  1. 打开 Kimi 开放平台,新建 API Key。
  2. 填进应用,模型点 拉取后选。

接口地址保持默认 https://api.moonshot.cn/v1

免费额度的每分钟请求数限制很低(实测 3 次/分钟)。 连续翻译时可能撞到「请求过于频繁」,等一会儿即可,或者充值提额。

智谱 GLM

  1. 打开 智谱开放平台,创建 API Key。
  2. 填进应用,模型点 拉取后选。

接口地址保持默认 https://open.bigmodel.cn/api/paas/v4

豆包(火山方舟)

  1. 打开 火山方舟控制台, 在「API Key 管理」新建一个 Key,形如 ark-…
  2. 在「开通管理」里开通你要用的模型——没开通的模型调用会直接报错。
  3. 把 Key 填进应用,模型点 拉取。列表里就是你已开通的那些。

接口地址保持默认 https://ark.cn-beijing.volces.com/api/v3

如果你在方舟里创建了「在线推理」接入点,模型栏填 ep-… 开头的接入点 ID 也行, 两种都支持。

自定义 AI 渠道(接任何一家)

凡是提供 OpenAI 格式接口的服务都能接:OpenRouter、硅基流动、各类中转站, 以及本机跑的 Ollama / LM Studio。

  1. 接口地址:填服务商文档里的根地址,/v1 这一层为止, 后面的 /chat/completions 不要填。
    本机 Ollama 通常是 http://localhost:11434/v1
  2. API Key:填服务商给的。本机 Ollama 没有密钥,随便填一个非空值即可。
  3. 模型:点 拉取(服务商支持 /models 时), 或按文档里的模型名一字不差地填。

填完之后

点通道详情页里的「验证」。它会真的发一句话过去翻译, 通了会显示耗时和试译结果,不通会把服务商返回的原文照实贴出来—— 密钥错、余额不足、模型名不对,各是各的报错,照着改就行。

不确定某一栏该填什么?把配置页整个截图,发给任意 AI 助手问「这几栏分别填什么」。 它们认识这些平台的控制台,会告诉你去哪儿复制。

五、语言方向

默认是「自动检测 → 你的系统语言」。

面板和输入窗口顶部都能随时改方向,改完立刻用同一段原文重译,不用再截一次。 常用的 11 门语言在第一层,其余收在「更多语言」里,一共 34 门。

六、结果面板

面板默认不置顶,点窗口外面就收起来。想让它留着,点右上角的图钉。

每一块(原文、每家译文)都自带一排按钮:

自动补齐

菜单里的开关。开启时,框选把句子切断了会自动补上缺的部分再翻译; 关闭则截到什么翻什么,一个字都不多取。默认开——绝大多数时候框选都会切到半句。

七、单词本与历史翻译

翻译之后点星标,这一条连同原文、译文、语言对和出处一起存进单词本。 历史翻译则是自动记录的,不用手动操作。

单词本里可以看音标、朗读、复制,也可以导出成 JSON 带到别的机器上。 历史翻译可以导出成 Markdown——读完一本书就有一份完整译稿。

词条讲解

单词本里每一条都能点「使用教学」,让大模型讲解词义、使用场景、常见搭配和易混词。 没有配大模型时会退回系统词典。

这一步花的是你自己的 API 钱,所以默认会先问一次。 生成结果存在本地,同一个词再看不会重复请求。可以在设置里关掉这个确认。

八、导入导出

设置 → 备份与迁移可以导出全部配置(语言方向、快捷键、翻译通道), 换新设备导入即可。

导出时有一个「同时导出 API 密钥」的开关,默认关闭。 打开后导出的文件含明文密钥,等同账号凭证,不要发给别人、不要放进云同步目录。

单词本单独导出。导入时已有的词会跳过,不会覆盖。

九、常见问题

框选之后提示「没有识别到文字」

先确认屏幕录制权限给了。若权限正常,试试关掉「自动补齐」再框一次, 或者把框选范围放大一点、正好框住整段正文。

某一家译文明显不对,像音译

多半是原文语种判错了。看原文旁边的「· 识别为 ○○」是不是对的; 不对的话在顶部把原文语言指定成正确的那一门。

某一路显示「熔断冷却中」

那一家连续失败了几次,暂时跳过它,过几分钟自动恢复。 其余通道照常工作。

大模型通道报「接口错误 404」

模型名不对,多半是那个模型已经下线了。点模型框右边的 重新拉一次清单再选。

菜单栏图标不见了

系统设置 → 控制中心 → 允许在菜单栏显示,把「截图翻译」关掉再打开。 重新编译导致签名变化时会出现这个情况。