平时看英文文档、刷论文,最想要的就是双语对照:原文在上、译文在下,对着读。但市面上的方案用下来总有点不爽:免费档倒是能一直用,可只给平台自带的普通模型,翻译质量平平;想用更强的模型,就得按月订阅。
后来想通了:大模型厂商为了拉新,免费或极低价的 API 一大把,翻译网页用的 token 又少得可怜。缺的只是一个把两边拼起来的插件。这个开源项目「极简翻译」干的就是这件事。拼完的效果是这样:
下面从零开始搭一遍,十分钟左右能跑通。
第一步:装插件
插件没上架商店(在排期),从源码构建。本机需要有 Node.js,没有的话去 nodejs.org 下个 LTS 版,npm 会随 Node 一起装好。然后三条命令:
git clone https://github.com/shen1997-hub/llm-translate-minimal.git
cd llm-translate-minimal
npm install && npm run build
构建产物在 .output/chrome-mv3,接着:
- 地址栏打开
chrome://extensions - 打开右上角「开发者模式」
- 点「加载已解压的扩展程序」,选
.output/chrome-mv3目录
(此处配 chrome://extensions 加载扩展截图)
不想本地构建的话,如果 Releases 页面已提供打包好的 zip,也可以下载解压后同样走「加载已解压的扩展程序」;没有就按上面三条命令自己构建。
第二步:白嫖一个模型 API
以硅基流动(SiliconFlow)为例,它平台上有一批标注「免费」的开源模型,注册就能调:
- 打开硅基流动官网(cloud.siliconflow.cn)注册登录
- 控制台 →「API 密钥」→「新建 API 密钥」,复制保存好
- 在「模型广场」挑一个标注免费的模型,比如 Qwen 系列的 7B 档,记下完整模型名,下一步要填
注意:免费模型名单随平台调整,具体有哪些、限不限速,以硅基流动官网模型广场的当前信息为准。
免费档应付日常文档阅读基本够用。对翻译质量有更高要求的话,还有几个低成本备选:
- DeepSeek:极低价付费 API,翻一整页长文大概几分钱,充几块钱能用很久
- 智谱 GLM:常有免费额度和低价档
- Ollama:在自己电脑上跑开源模型,完全免费、完全离线,这个我下一篇单独写
第三步:把 key 填进插件
点扩展详情页的「扩展程序选项」(或者右键工具栏图标 →「选项」),打开设置页,添加一个供应商:
| 字段 | 填什么 |
|---|---|
| 名称 | 硅基流动(自己认得就行) |
| Base URL | https://api.siliconflow.cn/v1 |
| API Key | 第二步拿到的密钥 |
| 模型 | 你选的免费模型名,例如 Qwen/Qwen2.5-7B-Instruct |
(此处配 options 设置页添加供应商截图)
保存后点工具栏上的扩展图标打开 popup,选中刚配的供应商和模型,目标语言选「简体中文」,完事。
(此处配 popup 选择供应商与模型截图)
插件接的是 OpenAI 兼容协议,所以以后想换 DeepSeek,只要再添加一个供应商:Base URL 填 https://api.deepseek.com、模型填 deepseek-chat,别的照旧。供应商可以存多个,换模型就是 popup 里下拉切一下的事。
第四步:开翻
随便打开一个英文页面,点扩展图标,点「翻译本页」。发起请求前 popup 会先算一下这次要翻多少段、大概烧多少 token,心里有数再确认。译文逐段出现在原文下方;刷 X/Twitter 这种动态加载的页面,往下滚的时候新内容会自动补翻;个别段落翻失败了就单独重试那一段,不用整页重来。
平时用得更多的其实是划词:选中任意文本,旁边冒出来一个小圆钮,点它弹浮窗看译文,可以朗读、复制、把浮窗钉住。目标语言 12 种;划的内容中文占比过半会自动译成英文,不用手动切方向。设置里还能把小圆钮换成一只猫——选中文字它会跳过来蹲在选区旁边,没用,但挺开心的。
为什么说它几乎不花钱
免费模型是一方面,插件自己也做了几件事帮你省 token:
- 译文存在浏览器本地 IndexedDB 里,按「文本 + 模型 + 目标语言」分键。同一个页面再看一遍,命中缓存的段落直接读,不重复扣
- 翻译前预估:popup 先报段落数和 token 量级再发请求,不会手滑把一篇长文整本发出去
- 并发有上限,撞到供应商限流(429)会自动退避重试,免费额度不会被瞬间打爆
顺带说隐私:API Key 只存在你自己浏览器的 chrome.storage.local,请求只发给你配的那个域名,插件没有自己的服务器。代码开源,不放心的可以翻一遍网络请求的部分。
几个可能被问到的问题
支持哪些模型? 任何提供 OpenAI 兼容 /chat/completions 接口的服务:DeepSeek、GLM、OpenAI、Moonshot、本地 Ollama 都行,Claude 的协议也支持。支持 response_format: json_object 的模型体验最好,不支持的插件会自动降级,不影响用。
Firefox 呢? 能。npx wxt build -b firefox 构建一份,about:debugging 里加载临时扩展,需要 Firefox 127 以上。
付费模型到底多少钱? 给个数量级:一篇几千词的英文长文,输入输出加起来一两万 token,按 DeepSeek 刊例价折算是几分到一毛钱。具体数字不用猜,popup 翻译前会按当前页面实际算给你看。
和沉浸式翻译比呢? 它功能多得多,PDF、epub、字幕都有,需要这些的继续用它就好。这个插件只做网页翻译这一件事,好处是轻、免费模型能跑、key 是自己的。
最后
项目地址:**github.com/shen1997-hu… 协议,TypeScript + WXT(Manifest V3)。觉得有用欢迎 star,踩到坑欢迎提 issue,都会回。
下一篇写 Ollama 完全离线方案:模型跑在自己电脑上,不注册、不联网、零花费,配合这个插件照样双语对照。感兴趣的可以蹲一下。