一、快速开始
- 点击工具栏左侧的 打开本地 PDF,在浏览器中选择要阅读的 PDF 文件。
- 翻到想翻译的页面后,在工具栏最右侧选择服务商(如 阿里百炼、智谱、硅基流动、火山),填入你自己的 API Key 并点击 验证;再根据需要选择 OCR 模型 与 翻译模型。
- 点击 框选取译,在页面上拖出一个矩形,松手后即自动识别并翻译该区域文字,译文显示在区域旁(译文框可拖动、缩放,并会记住你的调整)。
- 图片版 PDF(扫描件)可点 整页扫描 一键处理:有缓存直接显示译文,没有则自动分区识别翻译并按原位回填(双页模式两页一起);分区不理想时点 区域编辑 微调后 重新翻译。
提示:阅读与翻译都在本地完成,随时可离线阅读已打开的 PDF;AI 翻译仅在触发时才把页面区域图像/文字发送给对应模型厂商。
二、界面一览
顶部工具栏从左到右依次为:
| 区块 | 包含内容 | 作用 |
| 打开文件 | 打开本地 PDF | 选择要阅读的 PDF(仅本地处理) |
| 翻页导航 | ⏮ ‹ 页码 › ⏭ + 页码输入框 | 首页 / 上一页 / 下一页 / 末页;在输入框直接输页码回车跳转 |
| 缩放视图 | − 百分比 + / 适应宽度 / 适合页面 / 实际大小 / ↺ ↻ | 缩放;适应宽度、适合页面(整页/对开页完整居中)、实际大小(100%);旋转视角 |
| 阅读模式 | 单页 / 双页切换、阅读方向、封面单页 | 单页或对开双页阅读;从左到右/从右到左翻页;双页时首封面单独占一页 |
| 翻译目标 | 翻译目标语言 | 译文输出语言:简体中文 / 繁体中文 / 英文 / 日文(源语言由翻译模型自动识别) |
| 操作 | 框选取译 / 编辑 / 分割框 / 📁 项目 | 区域选译、编辑已存选框、显示/隐藏选框、绑定项目文件夹(持久化) |
| 整页功能 | 整页扫描 / 区域编辑 / 重新翻译 / 显示原文 | 图片版 PDF 专用:整页扫描=有缓存直接显示译文、没有则自动分区识别翻译;区域编辑=手动微调分区;重新翻译=按当前分区重跑;显示原文=译文↔原页切换 |
| 模型设置 | 服务商 ▾ / 模型(OCR、翻译)/ API Key | 切换服务商,其下模型列表与 Key 自动联动;每家 Key 分开保存 |
三、基本阅读操作
- 翻页:点击 ‹ › ⏮ ⏭,或在页码输入框输入数字后回车。
- 缩放:+ / - 逐级缩放;适应宽度 让页面宽度充满视窗;适合页面 完整显示整页或对开页;实际大小 恢复 100%。
- 旋转:↺ 左旋 90°、↻ 右旋 90°,适合扫描方向颠倒的杂志/画册;已保存选框的坐标会自动跟随旋转后的画面。
- 单页 / 双页:双页模式适合杂志对开页阅读;可配合 封面单页 让第一页单独显示;阅读方向 可切换从左到右 / 从右到左的翻页顺序。
四、配置 AI 模型(服务商 / Key / 模型)
本工具不内置任何账号,所有识别与翻译都使用你自己申请的 API Key,按所选服务商计费(多数厂商有免费额度)。
- 在工具栏最右侧服务商下拉中选择一家(如 阿里百炼、智谱、硅基流动、火山引擎·豆包)。
- 点击后面的 获取 Key,会在新窗口打开该服务商控制台;申请并复制你的 API Key,粘贴到 API Key 输入框。
- 点击 验证:工具会发送一个最小请求测试 Key 与所选模型是否可用,通过后即可开始翻译。
- 在模型中选择 OCR 模型(用于识别页面文字)与翻译模型(用于把识别结果翻译成目标语言)。列表会随服务商自动切换,多数为有免费额度的模型。
想一分钱不花?推荐先选这两家(注册即领 Key,调用不收费):
· 智谱:GLM-4.6V-Flash 做 OCR 识别、GLM-4.7-Flash 做翻译——完全免费、无额度限制;
· 硅基流动:DeepSeek-OCR / PaddleOCR-VL-1.5 做识别、Hunyuan-MT-7B 做翻译,选标注「永久免费」的模型即可。
仍按上面流程操作:注册 → 免费申请 Key → 填入 → 验证。注意「免费」指调用不收费,Key 仍是必填的身份凭证——服务商 API 一律要求鉴权,不填 Key 无法调用。其余服务商多为「每个模型赠送 100 万 tokens / 90 天」的限时免费额度。
关于 Key:Key 只保存在你自己的浏览器(localStorage)中,按服务商分开保存、互不串用,关闭页面后仍在。切换服务商需使用对应服务商的 Key——各家 Key 不通用。识别/翻译请求会经网站服务器转发到对应厂商(HTTPS 加密)。
五、框选取译(核心功能)
- 点击工具栏 框选取译 按钮(进入框选模式,按钮高亮)。
- 在页面上按住鼠标左键拖出一个矩形,框住要翻译的文字区域后松手。
- 工具自动对该区域进行 OCR 识别并翻译,译文以悬浮小面板显示在选框旁边(原文框贴哪条边,译文框就出现在对侧:左→右、上→下、右→左、下→上,永远不会遮挡原文)。
- 选框会保留在页面上成为「分割框」;把鼠标移到分割框上可查看译文(悬浮层只显示译文)。
- 按 ESC 或再次点击 框选取译 退出框选模式(小于 8×8 像素的误触拖动会被忽略)。
调整译文悬浮框(拖动 / 缩放 / 记忆)
译文悬浮框结构:顶部握把条用于移动,右下角手柄用于缩放
- 移动位置:把鼠标按住悬浮框顶部的握把条(左侧有 ⠿ 标记)拖动即可;关闭按钮 × 在握把条右侧,点它只关闭、不会误触发拖动。
- 调整大小:拖动悬浮框右下角的小三角手柄可同时改变宽度和高度;译文过长时框内会自动滚动。
- 自动记忆:调整后的位置和尺寸会被记住(按「页码 + 选框位置」分别保存,存在浏览器本地)。下次框选同一区域时,悬浮框会直接出现在你上次调好的位置和大小。
- 恢复默认:双击顶部握把条会清除该区域的记忆并关闭悬浮框,下次再框选就重新走智能定位。
- 提示:拖动与缩放范围被限制在当前页内,不会跑出页面;记忆按页面宽高的比例保存,所以缩放页面或改变窗口大小后位置依然正确。
编辑已保存的选框
- 点击 编辑(与框选取译互斥):可拖动选框调整位置/大小,点选框上的 × 删除,点 ↻ 对框内区域重新识别+翻译。
- 分割框按钮:一键显示 / 隐藏页面上所有已保存的选框。
六、整页扫描
- 整页扫描(一键智能):点 整页扫描,程序先查缓存 —— 本页若已有整页扫描译文就直接显示;没有才把整页按阅读顺序切成若干区域,对文字区域 OCR + 翻译并按原位拼合回填。再点一次「关闭整页扫描」还原原页。
- 区域编辑:点 区域编辑 进入分区编辑层,本地版面分析把整页切成若干区域,以淡色块显示在页面上(文字=淡绿、图片=淡灰蓝)。可拖动移动、拉角缩放、双击或工具条改类型(文字↔图片)、删除误判区域、在空白处拖出新区域;方向键微调、Delete 删除、ESC 取消。此步不花任何 OCR / 翻译额度。
- 重新翻译:调整完分区后点 重新翻译,仅对「文字」类型区域做 OCR + 翻译,译文按原坐标拼合回填;照片/插图(纯图区域)原样保留。文字区域里没识别到文字的会被当作图片跳过;若一个区域都没改,则整页重译。
- 提示:点 显示原文 可在译文与原页之间来回切换对照(独立按钮,不影响扫描状态);未绑定项目时识别结果仅本次会话保留,点 📁 项目 绑定后可落盘缓存,下次打开同一 PDF 自动恢复分区与译文。
七、项目与缓存(推荐)
- 点击 📁 项目 为该 PDF 选择一个项目文件夹(浏览器会弹出文件夹选择,需 Chrome / Edge / Opera 等支持 File System Access 的浏览器)。
- 绑定后,所有分割框的坐标、OCR 原文与翻译结果、整页扫描译文缓存都会保存到该文件夹;再次打开同一 PDF 时可自动恢复,不必重复识别与付费。
- 未绑定项目时功能不受影响,但选框与译文仅在当前会话内保留。
八、常见问题
1. 验证失败 / 提示无效 Key 怎么办?
先确认 Key 属于当前选择的同一服务商(各家不通用)且无复制遗漏;再到对应控制台确认账号有可用额度。若一直失败,可能是网站服务器与模型厂商的通道未连通,请联系站点管理员。
2. 我的 PDF / 内容会被上传吗?
PDF 文件始终只在你的浏览器本地解析,不会上传。但触发 OCR / 翻译时,框选区域的页面图像或识别出的文字会发送到你所选的服务商用于识别与翻译——请勿对机密内容使用。
3. 翻译结果语言不对 / 想换语言?
在工具栏 翻译目标 中选择目标语言(简体中文 / 繁体中文 / 英文 / 日文);源语言由翻译模型自动识别,无需手动指定。
4. 之前翻译过的页面为什么还要重新识别?
整页扫描译文有磁盘缓存(绑定 📁 项目后);框选取译默认不缓存。若整页再次识别,先确认已绑定项目且没有更换服务商/模型——更换翻译模型后会按新模型重新翻译。
5. 双页模式下如何翻译?
整页扫描会同时处理当前跨页的两页;框选取译则每次框选一页内的任意区域。
6. 浏览器兼容性?
基础阅读与翻译功能兼容主流现代浏览器;📁 项目 文件夹持久化需要 Chrome / Edge / Opera。
7. 译文悬浮框挡住内容 / 位置不满意?
悬浮框默认按「原文框贴哪条边就放对侧」摆放,绝不会遮挡原文。若仍不满意,可拖动顶部握把条移动、拖右下角手柄缩放;调整会被自动记住,下次框选同一区域直接复用。想恢复默认摆放,双击顶部握把条即可清除记忆。