日杂阅读器 · 使用说明

本工具在你的浏览器里本地阅读 PDF,并调用 AI 模型完成「框选取译 / 整页扫描」。PDF 文件本身不会上传到任何服务器。

一、快速开始

  1. 点击工具栏左侧的 打开本地 PDF,在浏览器中选择要阅读的 PDF 文件。
  2. 翻到想翻译的页面后,在工具栏最右侧选择服务商(如 阿里百炼、智谱、硅基流动、火山),填入你自己的 API Key 并点击 验证;再根据需要选择 OCR 模型翻译模型
  3. 点击 框选取译,在页面上拖出一个矩形,松手后即自动识别并翻译该区域文字,译文显示在区域旁(译文框可拖动、缩放,并会记住你的调整)。
  4. 图片版 PDF(扫描件)可点 整页扫描 一键处理:有缓存直接显示译文,没有则自动分区识别翻译并按原位回填(双页模式两页一起);分区不理想时点 区域编辑 微调后 重新翻译
提示:阅读与翻译都在本地完成,随时可离线阅读已打开的 PDF;AI 翻译仅在触发时才把页面区域图像/文字发送给对应模型厂商。

二、界面一览

顶部工具栏从左到右依次为:

区块包含内容作用
打开文件打开本地 PDF选择要阅读的 PDF(仅本地处理)
翻页导航⏮ ‹ 页码 › ⏭ + 页码输入框首页 / 上一页 / 下一页 / 末页;在输入框直接输页码回车跳转
缩放视图− 百分比 + / 适应宽度 / 适合页面 / 实际大小 / ↺ ↻缩放;适应宽度适合页面(整页/对开页完整居中)、实际大小(100%);旋转视角
阅读模式单页 / 双页切换、阅读方向、封面单页单页或对开双页阅读;从左到右/从右到左翻页;双页时首封面单独占一页
翻译目标翻译目标语言译文输出语言:简体中文 / 繁体中文 / 英文 / 日文(源语言由翻译模型自动识别)
操作框选取译 / 编辑 / 分割框 / 📁 项目区域选译、编辑已存选框、显示/隐藏选框、绑定项目文件夹(持久化)
整页功能整页扫描 / 区域编辑 / 重新翻译 / 显示原文图片版 PDF 专用:整页扫描=有缓存直接显示译文、没有则自动分区识别翻译;区域编辑=手动微调分区;重新翻译=按当前分区重跑;显示原文=译文↔原页切换
模型设置服务商 ▾ / 模型(OCR、翻译)/ API Key切换服务商,其下模型列表与 Key 自动联动;每家 Key 分开保存

三、基本阅读操作

四、配置 AI 模型(服务商 / Key / 模型)

本工具不内置任何账号,所有识别与翻译都使用你自己申请的 API Key,按所选服务商计费(多数厂商有免费额度)。

  1. 在工具栏最右侧服务商下拉中选择一家(如 阿里百炼、智谱、硅基流动、火山引擎·豆包)。
  2. 点击后面的 获取 Key,会在新窗口打开该服务商控制台;申请并复制你的 API Key,粘贴到 API Key 输入框。
  3. 点击 验证:工具会发送一个最小请求测试 Key 与所选模型是否可用,通过后即可开始翻译。
  4. 模型中选择 OCR 模型(用于识别页面文字)与翻译模型(用于把识别结果翻译成目标语言)。列表会随服务商自动切换,多数为有免费额度的模型。
想一分钱不花?推荐先选这两家(注册即领 Key,调用不收费):
· 智谱:GLM-4.6V-Flash 做 OCR 识别、GLM-4.7-Flash 做翻译——完全免费、无额度限制
· 硅基流动:DeepSeek-OCR / PaddleOCR-VL-1.5 做识别、Hunyuan-MT-7B 做翻译,选标注「永久免费」的模型即可。
仍按上面流程操作:注册 → 免费申请 Key → 填入 → 验证。注意「免费」指调用不收费,Key 仍是必填的身份凭证——服务商 API 一律要求鉴权,不填 Key 无法调用。其余服务商多为「每个模型赠送 100 万 tokens / 90 天」的限时免费额度。
关于 Key:Key 只保存在你自己的浏览器(localStorage)中,按服务商分开保存、互不串用,关闭页面后仍在。切换服务商需使用对应服务商的 Key——各家 Key 不通用。识别/翻译请求会经网站服务器转发到对应厂商(HTTPS 加密)。

五、框选取译(核心功能)

  1. 点击工具栏 框选取译 按钮(进入框选模式,按钮高亮)。
  2. 在页面上按住鼠标左键拖出一个矩形,框住要翻译的文字区域后松手。
  3. 工具自动对该区域进行 OCR 识别并翻译,译文以悬浮小面板显示在选框旁边(原文框贴哪条边,译文框就出现在对侧:左→右、上→下、右→左、下→上,永远不会遮挡原文)。
  4. 选框会保留在页面上成为「分割框」;把鼠标移到分割框上可查看译文(悬浮层只显示译文)。
  5. ESC 或再次点击 框选取译 退出框选模式(小于 8×8 像素的误触拖动会被忽略)。

调整译文悬浮框(拖动 / 缩放 / 记忆)

× ① 顶部握把条(⠿)— 按住拖动可移动位置 右侧的 × 只关闭面板,不会触发拖动 ② 右下角手柄 — 拖动可同时调整宽高 译文过长时框内自动滚动 ③ 双击握把条 — 清除记忆,恢复智能定位
译文悬浮框结构:顶部握把条用于移动,右下角手柄用于缩放

编辑已保存的选框

六、整页扫描

七、项目与缓存(推荐)

八、常见问题

1. 验证失败 / 提示无效 Key 怎么办?

先确认 Key 属于当前选择的同一服务商(各家不通用)且无复制遗漏;再到对应控制台确认账号有可用额度。若一直失败,可能是网站服务器与模型厂商的通道未连通,请联系站点管理员。

2. 我的 PDF / 内容会被上传吗?

PDF 文件始终只在你的浏览器本地解析,不会上传。但触发 OCR / 翻译时,框选区域的页面图像或识别出的文字会发送到你所选的服务商用于识别与翻译——请勿对机密内容使用。

3. 翻译结果语言不对 / 想换语言?

在工具栏 翻译目标 中选择目标语言(简体中文 / 繁体中文 / 英文 / 日文);源语言由翻译模型自动识别,无需手动指定。

4. 之前翻译过的页面为什么还要重新识别?

整页扫描译文有磁盘缓存(绑定 📁 项目后);框选取译默认不缓存。若整页再次识别,先确认已绑定项目且没有更换服务商/模型——更换翻译模型后会按新模型重新翻译。

5. 双页模式下如何翻译?

整页扫描会同时处理当前跨页的两页;框选取译则每次框选一页内的任意区域。

6. 浏览器兼容性?

基础阅读与翻译功能兼容主流现代浏览器;📁 项目 文件夹持久化需要 Chrome / Edge / Opera。

7. 译文悬浮框挡住内容 / 位置不满意?

悬浮框默认按「原文框贴哪条边就放对侧」摆放,绝不会遮挡原文。若仍不满意,可拖动顶部握把条移动、拖右下角手柄缩放;调整会被自动记住,下次框选同一区域直接复用。想恢复默认摆放,双击顶部握把条即可清除记忆。