扫描件 PDF 转文字(OCR)
扫描出来的 PDF 是图片、文字选不中复制不了?上传后 OCR 识别成可复制的文字,同时输出 txt 与可搜索 PDF(原版面上叠加隐形文字层,可全文检索)。默认简体中文+英文,可切换繁中/日/韩/德/法/西/葡。识别在你的浏览器本地完成,文件不上传。
今日免费额度已用 0 / 共 2 次 · 明日 00:00 (UTC) 恢复
- 上传扫描件
- 本地 OCR 识别
- 下载文字结果
拖拽文件到此处
或从设备选择文件,无需注册
选择文件文件在你的浏览器本地处理,不会上传到任何服务器
输出 txt + 可搜索 PDF9 种识别语言可选(默认简中+英)印刷体准确率高 · 手写体不保证
更多说明
浏览器本地识别 · 不上传支持格式:PDF / PNG / JPG处理完即弃 · 文件不离开设备,服务器零留存可自行验证:开发者工具 Network 面板中看不到任何文件上传请求
正式版定价预告 $6.9/月 或 $49/年 · 开始收费前 30 天邮件通知 · Beta 期不收取任何费用
识别效果示例

会议纪要 日期: 2026 年 8 月 3 日 ”地点:上海办公室 主持人:王小明 ”记录人:李华 一、项目进度汇报 本季度产品开发已完成核心功能的百分之八十, 预计九月底前完成全部测试工作。
以上为本站 OCR 引擎对示例扫描件的真实识别输出节选,未经人工修饰。点上方「用示例 PDF 试一试」即可亲自复现。
怎么用(3 步)
1
上传扫描件
支持扫描件 PDF 与 PNG/JPG 图片,识别语言默认简体中文+英文,可切换其他 8 种。
2
本地 OCR 识别
逐页识别并显示进度,印刷体清晰扫描件准确率高;识别模型在浏览器内运行。
3
下载文字结果
同时得到纯文本 txt 和保留原版面的可搜索 PDF,后者可直接全文检索。
适用场景
- 扫描件转文字在线
- PDF 图片文字提取
- scanned PDF to text online
常见问题
含数字签名的 PDF 处理后签名还有效吗?
无效。对已签名 PDF 的任何修改(合并、压缩、加水印等)都会使原数字签名失效——这是 PDF 签名的防篡改设计,并非本站限制。如需签名有效,请先处理后再签名。
试一下 ↑这个工具的处理引擎可信吗?
可信且可验证:基于浏览器内开源引擎(pdf-lib、pdf.js、Tesseract OCR 等)在你的设备上运行,代码公开可审计;处理时打开 DevTools → Network 即可确认没有任何文件上传请求。
试一下 ↑