跳到主内容
Paplume
Beta 免费

扫描件 PDF 转文字(OCR)

扫描出来的 PDF 是图片、文字选不中复制不了?上传后 OCR 识别成可复制的文字,同时输出 txt 与可搜索 PDF(原版面上叠加隐形文字层,可全文检索)。默认简体中文+英文,可切换繁中/日/韩/德/法/西/葡。识别在你的浏览器本地完成,文件不上传。

今日免费额度已用 0 / 共 2 次 · 明日 00:00 (UTC) 恢复
  1. 上传扫描件
  2. 本地 OCR 识别
  3. 下载文字结果

拖拽文件到此处

或从设备选择文件,无需注册

选择文件

文件在你的浏览器本地处理,不会上传到任何服务器

输出 txt + 可搜索 PDF9 种识别语言可选(默认简中+英)印刷体准确率高 · 手写体不保证
更多说明
浏览器本地识别 · 不上传支持格式:PDF / PNG / JPG处理完即弃 · 文件不离开设备,服务器零留存可自行验证:开发者工具 Network 面板中看不到任何文件上传请求

正式版定价预告 $6.9/月 或 $49/年 · 开始收费前 30 天邮件通知 · Beta 期不收取任何费用

识别效果示例

扫描件原文(图片,不可选中文字)
扫描件原文(图片,不可选中文字)
会议纪要
日期: 2026 年 8 月 3 日 ”地点:上海办公室
主持人:王小明 ”记录人:李华
一、项目进度汇报
本季度产品开发已完成核心功能的百分之八十,
预计九月底前完成全部测试工作。
本站 OCR 识别结果(真实输出节选)

以上为本站 OCR 引擎对示例扫描件的真实识别输出节选,未经人工修饰。点上方「用示例 PDF 试一试」即可亲自复现。

怎么用(3 步)

1

上传扫描件

支持扫描件 PDF 与 PNG/JPG 图片,识别语言默认简体中文+英文,可切换其他 8 种。

2

本地 OCR 识别

逐页识别并显示进度,印刷体清晰扫描件准确率高;识别模型在浏览器内运行。

3

下载文字结果

同时得到纯文本 txt 和保留原版面的可搜索 PDF,后者可直接全文检索。

适用场景

  • 扫描件转文字在线
  • PDF 图片文字提取
  • scanned PDF to text online

常见问题

扫描件转出来的文字准吗?

印刷体、300dpi 以上的清晰扫描准确率高;倾斜、模糊、手写内容准确率会明显下降,建议识别后抽查关键数字与人名。

试一下 ↑
可搜索 PDF 是什么?

外观和原扫描件一模一样,但每页叠加了隐形文字层——可以选中复制、Ctrl+F 全文搜索,也能被资料库索引。

试一下 ↑
支持哪些语言?

简体中文、繁体中文、英语、日语、韩语、德语、法语、西班牙语、葡萄牙语共 9 种,非英语选项均自动搭配英文混排识别。

试一下 ↑
文件会上传吗?

不会,OCR 识别在你的浏览器本地完成;首次使用会从 CDN 下载识别模型(详见页脚披露)。

试一下 ↑
含数字签名的 PDF 处理后签名还有效吗?

无效。对已签名 PDF 的任何修改(合并、压缩、加水印等)都会使原数字签名失效——这是 PDF 签名的防篡改设计,并非本站限制。如需签名有效,请先处理后再签名。

试一下 ↑
这个工具的处理引擎可信吗?

可信且可验证:基于浏览器内开源引擎(pdf-lib、pdf.js、Tesseract OCR 等)在你的设备上运行,代码公开可审计;处理时打开 DevTools → Network 即可确认没有任何文件上传请求。

试一下 ↑

相关工具