扫描件 PDF 转文字(OCR)
扫描出来的 PDF 是图片、文字选不中复制不了?上传后 OCR 识别成可复制的文字,同时输出 txt 与可搜索 PDF(原版面上叠加隐形文字层,可全文检索)。默认简体中文+英文,可切换繁中/日/韩/德/法/西/葡。识别在你的浏览器本地完成,文件不上传。
- 上传扫描件
- 本地 OCR 识别
- 下载文字结果
拖拽文件到此处
或从设备选择文件,无需注册
文件在你的浏览器本地处理,不会上传到任何服务器
正式版定价预告 $6.9/月 或 $49/年 · 开始收费前 30 天邮件通知 · Beta 期不收取任何费用
识别效果示例

会议纪要 日期: 2026 年 8 月 3 日 ”地点:上海办公室 主持人:王小明 ”记录人:李华 一、项目进度汇报 本季度产品开发已完成核心功能的百分之八十, 预计九月底前完成全部测试工作。
以上为本站 OCR 引擎对示例扫描件的真实识别输出节选,未经人工修饰。点上方「用示例 PDF 试一试」即可亲自复现。
怎么用(3 步)
上传扫描件
支持扫描件 PDF 与 PNG/JPG 图片,识别语言默认简体中文+英文,可切换其他 8 种。
本地 OCR 识别
逐页识别并显示进度,印刷体清晰扫描件准确率高;识别模型在浏览器内运行。
下载文字结果
同时得到纯文本 txt 和保留原版面的可搜索 PDF,后者可直接全文检索。
适用场景
- 扫描件转文字在线
- PDF 图片文字提取
- scanned PDF to text online
常见问题
印刷体、300dpi 以上的清晰扫描准确率高;倾斜、模糊、手写内容准确率会明显下降,建议识别后抽查关键数字与人名。
试一下 ↑外观和原扫描件一模一样,但每页叠加了隐形文字层——可以选中复制、Ctrl+F 全文搜索,也能被资料库索引。
试一下 ↑简体中文、繁体中文、英语、日语、韩语、德语、法语、西班牙语、葡萄牙语共 9 种,非英语选项均自动搭配英文混排识别。
试一下 ↑不会,OCR 识别在你的浏览器本地完成;首次使用会从 CDN 下载识别模型(详见页脚披露)。
试一下 ↑无效。对已签名 PDF 的任何修改(合并、压缩、加水印等)都会使原数字签名失效——这是 PDF 签名的防篡改设计,并非本站限制。如需签名有效,请先处理后再签名。
试一下 ↑可信且可验证:基于浏览器内开源引擎(pdf-lib、pdf.js、Tesseract OCR 等)在你的设备上运行,代码公开可审计;处理时打开 DevTools → Network 即可确认没有任何文件上传请求。
试一下 ↑