OPTPDF · 理解文档
识别英文扫描 PDF 的文字
识别英文扫描页中的文字,以 200 DPI 重新生成带文字层的可搜索 PDF,默认上限为十页。中文界面并不表示支持中文 OCR:当前识别范围仅限英文。处理需要已配置的服务,且不会保留原来的矢量、链接、表单和无障碍标签。
◉ 本地工具仅在浏览器中处理文件,无需注册。
此工具所需的处理服务尚未连接,你的文件未被上传。
此工具尚不可用。处理服务配置完成并通过测试后,才能提交文件。
适合哪些使用场景
- 给简短的英文扫描讲义添加可按词句查找的文字层。
- 在把英文扫描内容导出为文字格式之前先做识别。
常见问题与实际限制
可以识别中文扫描件或其他语言吗?
当前只支持并验证了英文。切换网站语言不会改变 OCR 引擎已经验证的语言范围,不能据中文界面推断支持中文识别。
识别时会保留原 PDF 的全部结构吗?
不会。页面先栅格化,再加上识别文字重建,原矢量图形、链接、表单和标签会丢失;文字识别错误也仍需人工校对。