NullKit

PDF 工具 · 免费浏览器工具

地元 OCR 和可搜索的 PDF 制造商

在扫描的PDF页面中识别英语印刷文本,并创建一个基于图像的新PDF,具有可搜索的文本层。

电话和计算机友好 没有文件上传 自由使用

私人工作空间

将图像仅扫描转换为可搜索的审查副本,而无需上传文档或将文本发送到人工智能服务。

地方处理
只记忆表 新输出文件 分享前评论

您的文件是由已在此选项卡上传的代码处理. 您的设备、浏览器、扩展、下载和任何后续共享仍然是信任界限的一部分。

准备好!选择一个文件开始。

输出是基于图像的新PDF,包含隐藏的认可文本。

选择一个文件开始

将图像仅扫描转换为可搜索的审查副本,而无需上传文档或将文本发送到人工智能服务。

这个工具做什么

一个专注的PDF工作,可见的边界。

将图像仅扫描转换为可搜索的审查副本,而无需上传文档或将文本发送到人工智能服务。

01

英语 OCR 模型

02

可搜索的文本层和提取的 TXT

03

页面为页面 地点进展和输出收件

知道限制

地方并不意味着无限。

浏览器处理避免上传工作流,但可用的内存、PDF结构、数字签名以及您选择的设置仍然重要。

  • 此第一版识别英语印刷文本,并且可以犯错误,尤其是手写、列、低分辨率扫描、异常字体或旋转页面。
  • 页面以隐藏的 OCR 文本层的图像重建;原始链接、表格、标签、附件、签名、 vectors 和可访问性结构不保存。
  • 可搜索的文本可能包含识别错误,不得被视为授权的翻译。

4 地方步骤

如何使用可搜索的PDFOCR

  1. 01

    选择未签名扫描的 PDF。

  2. 02

    选择页面和OCR决议。

  3. 03

    运行本地识别,等待每个选定的页面。

  4. 04

    搜索、复制和检查输出,然后依靠它。

清晰的答案

可搜索的 PDF OCR 问题。

OCR 是否上传 PDF 或认可的文本?

编号: OCR 工作者、英语语言数据和 PDF 处理资产由 NullKit 服务并在当前浏览器中运行。

它是否保留了原始PDF结构?

选择的页面被视为基于图像的页面,具有可搜索的文本层不可见。

它能否认出手写或任何语言?

此初版是用英语打印的文本,手写和其他语言不在其所述支持之外。