PDF 工具

从 PDF 复制可选择的文字

从带文字层的 PDF 复制文本并保存为 .txt。这不是 OCR,无法识别扫描页照片。

在本机打开带文字的 PDF。纯图片扫描件需要另用 OCR 工具。

  • 在浏览器中处理
  • 不上传
  • 即时
  • 免费

使用方法

  1. 在您的设备上选择一个PDF。
  2. 如果您希望为每个页面添加标签,请保留分页符,或跳过多余的空白行。
  3. 选择提取文本。工作在您的浏览器中运行。
  4. 复制结果或下载.txt 文件。

为何选择 NEXNARA

  • 私密

    数据只留在浏览器中。

  • 即时

    结果立即显示。

  • 无需上传

    不会向 NEXNARA 服务器发送任何内容。

  • 随处可用

    无需安装。

了解更多

什么是PDF转文本?

PDF to Text 是一个 PDF 文本提取器,适用于已包含文本图层的文件。它按页面顺序复制该文本。它不是 PDF OCR,并且它不会从页面照片中读取文本。

限制

复杂的列或表格可能与视觉阅读顺序不匹配,因为PDF文本对象按其自己的顺序存储。仅图像扫描几乎没有或没有文本可供提取。受密码保护的PDF无法打开。为了保护浏览器内存,超过 80 MB 或 400 页的文件将被拒绝。

隐私

PDF 保留在您的浏览器中。它没有上传到NEXNARA服务器。

常见问题

这适用于扫描的PDF吗?

通常不会。如果文件是页面照片,则没有要复制的文本层。为此,请使用专用的 PDF OCR 工具。

为什么文本顺序不同?

PDF 将文本存储为对象,并不总是按照您阅读它们的顺序。多列布局和表格可以按不同的顺序出现。

我的PDF已上传吗?

不需要。提取在您的浏览器中运行。文件未发送至NEXNARA。

我可以下载文字吗?

是的。解压后使用复制或下载.txt。