分类: PDF 工具

PDF 转文本

站方自主规划没找到想要的工具?

在本地逐页提取 PDF 中可选中的文本

在浏览器中完全本地提取 PDF 的文本层,可以一次一页,也可以选择一段页码范围。将结果复制出来,或下载为纯文本文件。

尚未选择文件。

选择一个 PDF 文件以提取其文本。

提取功能仅适用于已包含真实文本的 PDF。以图像形式保存的扫描页面没有文本层,需要 OCR 才能识别,而此工具不执行 OCR。受密码保护的 PDF 同样无法在此打开。

本页的所有处理都在浏览器中完成,不会上传任何内容。

本页的所有处理都在浏览器中完成,不会上传任何内容。

这个工具能做什么

该工具使用基于浏览器的 PDF 引擎打开你的 PDF,读取每个所选页面中已嵌入的文本层,并将它们合并为一份纯文本结果,页与页之间可选择性地插入分隔符。不会上传任何内容:文件完全在你的设备上打开和读取。它只能取出 PDF 中已经以文本形式保存的内容——不会执行 OCR,因此以图像形式保存的扫描页面结果将为空。

使用方法

  1. 从你的设备中选择一个 PDF 文件。
  2. 可选择性地指定要提取的页面,并选择是否在页面之间插入分隔符。
  3. 点击「提取文本」,然后复制结果或将其下载为 .txt 文件。

隐私说明

本工具完全在你的浏览器中运行。输入的内容不会被上传、保存或分享,关闭标签页即随之消失。

常见问题

提取文本时我的 PDF 会被上传吗?
不会。文件会在你的浏览器中打开,其文本层也完全在浏览器中读取;不会向任何地方发送任何内容。
为什么有些页面的结果是空的?
这些页面很可能没有文本层——通常是因为它们是扫描图像,而不是输入或生成的文本。此工具读取已有的文本,不具备识别图像中文字(OCR)的能力。
我可以从受密码保护的 PDF 中提取文本吗?
不可以。此工具无法打开受密码保护的 PDF。