提取 PDF 文字

把 PDF 中的可搜索文字转换为 TXT

选择需要的页面,把已有文字层提取为 UTF-8 文本文件,PDF 无需上传。

PDF 转文本
文件只留在当前浏览器,不会上传到服务器。
免费在线 PDF 转文本 - 提取 TXT

从 PDF 页面提取文字

选择要读取的页面、查看预览,然后把其中的可搜索文字下载为一个 TXT 文件。

把 PDF 拖到这里

文件只留在当前浏览器,不会上传到服务器。

把可搜索 PDF 转换为可编辑纯文本

需要把 PDF 内容用于笔记、搜索、引用、无障碍处理或文本编辑器时,可以先提取文字。

可以选择全部页面,也可以只选择需要的页面。输出会用清晰标题区分每一页,并使用 UTF-8 编码。

此工具只在本地读取 PDF 文字层,不执行 OCR,因此只有扫描图片的页面可能没有可提取文字。

文字提取内容

可选择页面

可以提取整个文档,也可以从预览网格中选择单独页面。

清晰页面分段

每个所选页面都会带有标题,方便确认文字来源。

UTF-8 输出

TXT 文件支持 PDF 中已有的中文、英文及其他 Unicode 文字。

使用方法

1

选择 PDF

在本地打开文件并准备页面预览。

2

选择页面

保留全部页面,或只选择需要提取文字的页面。

3

下载 TXT

提取文字层并保存为一个 UTF-8 文本文件。

常见问题

PDF 会上传到服务器吗?+

不会。PDF 文字层只在当前浏览器本地读取。

这个工具会执行 OCR 吗?+

不会。它只提取已有可搜索文字,不能识别扫描图片中的文字。

可以只提取部分页面吗?+

可以。提取前可选择或取消选择任意页面。

为什么部分文字顺序不同?+

PDF 按页面位置而不是自然段保存文字,复杂分栏或装饰性排版可能产生不同阅读顺序。

支持哪些语言?+

UTF-8 输出可以包含 PDF 文字层中已有的任何 Unicode 字符。