把可搜索 PDF 转换为可编辑纯文本
需要把 PDF 内容用于笔记、搜索、引用、无障碍处理或文本编辑器时,可以先提取文字。
可以选择全部页面,也可以只选择需要的页面。输出会用清晰标题区分每一页,并使用 UTF-8 编码。
此工具只在本地读取 PDF 文字层,不执行 OCR,因此只有扫描图片的页面可能没有可提取文字。

选择要读取的页面、查看预览,然后把其中的可搜索文字下载为一个 TXT 文件。
文件只留在当前浏览器,不会上传到服务器。
需要把 PDF 内容用于笔记、搜索、引用、无障碍处理或文本编辑器时,可以先提取文字。
可以选择全部页面,也可以只选择需要的页面。输出会用清晰标题区分每一页,并使用 UTF-8 编码。
此工具只在本地读取 PDF 文字层,不执行 OCR,因此只有扫描图片的页面可能没有可提取文字。
可选择页面
可以提取整个文档,也可以从预览网格中选择单独页面。
清晰页面分段
每个所选页面都会带有标题,方便确认文字来源。
UTF-8 输出
TXT 文件支持 PDF 中已有的中文、英文及其他 Unicode 文字。
在本地打开文件并准备页面预览。
保留全部页面,或只选择需要提取文字的页面。
提取文字层并保存为一个 UTF-8 文本文件。
不会。PDF 文字层只在当前浏览器本地读取。
不会。它只提取已有可搜索文字,不能识别扫描图片中的文字。
可以。提取前可选择或取消选择任意页面。
PDF 按页面位置而不是自然段保存文字,复杂分栏或装饰性排版可能产生不同阅读顺序。
UTF-8 输出可以包含 PDF 文字层中已有的任何 Unicode 字符。