PDF 转文本
把最多五个 PDF 的文本提取为纯 .txt 文件。
1 · 选择文件
将 PDF 拖放到这里,或点击浏览
最多 5 个文件,每个不超过 50 MB
提取工具读取 PDF 的文本层。没有文本层的扫描版 PDF(页面照片)几乎提取不出文本;本工具不执行 OCR。
所有处理都通过开源 PDF 库在你自己的设备上进行,不会上传任何内容。
3 · 获取文件
结果会显示在这里。可以逐个下载,也可以打包成 ZIP 一起下载。
如何在线提取 PDF 文本
- 把最多 5 个 PDF 添加到上方的框中。
- 点击提取文本。
- 为每个 PDF 下载一个 .txt 文件,或打包成 ZIP。
常见问题
怎样从无法选中文字的 PDF 里复制文本?
如果 PDF 有文本层,本工具能一次性全部提取,通常比逐页选中更省事。如果什么都提取不出来,那它就是扫描件,需要 OCR。
为什么我的 PDF 提取不出文本?
几乎可以肯定它是扫描文档:页面是没有文本层的图片。从扫描件提取文本需要 OCR,而本工具不执行 OCR。
提取后版式还在吗?
纯文本保留阅读顺序和换行,但不保留字体、分栏和表格。它非常适合把文本喂给其他工具、搜索或翻译。
提取是私密的吗?
是的。文本完全在你的浏览器中读取,文档从不上传到任何服务器。