关于此工具
将 PDF 的文本层提取为干净、可复制的纯文本。拖入文件后,每一页会按顺序读取,页与页之间带有页码分隔标记,随后你可以将结果复制到剪贴板或下载为 .txt 文件。
一切都在你的浏览器本地运行——文档不会离开你的设备,也不会被存储在任何地方。因此处理合同、发票、账单等敏感文件同样安全。
请注意,本工具读取的是 PDF 查看器中可选中、可复制的内嵌文本层。扫描件只是页面的照片,没有文本层,因此提取结果会是空的——这种情况请改用 OCR 工具来识别文字。
常见问题
为什么我的 PDF 提取不出任何文本?
它很可能是扫描件:页面是没有可选中文本层的图片。本工具不做 OCR——请把页面交给本站的图片 OCR 工具来识别扫描文字。
PDF 会上传到服务器吗?
不会。文本由完全在你浏览器标签页中运行的 PDF 引擎提取,文件不会离开你的设备——处理机密文档也安全。
会保留原始排版吗?
PDF 标注的换行会被保留,但分栏、表格和精确间距会按阅读顺序展平——PDF 是一种印刷格式,无法总是完美还原排版。
可以只提取部分页面吗?
工具会提取所有页面,并在页与页之间插入“第 N 页”分隔符,方便你在输出框中快速找到并只复制需要的部分。