PDF 转文本
从任意 PDF 中提取文本,并将其复制或下载为纯 .txt 文件。一切都在浏览器中运行,因此您的文档绝不会离开您的设备。
将 PDF 文件拖放到此处
或
如何从 PDF 中提取文本
- 将单个 PDF 文件拖入上传区域,或点击从设备中选择一个。
- 选择是否在页面之间包含页面标记,这有助于您定位内容。
- 点击"提取文本",等待文本从每一页中提取出来。
- 将结果复制到剪贴板,或下载为 .txt 文件。
常见问题
我的 PDF 文件会上传到服务器吗?
不会。PDF 转文本使用 pdf.js 完全在您的浏览器中运行,因此您的文档绝不会离开您的设备。
此工具可以提取哪种文本?
它提取 PDF 的内嵌文本层。没有文本层的扫描或基于图片的 PDF 将返回很少或没有文本。
此工具是否执行 OCR?
不会。Handio 不执行光学字符识别。如果您的 PDF 是扫描件,则需要专用的 OCR 工具来恢复文本。
为什么文本间距有点异常?
PDF 将文本存储为定位的片段,而非连续的段落。分栏和表格等复杂布局可能会产生异常的间距和换行。
相关工具
为什么要使用 PDF 转文本?
提取 PDF 的文字以便重复使用——粘贴到编辑器中、引用报告内容,或在长文档中搜索,而无需重新输入任何内容。
- 将 PDF 中的引文和段落复制到文档或电子邮件中。
- 让 PDF 的内容可在文本编辑器或电子表格中搜索和编辑。
- 从报告和论文中提取原始文本,用于分析、翻译或总结。
提示与限制
PDF 转文本使用 pdf.js 提取内嵌文本层,因此快速且私密,但它不执行 OCR。扫描文档将返回很少或没有文本,多栏页面或表格等复杂布局可能以异常的间距输出。