在线把 PDF 转换成文字
导入 PDF,即可获取全部文字或部分页面的文字,直接复制或下载为 .txt。文档在您的浏览器中读取:不会上传。
- 免费
- 全部页面或指定页面
- 复制或下载 .txt
- 100% 隐私
100% 隐私保护 — 一切均在您的浏览器中直接处理:您的文件、语音和图像永远不会发送到 Chatzam 的服务器。
如何提取 PDF 中的文字?
-
导入 PDF
把文档拖到区域内,或从设备中选择。
-
选择页面
提取全部页面,或只提取指定页面;需要时可以开启分页标记。
-
复制或下载
一键复制文字,或下载为 .txt 文件。
直接获取 PDF 文字,无需重新录入
保持行的顺序
文字逐行提取,按照每一页的阅读顺序排列。
页面自由选择
整份文档或只取需要的页面,还可以开启分页标记,方便知道每段文字来自哪一页。
复制或 .txt
把文字粘贴到任何地方,或保存为任何设备都能打开的 .txt 文件。
识别扫描版 PDF
如果 PDF 里只有图片,工具会提示您,并引导您使用文字识别(OCR)。
电子版 PDF 与扫描版 PDF:关键区别
由软件生成的 PDF(Word 导出、电子发票、银行对账单等)包含真正的文字:您可以在 PDF 阅读器中选中它们,本工具也能瞬间提取。扫描版 PDF,或者把文件照片存成的 PDF,里面只有页面图片:即使屏幕上能看到文字,也没有可提取的文本。检查方法很简单:在 PDF 阅读器中试着选中一句话,如果什么都选不中,那就是扫描件。这种情况下工具会提示您,请改用“图片转文字 OCR”,它会通过 OCR 识别文字。
排版会怎么样?
.txt 文件只包含纯文本:粗体、斜体、字体、颜色和图片都不会保留。工具会保持行的顺序,对于信函、合同、文章或课件来说已经足够。如果排版比较复杂,比如多栏排版或含有表格,请检查一下结果:阅读顺序或对齐可能需要稍作调整。部分中文 PDF 因字体编码的原因,提取出的文字可能带有多余空格或乱码,这时也可以改用 OCR。可选的分页标记会标出每一页的开头:方便引用某段文字时注明页码,或回到 PDF 中找到原文位置。
提取 PDF 文字有什么用?
直接获取文字可以省去重新录入的麻烦:把合同中的一段话放进邮件,把参考文献复制到论文里,把文档粘贴给 ChatGPT 或 Claude 让它总结或翻译,或者用“字数统计”统计字数。只提取需要的页面,得到的文字更短,也更好处理。.txt 文件在记事本、手机等任何地方都能打开,而且体积很小。如果您是想修改 PDF 本身,或只保留其中几页,请使用“拆分 PDF”。
常见问题
怎么提取 PDF 中的文字?
导入 PDF,选择全部页面或指定页面,然后复制文字或下载为 .txt。免费使用,无需注册。
为什么我的 PDF 提取不到文字?
您的 PDF 很可能是扫描件:每一页都是一张图片,里面没有文字。请使用“图片转文字 OCR”,它能通过 OCR 识别文字。
可以只提取几页的文字吗?
可以,选择需要的页面,而不是整份文档。开启分页标记后,可以看出每段文字来自哪一页。
PDF 的格式会保留吗?
不会,只按行的顺序提取纯文本。粗体、字体和图片不会保留,表格或多栏排版可能需要人工检查。
我的 PDF 会上传到服务器吗?
不会。文档完全在您的浏览器中读取,不会离开您的设备。