PDF 提取文字
把数字 PDF 的文字层提取成纯文本 .txt,可选全部或部分页面。
在浏览器里处理 · 文件不上传
怎么用
- 01
为PDF 提取文字选择文件。支持 PDF。大多数文件留在这个标签页里处理。
- 02
在工作台里设好参数——有预览、裁切框或时间线的工具可以直接看画面——然后点运行。
- 03
下载结果。文件也会进托盘,下一个工具可以直接接着用,不用再上传。
关于这个工具
添加 PDF 后导出。文字层逐页读取并保存为保留换行的 UTF-8 文本,随处可粘贴。扫描版 PDF 没有文字层——它们只是文字的图片——会提示没有找到内容;这个工具不包含 OCR。
常见问题
- PDF 提取文字能打开什么?
- PDF 提取文字支持 PDF。AVI、WMV、FLV、MPEG、3GP 这类老容器会走服务器编码器。
- PDF 提取文字会上传我的文件吗?
- 浏览器能处理的格式留在这个标签页。浏览器写不了的格式(AVI、WMV、HEVC、AMR 等)会送到编码器,下载后删除。
- 文件能有多大?
- 免费:500 MB,每天 8 次导出。Plus(等待名单)会提高每日次数。也可以粘贴公开文件网址导入。