跳到正文
batonbox

首页PDF 工具PDF 提取文字

PDF 提取文字

把数字 PDF 的文字层提取成纯文本 .txt,可选全部或部分页面。

在浏览器里处理 · 文件不上传

怎么用

  1. 01

    为PDF 提取文字选择文件。支持 PDF。大多数文件留在这个标签页里处理。

  2. 02

    在工作台里设好参数——有预览、裁切框或时间线的工具可以直接看画面——然后点运行。

  3. 03

    下载结果。文件也会进托盘,下一个工具可以直接接着用,不用再上传。

关于这个工具

添加 PDF 后导出。文字层逐页读取并保存为保留换行的 UTF-8 文本,随处可粘贴。扫描版 PDF 没有文字层——它们只是文字的图片——会提示没有找到内容;这个工具不包含 OCR。

常见问题

PDF 提取文字能打开什么?
PDF 提取文字支持 PDF。AVI、WMV、FLV、MPEG、3GP 这类老容器会走服务器编码器。
PDF 提取文字会上传我的文件吗?
浏览器能处理的格式留在这个标签页。浏览器写不了的格式(AVI、WMV、HEVC、AMR 等)会送到编码器,下载后删除。
文件能有多大?
免费:500 MB,每天 8 次导出。Plus(等待名单)会提高每日次数。也可以粘贴公开文件网址导入。

相关工具