PDF转文字

从PDF中提取纯文字,下载为.txt文件。

常见问题

这对扫描版PDF(文字以图片形式存在)有效吗?

无效,它读取的是PDF中已嵌入的文字;扫描页面本质上只是一张图片,没有可供提取的底层文字层。遇到这种情况,可以改用图片转文字工具,对扫描页面的截图使用AI OCR处理。

它会保留原始排版吗?

不会,这是纯文字提取:段落和换行会尽可能按照pdf.js的识别结果保留,但字体、分栏和版式不会被保留。

我的PDF会被上传到哪里吗?

不会,文字提取完全在你的浏览器中使用pdf.js完成,不会有任何内容发送到服务器。

相关工具