PDF转文字
从PDF中提取纯文字,下载为.txt文件。
常见问题
这对扫描版PDF(文字以图片形式存在)有效吗?
无效,它读取的是PDF中已嵌入的文字;扫描页面本质上只是一张图片,没有可供提取的底层文字层。遇到这种情况,可以改用图片转文字工具,对扫描页面的截图使用AI OCR处理。
它会保留原始排版吗?
不会,这是纯文字提取:段落和换行会尽可能按照pdf.js的识别结果保留,但字体、分栏和版式不会被保留。
我的PDF会被上传到哪里吗?
不会,文字提取完全在你的浏览器中使用pdf.js完成,不会有任何内容发送到服务器。