从 PDF 提取可复制文本,支持自定义页码范围导出 TXT
这是浏览器端运行的 PDF 文本提取工具,解决扫描PDF外的PDF文本无法批量复制、排版混乱的问题。
直接在浏览器中解析PDF文件结构,提取嵌入的可编辑文本内容,不处理扫描生成的图片型PDF。
结论:该PDF是扫描件,本工具无法提取。本工具只提取PDF内嵌的可编辑文本,图片形式的扫描PDF需要OCR工具处理。
结论:支持最大 30MB 的PDF文件。所有解析过程在浏览器本地完成,过大的文件会导致浏览器卡顿。
结论:支持自定义提取页码范围。你可以在输入框填写起始和结束页码,只提取你需要的页面内容。
结论:提取后的文本导出为 TXT 纯文本格式。导出文件可以用任意文本编辑器打开编辑。