PDF 文本提取
使用现有本地 PDF runtime 提取 PDF 文本层,可按页查看、搜索并导出文本或 JSON。
浏览器本地处理
该页面已通过公开目录检查;启用JavaScript后可使用完整功能。
使用指南
如何使用PDF 文本提取
PDF 文本提取只在当前浏览器中处理输入,不会上传、联网或保存用户数据。
输入内容
选择本地 PDF 并指定页码范围或搜索词。
选择处理方式
读取 PDF 文本层并按页展示,不使用 OCR。
检查并导出
检查页码和文本顺序后复制或下载 TXT/JSON。
限制与注意事项
- 扫描件和图片页没有文本层时不会自动识别。
- 字体编码、阅读顺序和复杂布局可能影响文本顺序,重要内容需逐页核对。
- 工具只提供本地辅助处理结果;重要配置、密钥、文档和发布内容仍需在目标环境中复核。
常见问题
输入会上传到服务器吗?
不会。页面只使用浏览器内存、本地文件 API 和已经随站点提供的本地资源。
扫描 PDF 为什么提取不到文字?
本工具只读取文本层,不做 OCR;扫描件需要单独的 OCR 流程。
为什么结果还需要人工检查?
边界语法、地区规范、第三方阅读器和目标运行环境可能存在差异,工具不会替代最终校验。