把 PDF 中的表格和结构化数据提取为 Excel 表格(.xlsx),无需重新录入即可排序、筛选和计算。我们的服务器使用 tabula-py 识别并提取 PDF 中的表格区域,尤其适合发票、银行对账单、财务报表和数据导出文件。
表格线框清晰的 PDF 效果最好。扫描版 PDF(图片)若未先进行 OCR,可能无法很好地提取。来自 Excel、Word 或政府报告的文本型 PDF 效果最理想。
工具会尝试识别文档中的所有表格,每个表格会放在 Excel 文件的单独工作表中。
会。表格提取使用运行在我们服务器上的 tabula-py(基于 Java)完成。您下载结果后,文件会被自动删除。
通常为 15 至 45 秒,具体取决于页数和表格的复杂程度。
如果未检测到表格结构,生成的 Excel 文件可能为空或只包含部分文本。没有表格线框、以文字为主的 PDF 更适合使用 PDF 转 Word 进行转换。
精准地把 PDF 中的表格和数据提取到 Excel 表格。
或将文件拖放到此处支持:PDF