发票批量提取 Excel 台账

多张数电票拖进来,一张台账导出去 · 先预览修正再下载

正在加载发票提取器...

使用说明

  1. 把发票文件拖入上方区域:XML / OFD / 文字层 PDF 可混合,一次最多 50 个
  2. 每张票提取为表格一行,来源格式以徽标区分
  3. 在表格中直接修改任何字段(如 OCR 后需人工确认的内容);有疑问的行会标黄并给出校验提示
  4. 解析失败的文件在下方列表说明原因,可点「补录此票」手动补一行
  5. 点「导出 Excel」或「导出 CSV」下载台账——导出内容以表格当前态为准

只有 XML 格式的票?可以直接用 数电票 XML 转 PDF 打印;要排版打印多张票面,请用 发票合并打印。

三种格式的提取方式有什么区别?

格式提取原理可靠性
XML结构化源数据直读字段最高(与开票数据一致)
OFD优先读 OFD 内置的结构化字段索引,无索引时按版式坐标定位高
PDF(文字层)按数电票官方版式坐标分区定位文本中高(建议导出前人工复核)

常见问题

怎么把一堆发票快速汇总成 Excel 台账?

把发票文件(XML、OFD 或带文字层的 PDF)一次性拖入本工具,系统会逐张提取发票号码、开票日期、购买方/销售方名称与税号、不含税金额、税额、价税合计等字段并生成表格。你可以在表格里直接修正任何单元格,然后点「导出 Excel」得到 xlsx 台账,或「导出 CSV」得到带 UTF-8 BOM 的通用格式(Excel 直接打开中文不乱码)。

支持哪些格式的发票?扫描件可以吗?

支持三类:①数电票 XML 源文件(最精确);②税务系统开具的数电票 OFD 版式文件;③含文字层的数电票 PDF 版式文件。扫描件和图片型 PDF 没有文字层,无法可靠提取,工具会明确提示——请先用「扫描件转可搜索 PDF」OCR 工具处理后再试。

提取结果不准怎么办?

PDF/OFD 属于版式还原,做不到百分百。因此本工具的设计是「先预览、后导出」:所有字段都可以在表格中直接修改;个别失败的文件会被隔离标红并给出原因,你可以点「补录此票」手工补一行。导出内容以你看到的表格为准,改过什么就导出什么。

上传的发票文件安全吗?

文件仅用于本次解析:在服务器内存中即时读取并提取字段,原始文件不写入磁盘、不做留存;生成的台账文件也只有你自己能通过一次性链接下载。此外提醒:XML 数电票才是唯一合规的归档原件,本工具只做信息汇总辅助,请继续妥善保存 XML 原件。

导出的 Excel 里有哪些列?

来源文件名、发票类型、发票号码、开票日期、购买方名称、购买方税号、销售方名称、销售方税号、不含税金额、税额、价税合计、明细行数、备注、校验提示。金额列在 Excel 中是数字格式可直接求和;校验提示列会标注重复号码、金额勾稽不一致等需要人工核对的情况。

相关工具

关于 iPDFToo 发票批量提取 Excel 工具

iPDFToo 发票批量提取工具是一款免费的在线发票台账生成器,面向财务记账、报销汇总与审计对账场景。 它把全面数字化电子发票的三种常见载体——XML 源文件、OFD 版式文件和含文字层的 PDF 版式文件——批量提取为结构化表格, 字段覆盖发票类型、发票号码、开票日期、购买方与销售方的名称及纳税人识别号、不含税金额、税额、价税合计、明细行数、备注等。 与直接下载不同,本工具强调「先预览修正、再导出」: 所有字段在浏览器表格中可编辑,解析失败的文件被隔离标红并可手动补录, 导出的 Excel(xlsx)金额列为数字格式可直接求和,CSV 带 UTF-8 BOM 保证中文兼容。 工具还会自动进行基础勾稽校验(如不含税金额+税额是否等于价税合计、同一发票号码是否重复出现)并在「校验提示」列中标注。

主要功能

  • 混传最多 50 个 XML/OFD/PDF 文件,逐个解析、失败隔离不阻断
  • 可编辑表格预览,支持手动补录缺失票据
  • 双格式导出:xlsx(表头样式+冻结首行+筛选)与 CSV(UTF-8 BOM)
  • 重复发票号码与金额勾稽自动校验提示
  • 原始文件内存即用即弃,不写磁盘不留存

适用场景

  • 财务每月把进项数电票汇总成 Excel 台账登记
  • 员工报销打包多张发票,一键生成报销明细表
  • 审计/对账时批量核对票面要素

合规提示

根据财会便函〔2023〕18 号等规定,XML 数电票是唯一合规的入账归档原件。 本工具输出的台账仅为信息汇总辅助,不改变原件保存要求,也不提供发票真伪查验功能; 请继续按贵司制度保存 XML 原件并对入账凭证负责。