PDF 转 Excel 后表格乱了?问题通常出在这里
来自 FreePDF 团队 ·
PDF 表格转到 Excel 后出现错列、断行、数字进错格,往往不是转换器“看不懂表格”,而是源文件只看起来像表格。PDF 记录的是页面上文字的位置,未必保留 Excel 需要的行列关系。
转换时到底在还原什么
从 Excel、财务系统导出的表格,文字位置和列边界通常稳定,容易重建。扫描件、截图、合并表头很多的报告,则只能根据像素或不规则间距猜结构。
- 最容易成功:原生电子 PDF、列整齐的报表。
- 必须复核:多行单元格、合并表头、跨页表和表格外的合计。
- 先 OCR:照片和扫描件,因为里面根本没有可选中的表格文字。
别逐格修,先判断错在什么地方
把原 PDF 和工作簿并排打开。如果整列错位,修正受影响范围后立即看下一页是否也有同样模式。原稿没有明确列界时,手工重建这一张表可能比反复转换更安全。扫描表先 OCR,但金额、日期、负号和小数点仍应重点核对。
导入后先做四项检查
- 对照原表核实行数和列标题。
- 每页抽查开头、中间和最后一行。
- 独立核算合计;一处小数点或负号错位就可能改变结果。
- 确认数值无误后,再设置日期和数字格式。
常见问题
为什么一张表被拆到多个工作表?
分页和重复表头会让 PDF 看起来像多张表。先按页检查,再合并已经核实属于同一张表的区域。
Excel 能把扫描表格完美还原吗?
不能保证。OCR 能认出文字和数字,但图片并不带真实单元格;把结果当作起点,凡是影响计算或决策的数据都要逐项复核。