“把这份 80 页财务报告里的每个表格都提取成单独的 CSV 文件。”
MoClaw 会做什么
- 1 为这份 PDF 建立索引——在第 12 到 76 页之间检测到 23 个表格。
- 2 对每个表格推断表头并运行 Camelot 提取(对低质量扫描件会回退到 vision OCR)。
- 3 把 23 个 CSV 文件写入 ~/reports/,按章节标题命名。
- 4 在对话里贴出一份清单,附带每个文件的链接和 5 行预览。
回复:“23 个表格已提取到 ~/reports/。最大的是第 47 页(按地区分的季度营收,8 列 × 47 行)。第 22 页和第 58 页上的两个表格有布局问题——我对它们改用了 vision OCR 而不是 Camelot,使用前请再核对一下。”