“Extrais chaque tableau de ce rapport financier de 80 pages dans des fichiers CSV séparés.”
Ce que fait MoClaw
- 1 Indexe le PDF — détecte 23 tableaux répartis sur les pages 12 à 76.
- 2 Pour chaque tableau, infère les en-têtes et lance une extraction Camelot (repli sur l'OCR vision pour les scans de mauvaise qualité).
- 3 Écrit 23 fichiers CSV dans ~/reports/, nommés d'après l'intitulé de section.
- 4 Publie un manifeste dans le chat avec un lien vers chaque fichier et un aperçu de 5 lignes.
Répond : « 23 tableaux extraits vers ~/reports/. Le plus grand est en page 47 (Chiffre d'affaires trimestriel par région, 8 colonnes × 47 lignes). Deux tableaux en pages 22 et 58 avaient des problèmes de mise en page — j'ai utilisé l'OCR vision au lieu de Camelot pour ceux-là, à vérifier avant utilisation. »