“Extrahiere jede Tabelle in diesem 80-seitigen Finanzbericht in separate CSV-Dateien.”
Was MoClaw tut
- 1 Indexiert das PDF – erkennt 23 Tabellen über die Seiten 12 bis 76.
- 2 Leitet für jede Tabelle die Kopfzeilen ab und führt eine Camelot-Extraktion aus (greift bei minderwertigen Scans auf Vision-OCR zurück).
- 3 Schreibt 23 CSV-Dateien nach ~/reports/, benannt nach der Abschnittsüberschrift.
- 4 Postet ein Manifest im Chat mit einem Link zu jeder Datei und einer 5-Zeilen-Vorschau.
Antwortet: '23 Tabellen nach ~/reports/ extrahiert. Die größte ist auf Seite 47 (Quartalsumsatz nach Region, 8 Spalten × 47 Zeilen). Zwei Tabellen auf den Seiten 22 und 58 hatten Layout-Probleme – dafür habe ich Vision-OCR statt Camelot verwendet, prüfe sie vor der Verwendung noch einmal.'