“Extrae cada tabla de este informe financiero de 80 páginas a archivos CSV separados.”
Qué hace MoClaw
- 1 Indexa el PDF: detecta 23 tablas entre las páginas 12 y 76.
- 2 Para cada tabla, infiere las cabeceras y ejecuta la extracción con Camelot (recurre al OCR de visión para escaneos de baja calidad).
- 3 Escribe 23 archivos CSV en ~/reports/, nombrados según el título de la sección.
- 4 Publica un manifiesto en el chat con un enlace a cada archivo y una vista previa de 5 filas.
Responde: «23 tablas extraídas a ~/reports/. La más grande está en la página 47 (Ingresos trimestrales por región, 8 columnas × 47 filas). Dos tablas en las páginas 22 y 58 tenían problemas de diseño: usé OCR de visión en lugar de Camelot para esas, compruébalas antes de usarlas.»