Por qué los PDFs son problemáticos
Los PDFs fueron diseñados para visualización, no para extracción de datos. Los extractos bancarios presentan desafíos específicos.
Error 1: Líneas partidas
Descripciones largas se dividen en múltiples líneas:
```
01/01 TRANSFERENCIA SEPA A
EMPRESA XYZ SL NIF B12345678
REF 123456 -500,00
```
**Solución:** StatementBridge une automáticamente líneas relacionadas.
Error 2: Saltos de página
Una transacción empieza en la página 1 y termina en la página 2. Copiar manualmente pierde datos.
**Solución:** Procesamos el documento completo y mantenemos la integridad de las transacciones.
Error 3: Columnas invisibles
Los PDFs no tienen columnas reales — usan espaciado visual. Copiar a Excel mezcla todo.
**Solución:** Reconstruimos la estructura de columnas a partir del layout visual.
Error 4: Totales y subtotales
Los extractos incluyen líneas de resumen que no son transacciones:
```
Total Débitos: 1.234,56
Total Créditos: 2.345,67
```
**Solución:** Filtramos automáticamente líneas que no son movimientos.
Error 5: Formatos de fecha inconsistentes
Algunos bancos usan DD/MM/AAAA, otros DD-MM-AA.
**Solución:** Normalizamos todas las fechas a un formato consistente.
Resultado limpio
El archivo final tiene solo lo que importa: movimientos con fecha, descripción, importe y saldo.