LlamaIndex Extract v2.5 mejora la precisión con razonamiento estructural
LlamaIndex ha lanzado Extract v2.5, mejorando la precisión de la extracción de documentos en todos los niveles y añadiendo citas avanzadas para un mejor anclaje.
Traducido automáticamente del original en inglés.
LlamaIndex ha lanzado Extract v2.5, una actualización significativa de sus agentes de extracción de documentos basados en esquemas que ofrece mayor precisión y un mejor anclaje de datos. Lanzada el 1 de octubre de 2026, esta versión introduce cambios arquitectónicos inspirados en los agentes de codificación para gestionar diseños de documentos complejos de manera más efectiva sin aumentar los costes por página.
Qué ha ocurrido
El núcleo de este lanzamiento es un salto medible en el rendimiento en los tres niveles de servicio: Cost Effective (Efectivo en Costes), Agentic (Agéntico) y Agentic Plus (Agéntico Plus). Según las pruebas internas de referencia en ExtractBench, el nivel Cost Effective ahora logra una puntuación F1 global de valor de 93.9, frente a 87.1, superando el rendimiento anterior del nivel Agentic. El nivel Agentic mejoró de 89.8 a 95.8, mientras que el nivel superior Agentic Plus subió de 95.1 a 96.4. Estas mejoras vienen sin cambios en los precios, ofreciendo mejor rendimiento por dólar para los usuarios existentes.
Más allá de las puntuaciones brutas de precisión, la actualización aborda modos de fallo específicos comunes en el procesamiento real de documentos. Las listas largas, que a menudo hacen que los modelos de visión-lenguaje truncuen la salida o pierdan el rastro de registros repetidos, ahora se manejan con representaciones intermedias que validan contra el esquema del usuario. En una prueba que involucraba una presentación de fondos de 17 páginas, el nivel Cost Effective previamente extraía solo 87 de 238 participaciones; con v2.5, capturó las 238, elevando la puntuación de extracción de documentos de 52.8 a 98.7.
El lanzamiento también mejora cómo el sistema gestiona los registros que abarcan múltiples páginas y formularios escaneados que contienen texto impreso mixto, escritura a mano y anotaciones. Anteriormente, los agentes podían fusionar notas del revisor con valores de campo o dejar de leer en los saltos de página. La nueva versión preserva mejor las relaciones entre campos a través de las páginas y distingue los valores originales de las correcciones manuales, reduciendo la necesidad de limpieza post-extracción.
Cómo funciona
En su interior, LlamaIndex introdujo un nuevo entorno de agente diseñado específicamente para la extracción de documentos. Esta arquitectura se inspira en los avances recientes en agentes de codificación, ajustando finamente las interacciones del modelo para gestionar pasos de visión, razonamiento y verificación de manera más eficiente. Una característica clave es el Razonamiento Estructural, que permite al agente adaptar su esfuerzo según la complejidad del documento. Para documentos simples, procesa rápidamente con menor latencia, mientras que los diseños complejos activan un análisis más profundo para garantizar la máxima precisión.
Otra gran adición son las Citas Avanzadas, ahora disponibles tanto para los niveles Agentic como Agentic Plus. Esta función localiza las cajas delimitadoras de la evidencia de apoyo para los valores extraídos, incluso cuando el texto exacto no aparece palabra por palabra en la fuente. Las puntuaciones de anclaje en ExtractBench aumentaron significativamente, de 46.8 a 80.6 para Agentic y de 46.4 a 82.2 para Agentic Plus. Estas citas permiten a los revisores humanos verificar los datos extraídos contra el documento original, facilitando flujos de trabajo fiables con intervención humana.
El sistema también ganó capacidades nativas de extracción de hojas de cálculo. En lugar de aplanar los libros de trabajo en texto no estructurado, los agentes ahora trabajan directamente con las celdas del libro, preservando la naturaleza estructurada de los datos. Este enfoque ayuda a mantener la integridad de tablas y cuadrículas, que a menudo suponen un desafío para las tuberías estándar de reconocimiento óptico de caracteres.
Detalles clave
- Ganancias de rendimiento: La puntuación F1 de Cost Effective subió a 93.9, Agentic a 95.8 y Agentic Plus a 96.4 en ExtractBench.
- Sin aumento de precio: El precio por página permanece inalterado a pesar de las mejoras de precisión en todos los niveles.
- Citas Avanzadas: Las puntuaciones de anclaje mejoraron a más de 80 para los niveles superiores, proporcionando cajas delimitadoras para la verificación de evidencia.
- Razonamiento Estructural: El agente adapta su esfuerzo de procesamiento según el diseño del documento y la densidad de información.
- Soporte nativo de hojas de cálculo: Los agentes ahora interactúan directamente con las celdas del libro en lugar de representaciones de texto aplanadas.
- Mejor manejo de listas largas: Las representaciones intermedias previenen el truncamiento en documentos con cientos de registros repetidos.
Por qué importa
Para los ingenieros que construyen tuberías de automatización de documentos, la fiabilidad suele ser el mayor cuello de botella. Las generaciones anteriores de herramientas de extracción frecuentemente requerían revisiones manuales extensas porque omitían elementos en listas largas o confundían anotaciones con datos. Al mejorar el anclaje y el razonamiento estructural, Extract v2.5 reduce el volumen de excepciones que los operadores humanos deben manejar. Este cambio hace factible automatizar flujos de trabajo de alto riesgo, como el cumplimiento financiero o la divulgación legal, donde perder una sola línea puede tener consecuencias graves.
La introducción de puntuaciones de confianza emparejadas con citas también cambia cómo los equipos diseñan sus interfaces de revisión. En lugar de confiar ciegamente en la salida o revisar manualmente cada campo, los desarrolladores pueden dirigir solo las extracciones de baja confianza a los revisores humanos. Las citas proporcionan contexto inmediato, permitiendo a los revisores saltar directamente a la parte relevante del documento fuente. Este enfoque dirigido ahorra tiempo y reduce la carga cognitiva, haciendo los flujos de trabajo híbridos humano-IA más sostenibles a escala.
Qué puedes hacer
- Prueba v2.5 en tus documentos más difíciles, particularmente aquellos con listas largas o tablas multipágina, usando tus esquemas existentes.
- Activa las Citas Avanzadas en tu configuración para generar cajas delimitadoras para verificar los valores extraídos.
- Usa las puntuaciones de confianza para filtrar el procesamiento automático y dirigir solo los campos inciertos a los revisores humanos.
- Prueba la extracción nativa de hojas de cálculo para flujos de trabajo intensivos en Excel para preservar la estructura y las relaciones de las celdas.
- Actualiza a v2.5 en tus pipelines actuales para beneficiarte de las mejoras sin cambiar tu infraestructura de precios.
