Presentamos Precision Mode en AI Extract: logre una precisión de frontera en documentos largos y esquemas complejos donde los enfoques existentes se quedan cortos.
por Jane Zhang, Arnav Singhvi, Ivan Zhou, Archika Dogra, Matthew Ding y Nihit Desai
Todas las empresas tienen datos valiosos atrapados en documentos desordenados y no estructurados. Hoy en día, Databricks Document Intelligence ayuda a miles de clientes a poner sus datos a trabajar, transformando miles de millones de páginas en datos estructurados que impulsan pipelines de producción, agentes y aplicaciones. Clientes como Panasonic, EY-Parthenon e Intercontinental Exchange (NYSE) utilizan Document Intelligence en sus flujos de trabajo más exigentes, procesando millones de documentos a la semana.
Al trabajar con los clientes, notamos varios problemas de extracción difíciles en los que las soluciones existentes de extracción de documentos basadas en reglas o en modelos de lenguaje grande (LLM) se quedan cortas:
Hoy, nos complace presentar Precision Mode en nuestra API de extracción de documentos, ai_extract, lo que establece un nuevo estándar de precisión para las tareas y los documentos empresariales más complejos.

Precision Mode combina nuestros modelos entrenados a medida para la extracción de documentos con un sistema de agentes para ofrecer una extracción confiable y precisa en documentos largos, resultados grandes y esquemas que requieren un razonamiento complejo. En evaluaciones comparativas que abarcan aproximadamente 9,000 documentos complejos, Precision Mode alcanza una calidad de vanguardia, superando por un amplio margen a los modelos de frontera más recientes en precisión de extracción.
"En Intercontinental Exchange, procesamos millones de documentos financieros complejos y muy variables cada mes. Document Intelligence nos ayuda a convertir esa complejidad en inteligencia de mercado estructurada, lo que nos permite avanzar más rápido, ofrecer un mayor valor a nuestros clientes y habilitar flujos de trabajo basados en agentes que aceleran el análisis y la toma de decisiones a escala."—Anand Pradhan, CTO y Head of AI, Mortgage Data en Intercontinental Exchange (NYSE)
Para mejorar la precisión en las tareas de extracción más difíciles, nuestros equipos de investigación e ingeniería abordaron la calidad de la extracción de documentos desde dos niveles: la personalización del propio modelo y la creación de un sistema de agentes eficaz en torno al modelo.
Para validar Precision Mode, diseñamos nuestras evaluaciones comparativas en torno a flujos de trabajo que llevan los enfoques existentes al límite.
En concreto, evaluamos Precision Mode en aproximadamente 9,000 documentos que abarcan los tres desafíos de extracción para los que fue diseñado. La evaluación incluye documentos de hasta 2,000 páginas, facturas con miles de partidas, tablas y gráficos densos de varias páginas, esquemas con más de 300 campos profundamente anidados y tareas con un alto nivel de razonamiento que requieren cruzar información a lo largo de un documento.
Los documentos provienen de dos conjuntos de evaluaciones comparativas:
Juntos, estos conjuntos de datos cubren documentos que incluyen informes 10-K, conocimientos de embarque, manuales técnicos, documentos financieros, notas clínicas, solicitudes de patentes y financiamiento gubernamental, entre otros.
Un punto de partida natural para la extracción de documentos es una única llamada al modelo de frontera: se introduce el documento y el esquema, y se le pide al modelo que devuelva el resultado estructurado. Sin embargo, en los flujos de trabajo densos y complejos que evaluamos, ese enfoque se desmorona rápidamente. Los documentos largos pueden superar los límites de contexto del modelo, lo que genera resultados inexactos e incompletos.
Por lo tanto, realizamos una evaluación comparativa frente a una referencia más sólida y realista: fragmentación y fusión (chunk-and-merge). Dividimos cada documento en fragmentos más pequeños, realizamos la extracción de cada uno de forma independiente y fusionamos los resultados en un producto final, el mismo patrón que vemos utilizar a los ingenieros cuando una sola llamada al modelo no es suficiente.
Probamos el enfoque de fragmentación y fusión utilizando los modelos líderes GPT, Claude y Gemini con sus configuraciones de API predeterminadas. Luego, comparamos cada uno de ellos con Precision Mode en cuanto a la precisión de la extracción. ¹

En todas nuestras evaluaciones comparativas, Precision Mode alcanza una precisión del 94.7 %, superando por siete puntos a la referencia de fragmentación y fusión del modelo de frontera más sólido, GPT-5.6 Sol.
En particular, en flujos de trabajo difíciles con documentos largos, observamos que los modelos de frontera presentaban numerosos modos de fallo operativo, como tiempos de espera agotados en los fragmentos, resultados truncados y fusiones finales incompletas que no se ajustaban al esquema solicitado. Por otro lado, el enfoque basado en agentes de Precision Mode es resistente a estos modos de fallo, y nuestros modelos de extracción entrenados a medida mantienen las extracciones eficientes y precisas.
Para sus tareas de extracción de documentos más complejas, el Precision Mode de AI Extract ya está disponible. Establezca el modo en precision al llamar a la función ai_extract, o active el interruptor de modo de precisión en la UI de extracción de información en la página de Agentes:

Pruebe el Precision Mode de AI Extract
Notas al pie:
¹ Definimos la exactitud como la fracción de objetos extraídos que coinciden con el objeto de referencia. La puntuación depende del tipo. Los tipos primitivos (booleanos, flotantes, enteros, enums) utilizan coincidencia directa. Las cadenas de texto intentan primero una coincidencia directa, luego una coincidencia aproximada y, por último, un juez LLM. Los arrays se puntúan buscando el emparejamiento más cercano entre los elementos predichos y los esperados, y luego calculando el promedio de los pares. Los objetos se puntúan por campo según el tipo y luego se calcula el promedio de todos los campos.
(Esta entrada del blog ha sido traducida utilizando herramientas basadas en inteligencia artificial) Publicación original
Suscríbete a nuestro blog y recibe las últimas publicaciones directamente en tu bandeja de entrada.