LandingAI liberó Agentic Document Extraction (ADE) Gen2, una reconstrucción de su plataforma de inteligencia documental en torno a una nueva familia de modelos llamada DPT-3.
La primera generación trataba un documento como una lista plana de fragmentos. Gen2 lo trata como un árbol, lo cobra por los caracteres que devuelve en vez de por página, y ancla cada respuesta a una línea o a una palabra específica de la hoja. El equipo de LandingAI ordena el lanzamiento en tres ejes: costo accesible, salidas listas para agentes y anclaje atómico.
¿Se puede desplegar hoy?
Sí. ADE Gen2 ya está en disponibilidad general. Quien programa puede empezar gratis en el entorno de pruebas de ADE. Las empresas pueden correrlo en nube de Estados Unidos o de Europa, en su propia nube privada virtual sobre AWS, Azure o Google Cloud, dentro de Snowflake, o en sus propias instalaciones, incluidos entornos aislados de la red.
Dos modelos de análisis en vez de uno
Gen2 divide el análisis en dos modelos, de manera que la carga de trabajo elija el precio.
DPT-3 Verity transcribe de forma determinista los documentos creados digitalmente y devuelve un recuadro delimitador y un puntaje de confianza para cada palabra. Apunta a texto de alto volumen, tablas y campos simples de formulario.
DPT-3 Pro lee primero la disposición de la página y después las palabras, detecta tipos de bloque que van desde tablas y figuras hasta notas al margen y firmas, los devuelve en orden de lectura, y maneja páginas escaneadas, escritura a mano, alfabetos no latinos y fórmulas en LaTeX. Según LandingAI, DPT-3 Verity cobra alrededor del 40% de los créditos que cobra DPT-3 Pro, y el ruteo automático entre ambos está planificado para el otoño boreal de 2026.
El cambio de precios es la noticia real
Con DPT-2, cada página costaba tres créditos planos. Con DPT-3, el consumo de créditos es la suma de un componente por página y otro por caracteres de salida.
| Modelo y nivel | Por página | Por cada 1.000 caracteres |
|---|---|---|
| DPT-3 Pro, nivel prioritario | 1 crédito | 0,5 créditos |
| DPT-3 Verity, nivel prioritario | 0,3 créditos | 0,2 créditos |
| DPT-2 (generación anterior) | 3 créditos | no aplica |
El nivel estándar reduce a la mitad ambas tarifas. Así, un análisis con Pro sobre 12 páginas que devuelve 48.120 caracteres suma 36,1 créditos en prioritario y cerca de la mitad en estándar. Los totales se redondean hacia arriba al décimo de crédito, y los metadatos de la respuesta reportan cada entrada del cálculo.
Los niveles de servicio son la segunda palanca. El prioritario está pensado para cuando una persona o un agente está esperando. El estándar corre de forma asíncrona a la mitad del precio y sirve para procesos que toleran minutos u horas. Ojo con dos detalles: las llamadas síncronas siempre se facturan como prioritarias, y el propio entorno de pruebas corre en prioritario.
LandingAI proyecta reducciones de costo de entre 25% y 80% en cargas mixtas, y afirma que el análisis con Verity en nivel estándar queda bajo un centavo de dólar por página. Conviene tratar esas cifras como estimaciones del proveedor hasta medirlas con la mezcla real de documentos de cada equipo, porque el componente por caracteres implica que una página densa puede terminar costando más que antes.
Bloques, no fragmentos
La respuesta de Parse v2 tiene tres campos de primer nivel: markdown en orden de lectura, metadata y structure. La estructura es un nodo de documento cuyos hijos son páginas, y cuyos hijos a su vez son bloques. Los tipos de bloque incluyen texto, tabla, celda de tabla, figura, nota al margen, atestación, logo, tarjeta y código de escaneo.
Cada bloque lleva un identificador semántico con la forma tipo-índice, estable dentro de una respuesta pero no entre análisis sucesivos, más un objeto de anclaje con el número de página, un rango dentro de la cadena de markdown y un recuadro delimitador normalizado.
La salida en markdown también quedó estandarizada. Las figuras usan elementos del estilo <figure type="CHART"> con la prosa generada aislada dentro de etiquetas <description>, de modo que la transcripción nunca se confunda con el comentario del modelo. Las atestaciones emiten etiquetas apiladas como [STAMPED][SIGNED], con [ILLEGIBLE_SIGNATURE] e [ILLEGIBLE_TEXT] como literales fijos. Las tablas se entregan en HTML por omisión, para preservar las celdas combinadas.
¿Qué habilita el anclaje atómico?
El anclaje atómico es la capacidad más importante del lanzamiento. Cada bloque terminal lleva un arreglo atomic_grounding: una entrada por línea visual con DPT-3 Pro, y una entrada por palabra con DPT-3 Verity.
Verity adjunta un valor de confianza de 0 a 1 por palabra, calculado como el puntaje más bajo por carácter dentro de esa palabra, lo que entrega a los equipos una señal para derivar a revisión humana las transcripciones dudosas. Las celdas de tabla ahora llevan sus propios recuadros delimitadores, aunque Pro deja vacío el anclaje atómico a nivel de celda.
Extract V2 toma sus citas de ese anclaje, así que un campo extraído se puede rastrear hasta una palabra específica en una página específica. Eso vuelve construibles, y no aproximadas, tres cosas concretas: el enmascarado de datos personales por coordenada, la comparación entre versiones de un documento y las interfaces de revisión humana.
Lo que hay que retener
- DPT-3 Pro y DPT-3 Verity, esta última en vista previa pública, reemplazan a DPT-2 como modelos de análisis.
- La facturación del análisis pasa a ser una tarifa por página más otra por caracteres de salida, en vez de tres créditos planos por página.
- DPT-3 Pro ancla a nivel de línea; DPT-3 Verity ancla a nivel de palabra y con puntaje de confianza.
- Los fragmentos quedan retirados: la respuesta es un árbol de documento, páginas y bloques con identificadores estables.
- El código cliente de la primera generación no corre contra las direcciones de Gen2, así que la migración es obligatoria.
Para equipos de la región que procesan facturas, boletas o expedientes en español, el punto práctico es ese último: la migración no es opcional y el costo deja de ser predecible por página. Un expediente escaneado de 200 páginas con Pro en nivel prioritario ya no cuesta 600 créditos fijos, sino 200 más medio crédito por cada mil caracteres transcritos, lo que obliga a estimar el volumen de texto antes de presupuestar.




