La empresa Reducto anunció la semana pasada r-1, el primer modelo de una nueva familia de análisis documental construida sobre una arquitectura reescrita desde cero. Su promesa es reemplazar el OCR agéntico de varias etapas por una sola pasada sobre la página completa. Según la compañía, r-1 es más preciso que sus propios modelos agénticos más potentes, más rápido y hasta 6 veces más barato.

¿Se puede usar hoy?

Sí, en versión preliminar. r-1 corre a través de la API Parse alojada por Reducto en su versión V3 y se activa con una bandera de configuración. No hay pesos abiertos ni un archivo del modelo para instalar en servidores propios. La plataforma sí admite, por separado, nube multiinquilino, despliegue en la nube privada del cliente, instalación en las propias dependencias y entornos aislados de la red, con certificación SOC 2 Tipo II y procesamiento bajo HIPAA en los planes superiores, de acuerdo con sus políticas de seguridad.

Una pasada en lugar de una cadena de etapas

El producto anterior, Parse, ejecutaba el OCR, la detección de estructura y el posprocesamiento como etapas separadas, con pasadas opcionales de modelos de visión y lenguaje encima. Cada llamada adicional a un modelo suma latencia.

r-1 integra en una sola pasada de página completa el texto, las tablas, las figuras, la estructura, el orden de lectura, el formato y el anclaje espacial. Cada bloque vuelve con coordenadas relativas a la página, lo que permite atar cualquier contenido a su posición exacta en el documento.

La consolidación es el argumento comercial de fondo. Los equipos que trabajan con estados financieros, siniestros de seguros o contratos suelen repartir los archivos entre varios proveedores y agregar procesamiento posterior para alcanzar una precisión usable. r-1 apunta a ese costo de coordinación, no solo a la precisión del carácter.

¿Qué dicen exactamente los números?

Reducto reporta una reducción de 20% en la tasa de error de la versión preliminar de r-1 frente a sus propias cadenas agénticas anteriores. También afirma que r-1 superó a productos de los grandes proveedores de nube y a modelos de lenguaje de gran tamaño en documentos complejos, en evaluaciones internas. Amazon Textract y Azure Document Intelligence aparecen nombrados en el comunicado como la categoría de referencia establecida.

En precio, los modelos agénticos anteriores costaban entre 3 y 6 centavos de dólar por página según la carga de trabajo. r-1 queda en 1 centavo por página, todo incluido, sin multiplicadores por función ni costos en créditos apilados para llegar a precisión alta.

Modelos agénticos anterioresr-1
Precio por página3 a 6 centavos1 centavo
Etapas de procesamientoOCR, estructura y posproceso separadosuna pasada completa
Costo de 1 millón de páginas30.000 a 60.000 dólares10.000 dólares

Conviene leer esas cifras con cuidado. La reducción de 20% está medida contra el propio producto anterior de Reducto, no contra una referencia de un tercero. Y la comparación directa contra los grandes proveedores de nube y los modelos de lenguaje la corrió la propia empresa, sin publicar el conjunto de pruebas ni los datos usados.

Qué resuelve dentro de la página

Según la documentación, r-1 maneja de forma nativa en esa única pasada:

  • Texto digital, escaneos y escritura a mano.
  • Estructura de tablas leída con el contexto de la página alrededor, incluidas celdas combinadas y encabezados anidados.
  • Columnas, encabezados, pies de página, barras laterales y orden de lectura resueltos en conjunto.
  • Detección de figuras con una descripción breve generada automáticamente.
  • Formato que carga significado: títulos, listas, negritas, subrayados y tachados.
  • Anclaje mediante coordenadas relativas a la página.

Los casos difíciles que la propia empresa reconoce son las tablas densas, las diagramaciones inusuales, los escaneos de mala calidad, el contenido con marcas de agua y los documentos que no siguen ninguna plantilla previsible. Un tachado que se pierde puede invertir una cláusula de contrato, y una tabla mal leída puede entregarle a un agente la cifra equivocada. Por eso esos bordes pesan tanto en procesos regulados.

Cómo se migra

r-1 exige la API V3. Una solicitud a Parse que omita settings.model sigue corriendo sobre el producto anterior, así que nada se rompe en silencio. Las configuraciones nuevas creadas en Studio usan r-1 por defecto.

Código
result = client.parse.run(
    input=upload.file_id,
    settings={"model": "r-1"}
)

El procesamiento agéntico no desaparece. Los flujos que necesitan instrucciones personalizadas o extracción avanzada de gráficos siguen pasando esas páginas por el circuito agéntico, que Reducto suma sobre el resultado de r-1 y que agrega latencia. Quien migre una configuración existente debería revisar primero la página de compatibilidad de r-1, porque algunas opciones antiguas quedan ignoradas o sin soporte.

Reducto ya adelantó las dos piezas siguientes: r-1 mini, para cargas sensibles a velocidad y costo, y un enrutamiento automático por página que elija el modelo adecuado para cada hoja. Las organizaciones que vengan de otro analizador pueden pedir hasta 5.000 dólares en créditos para una comparación lado a lado.

Qué cambia para un equipo en la región

A 1 centavo por página, digitalizar un archivo de 100.000 documentos escaneados cuesta del orden de 1.000 dólares en procesamiento, contra los 3.000 a 6.000 de la generación anterior. Eso mueve la frontera de lo que vale la pena automatizar en áreas de administración, cobranza o cumplimiento normativo, donde hasta ahora la digitalización manual competía de igual a igual con la automática. La contracara es la dependencia: sin pesos abiertos, el archivo histórico de una empresa queda atado a un proveedor externo y a su tarifa futura.