Reducto es una empresa de parsing documental con sede en EE. UU., fundada en torno a 2023, que ofrece OCR agéntico y una arquitectura VLM multipasada para la extracción estructurada. Está bien financiada (108 M$, Serie B liderada por a16z) y bien diseñada técnicamente, y su benchmark abierto RD-TableBench demuestra una verdadera profundidad técnica. El producto es más amplio que un único endpoint de parsing: junto a Parse, Split, Extract y Edit incluye una API de Classify y Studio, un constructor sin código para encadenar esos pasos en un pipeline.
Para las empresas europeas, las preguntas que quedan son jurisdiccionales y operativas: quién gobierna los datos, qué certificado exige el departamento de compras y qué ocurre con un campo del que el modelo no estaba seguro.
Constructor de flujos de trabajo y gestión de esquemas
El Studio de Reducto es un constructor sin código para encadenar pasos del pipeline, y Classify se encarga de tipificar los documentos. Describir a Reducto como un simple endpoint de parsing que te deja la orquestación a ti está desfasado.
Lo que su documentación no describe es una cola de revisión humana: un sitio donde un revisor ve los campos de los que el sistema no estaba seguro, los corrige y la corrección vuelve a la ejecución y sigue hacia los sistemas posteriores. anyformat combina el pipeline con esa capa de revisión y con una gestión de esquemas pensada para equipos no técnicos: un usuario de operaciones sube un documento de ejemplo, ve los resultados de extracción y cambia campos sin un desarrollador y sin un ciclo de despliegue.
La pregunta que conviene hacerse en una evaluación no es si existe un constructor, sino quién puede cambiar la lógica de extracción y qué ocurre con los valores que nadie verificó.
Soberanía europea y residencia de datos
Reducto es una empresa estadounidense desplegada en AWS con endpoints regionales para la UE y Australia, y ofrece despliegue en VPC y on-premise. Eso supone una flexibilidad de infraestructura significativa, pero la empresa, su gobernanza y su marco legal son estadounidenses.
anyformat es nativo de la UE: construido por un equipo europeo, sujeto a gobernanza europea, conforme con el GDPR por arquitectura. Seleccionar un endpoint europeo en una plataforma gobernada desde EE. UU. no convierte esos datos en datos gobernados por legislación europea, y para los compradores regulados esa distinción lo es todo.
ISO 27001 y cumplimiento normativo
Reducto cuenta con SOC 2 Type II y ofrece HIPAA BAA. Son certificaciones sólidas para el mercado estadounidense. La ISO 27001, el estándar que los departamentos de compras europeos suelen exigir, no aparece listada públicamente entre ellas.
anyformat cuenta con certificación ISO 27001 y cumple con el GDPR, con un alcance de certificación que cubre el pipeline de procesamiento documental de extremo a extremo. En los pliegos europeos, la ISO 27001 suele ser un requisito obligatorio que SOC 2 por sí sola no satisface.
Retención cero de datos
Reducto admite retención cero de datos a nivel de cuenta, de modo que los documentos no se almacenan después del procesamiento. En este control los dos productos están al mismo nivel.
anyformat ofrece procesamiento con retención cero como interruptor nativo con el mismo resultado. Lo que no se iguala es la jurisdicción bajo la que se procesaron esos datos, retenidos o no, que es donde acaba realmente la conversación de cumplimiento.
El parsing de Reducto es genuinamente potente. Su arquitectura de OCR agéntico multipasada combina visión por computador, VLMs y detección de errores, diseñada específicamente para documentos complejos, y reporta una precisión hasta un 20% superior a AWS, Google y Azure en sus propios benchmarks, con el benchmark abierto RD-TableBench añadiendo credibilidad.
anyformat combina LLMs con reglas determinísticas y puntuación de confianza calibrada a lo largo de todo el pipeline, y no solo en el paso de parsing, adaptándose a más de 100 formatos y a cualquier maquetación sin plantillas. La métrica que optimizamos no es la calidad de parsing en un benchmark, sino "con qué frecuencia el sistema se equivoca y no lo sabe".
Despliegue on-premise
Reducto ofrece despliegue en la nube, en VPC y completamente on-premise o air-gapped. anyformat ofrece despliegue en nube privada y on-premise, incluidos entornos air-gapped. Ambos pueden cumplir un requisito de perímetro de datos, y ninguno de los dos debería ganar una evaluación por este punto.
Precisión, confianza y evaluación
Reducto reporta un 99,24% de precisión en cargas de trabajo clínicas (caso de estudio de Anterior), publica RD-TableBench de forma abierta y devuelve un valor de confianza granular por campo extraído. Su transparencia en benchmarks es mejor que la de la mayoría del mercado.
La diferencia está en la calibración y en lo que hay detrás del número. anyformat calibra la confianza por campo, con un 99,1% de precisión de calibración y un Adaptive ECE de 0,009 (benchmark de anyformat, 2026), de modo que un umbral fijado para straight-through processing se comporta como el número da a entender. Cada valor lleva además una cita visual que lo vincula con su posición exacta en la página, y los campos de baja confianza se enrutan a una cola de revisión en lugar de a tu base de datos. En producción, L'Oréal reporta un 99% de precisión de extracción y una reducción del 60% en el tiempo de procesamiento en más de 1.500 facturas mensuales.
La evaluación cierra el ciclo. Cada flujo de trabajo de Extract y Classify de anyformat tiene una pestaña Health donde construyes un dataset con verdad de referencia verificada, lanzas una evaluación que vuelve a extraer cada documento incluido contra una versión concreta del flujo y lo puntúas campo a campo. Las ejecuciones son numeradas e inmutables, y Health Overview sitúa el benchmark del dataset junto a la precisión de producción en vivo e informa de la diferencia (Evals).
Tablas largas y maquetaciones complejas
Reducto destaca aquí. RD-TableBench apunta específicamente a la extracción de tablas complejas, y su arquitectura multipasada gestiona bien tablas densas, celdas combinadas y maquetaciones multicolumna.
El pipeline multietapa de anyformat también gestiona la complejidad de tablas de forma nativa: celdas combinadas, tramos multipágina, rupturas estructurales y estructuras anidadas. En tablas que crecen hasta 50 páginas y unas 2.400 filas mantuvo una recuperación de filas de ~99% (benchmark de anyformat, 2026).
En calidad bruta de parsing de tablas, ambas plataformas son potentes. La diferencia está en lo que ocurre después del parsing: validación, confianza calibrada, enrutamiento a revisión y auditoría mediante citas visuales.
Detección y explicación de figuras
Reducto resume las figuras por defecto y devuelve una descripción de gráficos y diagramas junto al texto parseado. anyformat detecta figuras, las clasifica en contexto y produce descripciones estructuradas. Esto es paridad, y ninguno de los dos productos debería elegirse por ello.
Para los compradores europeos, sí, y las brechas decisivas son jurisdiccionales: Reducto es una empresa estadounidense que no lista públicamente la ISO 27001, mientras que anyformat es nativo de la UE y está certificado. En producto, anyformat añade una cola de revisión humana donde las correcciones vuelven a la ejecución, confianza calibrada con citas visuales para auditoría, gestión de esquemas que pueden operar equipos no técnicos y una suite de evaluaciones que mide una versión del flujo de trabajo contra la verdad de referencia antes de publicarse.
Cuándo elegir Reducto
Reducto encaja cuando tu equipo quiere una primitiva de parsing code-first con benchmarks abiertos sólidos en tablas, cuando la jurisdicción estadounidense y SOC 2 Type II satisfacen tu marco de cumplimiento, y cuando tu pipeline no necesita un paso de revisión supervisada sobre los campos inciertos.
Elige anyformat cuando la jurisdicción de la UE y la ISO 27001 sean requisitos obligatorios, cuando necesites confianza calibrada y citas visuales para justificar el straight-through processing ante un auditor, cuando los esquemas deban pertenecer a los equipos de operaciones y no a los desarrolladores, o cuando quieras que los cambios en los flujos de trabajo se midan contra un dataset de verdad de referencia antes de llegar a producción.
anyformat es la plataforma de inteligencia documental agéntica diseñada para empresas europeas. Certificada ISO 27001, conforme con el GDPR, con procesamiento de retención cero y despliegue on-premise. Empieza en anyformat.ai