Reducto ist ein US-basiertes Unternehmen für Dokumenten-Parsing, gegründet um 2023. Es ist gut finanziert (108 Mio. $, Series B angeführt von a16z) und gut konstruiert, und der offene Benchmark RD-TableBench belegt echte technische Tiefe. Im September 2026 ersetzte es seine bisherige Multi-Pass-OCR-und-VLM-Pipeline durch r-1, ein einzelnes End-to-End-Parsing-Modell zum Pauschalpreis von 10 $ pro 1.000 Seiten. Das Produkt ist breiter als ein einzelner Parsing-Endpunkt: neben Parse, Split, Extract und Edit gibt es eine Classify-API und Studio, einen No-Code-Builder, der diese Schritte zu einer Pipeline verkettet.
Für europäische Unternehmen bleiben die Fragen jurisdiktionell und operativ: Wer regiert die Daten, welches Zertifikat verlangt die Beschaffung, und was passiert mit einem Feld, bei dem das Modell unsicher war.
Workflow-Builder und Schema-Management
Reductos Studio ist ein No-Code-Builder, der Pipeline-Schritte verkettet, und Classify übernimmt die Dokumententypisierung. Reducto als nackten Parsing-Endpunkt zu beschreiben, der die Orchestrierung Ihnen überlässt, ist überholt.
Was die Dokumentation nicht beschreibt, ist eine Prüf-Queue: ein Ort, an dem eine prüfende Person die Felder sieht, bei denen das System unsicher war, sie korrigiert, und die Korrektur in den Lauf und weiter in die nachgelagerten Systeme zurückfließt. anyformat kombiniert die Pipeline mit dieser Prüfschicht und mit Schema-Management für nicht-technische Teams: Ein Ops-Nutzer lädt ein Beispieldokument hoch, sieht die Extraktionsergebnisse und ändert Felder ohne Entwickler und ohne Deployment-Zyklus.
Die Frage, die sich in einer Evaluierung lohnt, ist nicht, ob es einen Builder gibt, sondern wer die Extraktionslogik ändern kann und was mit den Werten passiert, die niemand geprüft hat.
Europäische Souveränität und Datenresidenz
Reducto ist ein US-Unternehmen, betrieben auf AWS mit regionalen Endpunkten für die EU und Australien, und bietet VPC- und On-Prem-Deployment an. Das ist substanzielle Infrastruktur-Flexibilität, aber das Unternehmen, seine Governance und sein Rechtsrahmen sind allesamt US-basiert.
anyformat ist EU-nativ: entwickelt von einem europäischen Team, europäischer Governance unterworfen, DSGVO-konform per Architektur. Einen EU-Endpunkt auf einer US-regierten Plattform auszuwählen macht die Daten nicht europäisch regiert, und für regulierte Käufer ist genau das der Punkt.
ISO 27001 und Compliance
Reducto hält SOC 2 Type II und bietet ein HIPAA-BAA an. Das sind solide Zertifizierungen für den US-Markt. ISO 27001, der Standard, den europäische Beschaffungsteams typischerweise verlangen, ist darunter nicht öffentlich aufgeführt.
anyformat ist ISO-27001-zertifiziert und DSGVO-konform, mit einem Zertifizierungsumfang, der die Dokumentenverarbeitungs-Pipeline End-to-End abdeckt. In europäischen Ausschreibungen ist ISO 27001 oft eine harte Anforderung, die SOC 2 allein nicht erfüllt.
Zero Data Retention
Reducto unterstützt Zero Data Retention kontoweit, Dokumente werden nach der Verarbeitung also nicht gespeichert. Bei dieser Kontrolle sind beide Produkte gleichauf.
anyformat bietet Zero-Retention-Verarbeitung als nativen Schalter mit demselben Ergebnis. Nicht gleichauf ist die Jurisdiktion, unter der die gespeicherten oder nicht gespeicherten Daten verarbeitet wurden, und genau dort landet das Compliance-Gespräch.
Reductos Parsing ist wirklich stark. Das Modell r-1 liest ein Dokument in einem einzigen Durchgang von Anfang bis Ende, statt separate Schritte für OCR, Layout und Korrektur aneinanderzureihen, und Reducto meldet in eigenen Benchmarks bis zu 20% höhere Genauigkeit als AWS, Google und Azure; der offene RD-TableBench verleiht dem Glaubwürdigkeit. r-1 ist derzeit eine Preview, nur über die API verfügbar, und deckt noch nicht jede Konfiguration der bisherigen Pipeline ab.
anyformat kombiniert LLMs mit deterministischen Regeln und kalibriertem Confidence-Scoring über die gesamte Pipeline hinweg, nicht nur im Parsing-Schritt, und passt sich über 100 Formaten und jedem Layout ohne Templates an. Die Metrik, die wir optimieren, ist nicht die Parsing-Qualität im Benchmark, sondern "wie oft liegt das System falsch, ohne es zu wissen".
On-Premise-Deployment
Reducto bietet Cloud-, VPC- und vollständig On-Prem- oder Air-Gapped-Deployment. anyformat bietet Private-Cloud- und On-Premise-Deployment einschließlich air-gapped Umgebungen. Beide können eine Datenperimeter-Anforderung erfüllen, und keine Seite sollte eine Evaluierung an diesem Punkt gewinnen.
Genauigkeit, Konfidenz und Evaluation
Reducto meldet 99,24% Genauigkeit bei klinischen Workloads (Anterior-Fallstudie), veröffentlicht RD-TableBench offen und gibt einen granularen Konfidenzwert pro extrahiertem Feld zurück. Die Benchmark-Transparenz ist besser als bei den meisten im Markt.
Der Unterschied liegt in der Kalibrierung und in dem, was hinter der Zahl steht. anyformat kalibriert die Konfidenz pro Feld, gemessen mit 99,1% Kalibrierungsgenauigkeit bei einem Adaptive ECE von 0,009 (anyformat-Benchmark, 2026); ein Schwellenwert für Straight-Through-Processing verhält sich damit so, wie die Zahl es nahelegt. Jeder Wert trägt zusätzlich einen visuellen Beleg, der ihn mit seiner exakten Position auf der Seite verknüpft, und Felder mit niedriger Konfidenz gehen in eine Prüf-Queue statt in Ihre Datenbank. In der Produktion meldet L'Oréal 99% Extraktionsgenauigkeit und eine 60%ige Verkürzung der Bearbeitungszeit bei über 1.500 monatlichen Rechnungen.
Die Evaluation schließt den Kreis. Jeder Extract- und Classify-Workflow von anyformat hat einen Health-Tab, in dem Sie ein Dataset mit geprüfter Ground Truth aufbauen, eine Evaluation starten, die jedes einbezogene Dokument mit einer gewählten Workflow-Version erneut extrahiert, und es Feld für Feld bewerten. Die Läufe sind nummeriert und unveränderlich, und die Health Overview stellt den Dataset-Benchmark neben die Live-Produktionsgenauigkeit und weist die Differenz aus (Evals). Reducto bietet mit Studio Evaluations eine vergleichbare Funktion an, die aber auf den kostenpflichtigen Growth-Tarif beschränkt ist.
Auch Workflow-Versionen spielen hier eine Rolle. anyformats öffentliche API verweigert das Löschen oder stille Überschreiben einer bestehenden Workflow-Version: Jede Änderung erzeugt eine neue. Reducto erlaubt ebenfalls das Anheften einer Modellversion, allerdings mit einer 4-wöchigen Deprecation-Uhr: eine angeheftete Version wandert irgendwann von Standard über veraltet zu entfernt, sodass das Anheften heute trotzdem eine spätere Migration bedeutet.
Lange Tabellen und komplexe Layouts
Hier glänzt Reducto. RD-TableBench zielt spezifisch auf komplexe Tabellenextraktion, und r-1 bewältigt dichte Tabellen, verbundene Zellen und mehrspaltige Layouts gut.
anyformats mehrstufige Pipeline bewältigt Tabellenkomplexität ebenfalls nativ: verbundene Zellen, mehrseitige Tabellen, strukturelle Brüche und verschachtelte Strukturen. Bei Tabellen mit bis zu 50 Seiten und rund 2.400 Zeilen hielt anyformat eine Zeilenwiederherstellung von ~99% (anyformat-Benchmark, 2026).
Bei der reinen Tabellen-Parsing-Qualität sind beide Plattformen stark. Der Unterschied ist, was nach dem Parsing passiert: Validierung, kalibrierte Konfidenz, Routing zur Prüfung und Nachvollziehbarkeit über visuelle Belege.
Erkennung und Erklärung von Abbildungen
Reducto fasst Abbildungen standardmäßig zusammen und liefert neben dem geparsten Text eine Beschreibung von Diagrammen und Grafiken. anyformat erkennt Abbildungen, klassifiziert sie im Kontext und erzeugt strukturierte Beschreibungen. Das ist Gleichstand, und kein Produkt sollte deswegen gewählt werden.
Für europäische Käufer ja, und die entscheidenden Lücken sind jurisdiktioneller Natur: Reducto ist ein US-Unternehmen, das ISO 27001 nicht öffentlich aufführt, während anyformat EU-nativ und zertifiziert ist. Beim Produkt kommen hinzu: eine Prüf-Queue, in der Korrekturen in den Lauf zurückfließen, kalibrierte Konfidenz mit visuellen Belegen für das Audit, Schema-Management, das nicht-technische Teams bedienen können, und eine Evaluationssuite, die eine Workflow-Version gegen Ground Truth misst, bevor sie ausgeliefert wird.
Eine ehrliche Einschränkung: Wenn Sie nur Seiten parsen müssen und nichts weiter, ist Reductos r-1 preislich heute kaum zu schlagen. Der Vergleich ändert sich, sobald das Ergebnis im großen Maßstab vertrauenswürdig sein muss: von einer Person geprüft, wenn die Konfidenz niedrig ist, gegen die eigene Ground Truth evaluiert, bevor eine Workflow-Änderung ausgeliefert wird, und standardmäßig konform mit den EU-Datenresidenz-Anforderungen. Genau diese Schicht liefert eine reine Parsing-API nicht.
Wann Sie Reducto wählen sollten
Reducto passt, wenn Ihr Team ein code-first Parsing-Primitiv mit starken offenen Tabellen-Benchmarks will, wenn US-Jurisdiktion und SOC 2 Type II Ihr Compliance-Rahmenwerk erfüllen, wenn der Listenpreis fürs reine Parsen den Ausschlag gibt, und wenn Ihre Pipeline keinen überwachten Prüfschritt für unsichere Felder braucht.
Wählen Sie anyformat, wenn EU-Jurisdiktion und ISO 27001 harte Anforderungen sind, wenn Sie kalibrierte Konfidenz und visuelle Belege brauchen, um Straight-Through-Processing gegenüber einem Auditor zu begründen, wenn die Schemata den Ops-Teams gehören sollen und nicht den Entwicklern, oder wenn Workflow-Änderungen gegen ein Ground-Truth-Dataset gemessen werden sollen, bevor sie in die Produktion gehen.
anyformat ist die agentische Dokumentenintelligenz-Plattform für europäische Unternehmen. ISO-27001-zertifiziert, DSGVO-konform, mit Zero-Retention-Verarbeitung und On-Premise-Deployment. Jetzt starten auf anyformat.ai