Was ist Docsumo?
Docsumo ist eine Cloud-Plattform für Document AI, 2019 von Rushabh Sheth und Bikram Dahal gegründet und um vortrainierte Extraktionsmodelle für eine feste Auswahl an Branchen herum gebaut: Gewerbefinanzierung und Hypotheken, Underwriting von Gewerbeimmobilien (CRE), Logistik und Versicherung (ACORD-Formulare). Diese vertikale Tiefe ist echt und ihr größtes Kapital, mit namentlich genannten Produktivkunden im CRE-Bereich wie Arbor Realty Trust, das zugleich Investor ist. Das Unternehmen unterhält Büros in Singapur, Delaware, Mumbai und Kathmandu, mit der Entwicklung in Kathmandu, und die Finanzierung steht seit einer 3,5-Mio.-$-Runde im März 2022 unverändert in der Seed-Phase, eine Series A ist nicht dokumentiert. Docsumo hat zudem eine ungewöhnliche Sichtbarkeit in KI-Assistenten: In unserer eigenen Auswertung von KI-Antworten zur Dokumentenextraktion zwischen Juni und Juli 2026 tauchte Docsumo 148 Mal auf, bei einer durchschnittlichen Position von 7,1 (anyformat-Auswertung von KI-Antworten, 2026). Das erklärt, warum es so häufig erscheint, wenn Teams ChatGPT oder Gemini nach einer Lösung für Rechnungen fragen.
Vortrainierte Modelle gegenüber eigenen Dokumenttypen
Das Versprechen ohne Training gilt bei Docsumo für die vortrainierte Bibliothek, nicht für Ihre eigenen Dokumenttypen. Die über 30 vortrainierten Modelle für Rechnungen, Kontoauszüge, Rent Rolls, ACORD-Formulare und ähnliche Dokumente funktionieren tatsächlich ohne Konfiguration; für alles außerhalb dieser Bibliothek verlangt Docsumos eigene Dokumentation zu benutzerdefinierten Modellen ein Training mit rund 20 Dokumentbeispielen, um über 90% Genauigkeit zu erreichen. Eine LLM-gestützte Auto-Extraktion schlägt Felder aus einem einzelnen hochgeladenen Beispiel vor, was den Schemaentwurf verkürzt, den Ablauf aber beispielbasiert lässt. anyformat extrahiert Zero-Shot gegen ein benutzerdefiniertes Schema: Felder definieren, Dokument hochladen, validiertes JSON erhalten, ohne Labeling-Runde und ohne erneutes Training bei Schemaänderungen. Über mehr als 1.000 reale Dokumente aus über 30 Dokumenttypen erreichte anyformat 78,1% in einem kombinierten Parse Score (anyformat-Benchmark, 2026).
Konfidenz, visuelle Verankerung und menschliche Prüfung
Hier liegen Docsumo und anyformat am dichtesten beieinander, und das gehört klar gesagt: Docsumo hängt an jedes Feld einen Konfidenzwert und einen Quellenausschnitt, und ein Klick auf ein Feld hebt dessen exakte Stelle auf der Seite hervor. Das ist Konfidenz je Feld mit Klick-zur-Quelle-Verankerung, dieselbe Form wie die visuellen Belege von anyformat, und keine Fähigkeit, die anyformat für sich allein beanspruchen kann. Extraktionen mit niedriger Konfidenz laufen in eine Prüfoberfläche, in der Korrekturen zurück ins Modell fließen. Der Unterschied liegt in der Kalibrierung, nicht im Mechanismus: Docsumo veröffentlicht weder eine Kalibrierungsmethodik noch eine numerische Konfiguration von Schwellenwerten für Straight-Through-Processing, während anyformat die Kalibrierung mit 99,1% Kalibrierungsgenauigkeit und einem Adaptive ECE von 0,009 misst (anyformat-Benchmark, 2026), sodass ausgewiesene 90% in etwa 90% der Fälle zutreffen. Kalibrierung ist das, was ein Team einen Automatisierungsschwellenwert setzen und ihm vertrauen lässt.
Tabellen und lange Dokumente
Docsumos Genauigkeitsangaben zu Tabellen stammen vom Anbieter selbst und sind nicht geprüft: über 90% bei der Tabellenextraktion und über 99% bei Kontoauszugsdaten, beides ohne unabhängige Verifizierung, und es wird keine Seiten- oder Größenobergrenze für den Produktivbetrieb veröffentlicht (die Grenze von 5 Seiten und 35 MB, die manche Käufer zitieren, ist eine Beschränkung des Demo-Widgets auf ihrer Website, nicht der API). anyformat veröffentlicht seine Messwerte für lange Dokumente: ~99% Zeilenwiederherstellung bei Positionstabellen von 1 bis 50 Seiten und rund 2.400 Zeilen, 94% der komplexen Rechnungen vollständig korrekt extrahiert, mit allen Feldern, Positionen und abgestimmten Summen, sowie 80% bei Dokumenten ab 16 Seiten gegenüber 53% beim nächstbesten getesteten Modell (anyformat-Benchmark, 2026). Docsumos öffentliche Dokumentation deckt die Interpretation von Abbildungen, Diagrammen oder Grafiken nicht ab; anyformat erkennt visuelle Elemente und liefert strukturierte Beschreibungen davon.
Betrieb, Rechtsraum und Zertifizierungen
Docsumo ist reines Cloud-Produkt, ohne dokumentierte On-Premise-, VPC- oder Air-Gapped-Option in irgendeinem Tarif, Enterprise eingeschlossen. Die Plattform läuft auf AWS und GCP, mit AWS, GCP, MongoDB Atlas und Cloudflare als gelisteten Infrastruktur-Unterauftragsverarbeitern. Der Rechtsraum ist das Detail, das europäische Käufer meist übersehen: Docsumos Datenschutzerklärung nennt das Recht von Singapur als maßgeblich für Auslegung und Geltung des Vertrags, und Drittanbieter-Verzeichnisse, die das Unternehmen als in New York ansässig führen, werden von Docsumos eigenen Seiten nicht bestätigt. Bei den Zertifizierungen ist SOC 2 Type II bestätigt und datiert (Type I um September 2021, Type II um März 2022), während ISO 27001 nirgends auf ihrer Website öffentlich beansprucht wird, deren Footer-Badges nur DSGVO, SOC 2 Type 2 und HIPAA aufführen; das ist das Fehlen einer öffentlichen Angabe und kein Beweis für das Fehlen der Zertifizierung, und es ist eine Frage, die man dem Vertriebsteam direkt stellen sollte. anyformat ist EU-nativ, ISO 27001 zertifiziert über die gesamte Dokumenten-Pipeline und läuft in der Cloud, in einer Private Cloud oder in air-gapped On-Premise-Umgebungen.
Wohin Ihre Dokumente tatsächlich gehen
Docsumos veröffentlichte Liste der Unterauftragsverarbeiter nennt Anthropic, PBC und OpenAI OpCo, LLC als Unterauftragsverarbeiter für KI-Modell-APIs (Docsumo-Unterauftragsverarbeiter), das heißt, Dokumentinhalte werden im Normalbetrieb von US-LLM-APIs Dritter verarbeitet. Das ist eine sachliche Feststellung zum Datenfluss, kein Sicherheitsbefund: Beides sind gängige Enterprise-APIs mit eigenen AVV, und die Offenlegung ist mehr Transparenz, als mehrere Wettbewerber bieten. Relevant ist es, weil ein europäischer Käufer diese Übermittlungen im eigenen Verarbeitungsverzeichnis und im AVV abbilden muss und weil damit die Annahme entfällt, Dokumente blieben innerhalb der Grenzen eines einzigen Anbieters. Auch anyformat setzt LLMs in seiner Extraktions-Engine ein, mit modellagnostischer Architektur und ISO-27001-Zertifizierung über die Pipeline; der praktische Unterschied ist, dass die Verarbeitung ohne Datenspeicherung als Schalter verfügbar ist und Enterprise-Installationen in Ihrer eigenen VPC oder On-Premise laufen, wo die Pipeline innerhalb Ihrer Infrastruktur bleibt.
Datenspeicherung
Docsumo legt sich auf keine Aufbewahrungsfrist fest. Die Datenschutzerklärung besagt, dass übermittelte Daten so lange aufbewahrt werden, wie Docsumo es für die Erbringung eines angemessenen Dienstes für erforderlich hält, und dass personenbezogene Daten erst innerhalb von zwei Monaten nach Schließung des Kontos gelöscht werden (Docsumo-Datenschutzerklärung). Ein Modus für Zero Data Retention oder flüchtige Verarbeitung ist in keinem Tarif dokumentiert. Für einen regulierten Käufer ist eine offene Aufbewahrungsklausel in der Regel genau die Klausel, die vor Vertragsschluss nachverhandelt werden muss. anyformat bietet Zero Data Retention als Konfiguration in Enterprise-Tarifen, sodass Dokumente verarbeitet und nicht gespeichert werden.
Preistransparenz
Docsumo veröffentlicht keine Preise. Business und Enterprise sind beide als individuelle Preisgestaltung ausgewiesen, ohne Seitenpreis, ohne Überschreitungstarif und ohne Mindestabnahme auf der Preisseite; die einzige veröffentlichte Zahl ist die kostenlose 14-Tage-Testphase, begrenzt auf 1.000 Seiten und 10 Nutzerlizenzen, was ein wirklich großzügiges Evaluierungsbudget darstellt. Die kursierenden Seitenpreise Dritter zu Docsumo widersprechen einander um eine Größenordnung und sind nicht auf Docsumo zurückführbar, deshalb geben wir sie hier nicht wieder. anyformat veröffentlicht die vollständige Preisliste und rechnet in Credits ab, pro Seite und pro Operator: 10 Credits kosten 0,01 €, Parse also 25 Credits pro Seite (0,025 €, veröffentlicht als 25 $ pro 1.000 Seiten), Extract 35 Credits pro Seite, Classify 10, Split 25 und Validate 25 Credits pro Regel (anyformat-Preise, 2026). Pay As You Go ist im Einstieg kostenlos, mit einer einmaligen Zuteilung von 50.000 Credits; Business kostet 499 € pro Monat (399 € bei jährlicher Abrechnung) für 500.000 Credits; Enterprise wird individuell bepreist, mit VPC- oder On-Premise-Deployment und Zero Data Retention.
Eine Evaluations-Suite, einen angekündigten Optimizer und den Labeling-Zyklus, den Sie sonst selbst pflegen.
Evaluationen, heute verfügbar. Jeder Extract- und Classify-Workflow von anyformat hat einen Health-Tab. Sie bauen einen Datensatz mit geprüfter Ground Truth auf, indem Sie ein bereits verarbeitetes Dokument übernehmen und seine Werte in der Prüfoberfläche bestätigen, oder indem Sie gelabelte Dokumente mit ihrem erwarteten JSON hochladen. Dateien lassen sich in Sub-Datensätze taggen, sodass die Genauigkeit je Lieferant, je Dokumenttyp oder je Schwierigkeitsgrad ablesbar wird statt als ein einziger Mittelwert. Eine Evaluation extrahiert jedes einbezogene Dokument gegen eine gewählte Workflow-Version neu und bewertet es Feld für Feld, mit einer Ansicht Ergebnis gegen Erwartung bei jedem Fehler; Läufe sind nummeriert und unveränderlich, sodass die Wirkung einer Änderung gemessen und nicht angenommen wird. Die Health-Übersicht stellt den Datensatz-Benchmark dann neben Produktionsgenauigkeit, Konfidenz und Through Rate im Livebetrieb und weist die Differenz aus (Evals). Docsumo liefert ein Reporting-Dashboard mit Genauigkeitsmetriken und Slack- oder Gmail-Benachrichtigungen, wobei Echtzeit-Analysen dem Enterprise-Tarif vorbehalten sind. Präzise formuliert: Das ist operatives Reporting über Livedaten, keine Evaluation gegen einen festen Ground-Truth-Datensatz. Es gibt keine Datensatzverwaltung, keine Sub-Datensatz-Segmentierung, keine unveränderliche Laufhistorie und keinen Vergleich zwischen Benchmark und Produktion.
Optimizer, angekündigt und noch nicht verfügbar. anyformat hat Optimizer angekündigt, einen Workflow, der sich anhand des eigenen Datensatzes selbst optimiert und Ihre Evaluationen als Zielgröße nutzt. Er steht auf der Roadmap, nicht im heutigen Produkt (Evals).
Die Pipeline, die Sie nicht bauen müssen. Dies ist kein Vergleich zwischen API und Plattform: Docsumo liefert Ingestion, eine Prüfoberfläche und einen Workflow-Builder, der eine Prompt-Oberfläche mit visuellen Bausteinen verbindet, und das ist echte Produktsubstanz. Die Arbeit, die anyformat abnimmt, ist enger gefasst: rund 20 Beispiele je eigenem Dokumenttyp sammeln und labeln, neu labeln, wenn ein Lieferant sein Layout ändert, und operative Dashboards ohne festen Vergleichsmaßstab interpretieren. anyformat deckt das mit Zero-Shot-Schemata, No-Code-Workflows im Studio, kalibrierter Konfidenz je Feld mit Routing in die Prüfung, visuellen Belegen für die Revision und der oben beschriebenen Evaluationsschleife ab. Einen Produktions-Workflow mit dem Annie-Assistenten aufzusetzen dauert rund 5 Minuten gegenüber etwa 4 Stunden manueller Konfiguration (interner anyformat-Benchmark, 2026).
Wann Sie Docsumo wählen sollten
Wählen Sie Docsumo, wenn Ihre Dokumente in die vortrainierte Bibliothek und die Branchen passen: Gewerbefinanzierung, Hypotheken, CRE-Underwriting, Logistik und ACORD-Versicherungsformulare, in US-typischen Standardformaten. Die vertikale Tiefe ist echt, die Prüfoberfläche mit Klick-zur-Quelle-Verankerung ist ausgereift und dafür entworfen statt nachträglich angesetzt, und die kostenlose Testphase über bis zu 1.000 Seiten mit 10 Nutzerlizenzen erlaubt es, die Genauigkeit an eigenen Dokumenten zu prüfen, bevor ein Vertriebsgespräch beginnt. Das passt zu Teams, die mit einem reinen Cloud-Anbieter unter Singapurer Rechtsraum zurechtkommen und einen Labeling-Zyklus für Dokumenttypen außerhalb des vortrainierten Bestands tragen können.
Wählen Sie anyformat, wenn eigene Dokumenttypen ab dem ersten Dokument ohne gelabelte Beispiele funktionieren müssen; wenn europäische Datenresidenz, ISO-27001-Zertifizierung über die Pipeline, Zero Data Retention oder On-Premise- und Air-Gapped-Betrieb Anforderungen und keine Präferenzen sind; wenn Ihre Dokumente lang sind, mit Tabellen über Dutzende von Seiten oder Dateien jenseits von 16 Seiten, wo die meisten Engines abfallen; oder wenn Sie kalibrierte Konfidenz und eine Evaluationsschleife brauchen, um einen Workflow nach dem Go-live korrekt zu halten, statt eines Dashboards, das berichtet, was bereits passiert ist.