Qu'est-ce que Docsumo ?
Docsumo est une plateforme cloud de document AI fondée en 2019 par Rushabh Sheth et Bikram Dahal, construite autour de modèles d'extraction pré-entraînés pour un ensemble défini de verticales : crédit commercial et prêts hypothécaires, souscription en immobilier commercial (CRE), logistique et assurance (formulaires ACORD). Cette spécialisation verticale est réelle et constitue leur meilleur atout, avec des clients en production nommés dans le CRE comme Arbor Realty Trust, qui est aussi investisseur. L'entreprise a des bureaux à Singapour, dans le Delaware, à Mumbai et à Katmandou, avec l'ingénierie à Katmandou, et son financement est resté au stade seed depuis un tour de 3,5 M$ en mars 2022, sans aucune série A documentée. Docsumo bénéficie par ailleurs d'une visibilité inhabituelle dans les assistants IA : dans notre propre suivi des réponses IA sur l'extraction documentaire entre juin et juillet 2026, Docsumo est apparu 148 fois à une position moyenne de 7,1 (suivi des réponses IA anyformat, 2026), ce qui explique sa présence fréquente quand les équipes demandent à ChatGPT ou Gemini quoi utiliser pour les factures.
Modèles pré-entraînés et types de documents personnalisés
La promesse de zéro entraînement de Docsumo porte sur sa bibliothèque pré-entraînée, pas sur vos propres types de documents. Les plus de 30 modèles pré-entraînés pour les factures, relevés bancaires, rent rolls, formulaires ACORD et documents similaires fonctionnent réellement sans configuration ; pour tout ce qui sort de cette bibliothèque, la documentation des modèles personnalisés de Docsumo demande d'entraîner avec environ 20 échantillons de documents pour atteindre plus de 90 % de précision. Une fonction d'auto-extraction pilotée par LLM propose des champs à partir d'un seul échantillon chargé, ce qui raccourcit la conception du schéma mais conserve un flux fondé sur des échantillons. anyformat extrait selon un schéma défini par l'utilisateur en zero-shot : définissez les champs, chargez un document, recevez du JSON validé, sans tour d'annotation ni réentraînement quand le schéma change. Sur plus de 1 000 documents réels couvrant plus de 30 types, anyformat a obtenu 78,1 % sur un parse score combiné (benchmark anyformat, 2026).
Confiance, ancrage visuel et revue humaine
C'est ici que Docsumo et anyformat sont les plus proches, et il faut le dire clairement : Docsumo attache un score de confiance et un extrait source à chaque champ, et cliquer sur un champ met en évidence sa position exacte sur la page. C'est bien de la confiance par champ avec ancrage cliquable vers la source, la même forme que les citations visuelles d'anyformat, et ce n'est pas une capacité qu'anyformat peut revendiquer comme exclusive. Les extractions à faible confiance sont routées vers un écran de revue où les corrections alimentent le modèle. La différence tient à la calibration, pas au mécanisme : Docsumo ne publie ni méthodologie de calibration ni configuration numérique des seuils de straight-through processing, tandis qu'anyformat mesure sa calibration à 99,1 % de précision de calibration avec un Adaptive ECE de 0,009 (benchmark anyformat, 2026), si bien qu'un 90 % annoncé est correct environ 90 % du temps. La calibration est ce qui permet à une équipe de fixer un seuil d'automatisation et de s'y fier.
Tableaux et documents longs
Les chiffres de précision sur les tableaux annoncés par Docsumo sont déclaratifs et non audités : plus de 90 % sur l'extraction de tableaux et plus de 99 % sur les données de relevés bancaires, aucun vérifié de façon indépendante, et aucune limite de pages ou de taille en production n'est publiée (la limite de 5 pages et 35 Mo que certains acheteurs citent est une contrainte du widget de démonstration de leur site, pas de l'API). anyformat publie ses mesures sur documents longs : ~99 % de récupération des lignes sur des tableaux de lignes de détail allant de 1 à 50 pages et environ 2 400 lignes, 94 % des factures complexes extraites parfaitement avec tous les champs, lignes et totaux réconciliés, et 80 % sur les documents de 16 pages ou plus contre 53 % pour le meilleur modèle suivant testé (benchmark anyformat, 2026). La documentation publique de Docsumo ne couvre pas l'interprétation des figures, graphiques ou diagrammes ; anyformat détecte les éléments visuels et en renvoie des descriptions structurées.
Déploiement, juridiction et certifications
Docsumo est uniquement cloud, sans option on-premise, VPC ou air-gapped documentée sur aucun palier, Enterprise compris. La plateforme tourne sur AWS et GCP, avec AWS, GCP, MongoDB Atlas et Cloudflare listés comme sous-traitants d'infrastructure. La juridiction est le détail que les acheteurs européens négligent le plus souvent : la politique de confidentialité de Docsumo indique que le contrat est régi et interprété selon les lois de Singapour, et les annuaires tiers qui présentent l'entreprise comme basée à New York ne sont pas corroborés par les pages de Docsumo elle-même. Côté certifications, SOC 2 Type II est confirmée et datée (Type I vers septembre 2021, Type II vers mars 2022), tandis qu'ISO 27001 n'est revendiquée publiquement nulle part sur leur site, dont les badges de pied de page ne listent que RGPD, SOC 2 Type 2 et HIPAA ; il s'agit d'une absence de revendication publique et non d'une preuve d'absence, et c'est une question à poser directement à leur équipe commerciale. anyformat est natif de l'UE, certifié ISO 27001 sur l'ensemble du pipeline documentaire, et se déploie en cloud, cloud privé ou environnements on-premise isolés (air-gapped).
Où vont réellement vos documents
La liste publiée des sous-traitants de Docsumo nomme Anthropic, PBC et OpenAI OpCo, LLC comme sous-traitants d'API de modèles IA (sous-traitants Docsumo), ce qui signifie que le contenu des documents est traité par des API LLM américaines tierces dans le fonctionnement normal du service. C'est un constat factuel sur le flux de données, pas un signalement de sécurité : ce sont deux API d'entreprise standard avec leurs propres DPA, et les divulguer représente plus de transparence que n'en offrent plusieurs concurrents. Cela compte parce qu'un acheteur européen doit cartographier ces transferts dans son registre des traitements et son DPA, et parce que cela écarte l'hypothèse que les documents restent dans le périmètre d'un fournisseur unique. anyformat exécute lui aussi des LLM dans son moteur d'extraction, avec une architecture indépendante du modèle et une certification ISO 27001 sur le pipeline ; la différence pratique est que le traitement sans rétention est disponible via un simple interrupteur et que les déploiements Enterprise tournent dans votre propre VPC ou on-premise, où le pipeline reste dans votre infrastructure.
Rétention des données
Docsumo ne s'engage sur aucune durée de conservation. Sa politique de confidentialité indique que les données soumises sont conservées aussi longtemps que Docsumo l'estime nécessaire pour fournir un service adéquat, et que les données personnelles ne sont supprimées que dans les deux mois suivant la fermeture du compte (politique de confidentialité Docsumo). Aucun mode de rétention zéro ni de traitement éphémère n'est documenté, quel que soit le palier. Pour un acheteur régulé, une clause de conservation ouverte est en général précisément la clause à renégocier avant signature. anyformat propose la rétention zéro des données en configuration sur les offres Enterprise, si bien que les documents sont traités et non stockés.
Transparence tarifaire
Docsumo ne publie aucun prix. Business et Enterprise sont tous deux affichés sur devis, sans tarif à la page, sans tarif de dépassement ni engagement minimal sur la page tarifaire ; le seul chiffre publié est l'essai gratuit de 14 jours, plafonné à 1 000 pages et 10 licences utilisateur, ce qui constitue un budget d'évaluation réellement généreux. Les tarifs à la page attribués à Docsumo par des tiers se contredisent d'un ordre de grandeur et ne sont pas traçables jusqu'à Docsumo, nous ne les reprenons donc pas ici. anyformat publie sa grille complète et facture en crédits, à la page et par opérateur : 10 crédits coûtent 0,01 €, donc Parse revient à 25 crédits par page (0,025 €, publié sous la forme 25 $ pour 1 000 pages), Extract à 35 crédits par page, Classify à 10, Split à 25 et Validate à 25 crédits par règle (tarifs anyformat, 2026). Pay As You Go est gratuit au démarrage, avec une dotation unique de 50 000 crédits ; Business coûte 499 € par mois (399 € en facturation annuelle) pour 500 000 crédits ; Enterprise est sur devis, avec déploiement en VPC ou on-premise et rétention zéro des données.
Une suite d'évaluations, un optimiseur annoncé et le cycle d'annotation que vous maintiendriez sinon vous-même.
Évaluations, disponibles aujourd'hui. Chaque workflow Extract et Classify d'anyformat dispose d'un onglet Health. Vous constituez un jeu de données avec une vérité terrain vérifiée, en promouvant un document déjà traité par le workflow et en confirmant ses valeurs dans l'interface de revue, ou en téléversant des documents étiquetés avec leur JSON attendu. Les fichiers se taguent en sous-jeux de données, si bien que la précision se lit par fournisseur, par type de document ou par niveau de difficulté plutôt que sous forme d'une moyenne unique. Une évaluation réextrait chaque document concerné sur une version choisie du workflow et le note champ par champ, avec une vue résultat contre attendu sur chaque échec ; les exécutions sont numérotées et immuables, si bien que l'effet d'un changement se mesure au lieu d'être supposé. Health Overview place ensuite le benchmark du jeu de données à côté de la précision de production en temps réel, de la confiance et du through rate, et rapporte l'écart entre les deux (Evals). Docsumo fournit un tableau de bord de reporting avec des métriques de précision et des alertes Slack ou Gmail, l'analytique temps réel étant réservée à Enterprise. Dit précisément : c'est du reporting opérationnel sur le trafic en production, pas une évaluation face à un jeu de vérité terrain figé. Il n'y a ni gestionnaire de jeux de données, ni découpage en sous-jeux, ni historique d'exécutions immuable, ni comparaison entre benchmark et production.
Optimizer, annoncé et pas encore disponible. anyformat a annoncé Optimizer, un workflow qui s'optimise lui-même sur son propre jeu de données en prenant vos évaluations comme cible. Il figure à la feuille de route, pas dans le produit actuel (Evals).
Le pipeline que vous n'avez pas à construire. Ce n'est pas un comparatif API contre plateforme : Docsumo livre l'ingestion, une interface de revue et un constructeur de workflows combinant une interface par prompts et des blocs visuels, et c'est un vrai périmètre produit. Le travail qu'anyformat supprime est plus précis : collecter et annoter environ 20 échantillons pour chaque type de document personnalisé, réannoter quand un fournisseur change sa mise en page, et interpréter des tableaux de bord opérationnels sans benchmark figé auquel les comparer. anyformat couvre cela avec des schémas zero-shot, des workflows no-code dans le Studio, une confiance calibrée par champ avec routage vers la revue, des citations visuelles pour l'audit et la boucle d'évaluation ci-dessus. Mettre en place un workflow de production avec l'assistant Annie prend environ 5 minutes contre à peu près 4 heures de configuration manuelle (benchmark interne anyformat, 2026).
Quand choisir Docsumo
Choisissez Docsumo quand vos documents entrent dans sa bibliothèque pré-entraînée et dans ses verticales : crédit commercial, prêts hypothécaires, souscription CRE, logistique et formulaires d'assurance ACORD, en formats standard américains. La profondeur verticale est authentique, l'interface de revue avec ancrage cliquable vers la source est mature et conçue pour cet usage plutôt qu'ajoutée après coup, et l'essai gratuit jusqu'à 1 000 pages sur 10 licences utilisateur vous permet de valider la précision sur vos propres documents avant toute discussion commerciale. Cela convient aux équipes à l'aise avec un fournisseur uniquement cloud sous juridiction singapourienne et capables d'absorber un cycle d'annotation pour les types de documents hors du jeu pré-entraîné.
Choisissez anyformat quand les types de documents personnalisés doivent fonctionner dès le premier document sans échantillons annotés ; quand la résidence européenne des données, la certification ISO 27001 sur le pipeline, la rétention zéro ou le déploiement on-premise et air-gapped sont des exigences et non des préférences ; quand vos documents sont longs, avec des tableaux s'étendant sur des dizaines de pages ou des fichiers au-delà de 16 pages où la plupart des moteurs se dégradent ; ou quand vous avez besoin d'une confiance calibrée et d'une boucle d'évaluation pour garder un workflow correct après la mise en production, plutôt que d'un tableau de bord qui rapporte ce qui s'est déjà produit.