NouveauEvals est disponible : modifiez vos workflows documentaires sans crainteLire l’article

Docs

Solutions

Blog

Tarifs

Ressources

Essayez gratuitement

Docs
BlogTarifs
Se connecter
Docs
BlogTarifs
Se connecter

Traitement de documents
fiable pour vos systèmes

Le gros du travail sur vos documents les plus difficiles. Parsez, extrayez, classez, découpez et validez-les en données propres et fiables. En production en quelques minutes, avec résidence des données dans l’UE, ISO 27001 et auto-hébergement.

Connectez-le àClaudeCodexGeminivos agents ou appelez-le depuis notreTypeScriptPythonSDK/CLIVoir les docs

Adopté par des équipes qui automatisent des opérations documentaires à fort volume

Adea
L'Oréal
Recalvi
Grupo Fire
Iberia
Singapore Prison Service
Adea
L'Oréal
Recalvi
Grupo Fire
Iberia
Singapore Prison Service

Opérations documentaires
composables en un seul workflow

Parser

Parsez n'importe quel document
en texte propre et structuré

Transformez n'importe quel document en markdown propre que votre pipeline, votre RAG ou vos agents peuvent lire.

Markdown structuréDu markdown propre avec texte, tableaux et figures, lisible par n'importe quelle étape en aval, pipeline RAG ou agent.
Détection de la mise en pageDétecte les titres, les colonnes, l'ordre de lecture et les tableaux, pour que la structure du document survive même sur des pages denses à plusieurs colonnes.
Routage agentiqueLe mode de parsing agentique route les pages et les éléments difficiles, pour une précision plus élevée sur les documents réels et désordonnés.
Tout format, toute langueLit les PDF, images et scans dans n'importe quelle langue, sans template ni configuration par format.
Parser

Parsez n'importe quel document en texte propre et structuré

Transformez n'importe quel document en markdown propre que votre pipeline, votre RAG ou vos agents peuvent lire.

Parser
Markdown structuréDu markdown propre avec texte, tableaux et figures, lisible par n'importe quelle étape en aval, pipeline RAG ou agent.
Détection de la mise en pageDétecte les titres, les colonnes, l'ordre de lecture et les tableaux, pour que la structure du document survive même sur des pages denses à plusieurs colonnes.
Routage agentiqueLe mode de parsing agentique route les pages et les éléments difficiles, pour une précision plus élevée sur les documents réels et désordonnés.
Tout format, toute langueLit les PDF, images et scans dans n'importe quelle langue, sans template ni configuration par format.
Extraire

Extrayez exactement les données dont vos systèmes ont besoin

Transformez les documents parsés en champs typés et structurés, utilisables partout.

Extraire
Des centaines de pages, en une passeExtrayez sur des centaines de pages en une seule passe, sans chunking ni assemblage manuel.
Citations visuellesChaque valeur revient citée à sa position exacte sur la page, avec navigation directe vers la source.
Score de confianceUn score de confiance par champ indique à quoi vous fier et quoi envoyer en revue humaine.
Tableaux complexesCapturez les tableaux longs, multipages et imbriqués, comme des lignes de facture réparties sur des dizaines de pages, en une seule passe.
Classifier

Triez chaque document dans le bon type

Étiquetez chaque document pour qu'un seul workflow gère de nombreux types de documents.

Classifier
Des catégories que vous définissezCréez vos propres étiquettes, chacune avec une courte description de ce qu'elle regroupe.
Aucune donnée d'entraînementClassifie à partir de vos seules descriptions en langage naturel, sans exemples étiquetés.
Routage intégréEnvoyez chaque catégorie sur son propre chemin, pour qu'un seul workflow gère chaque type de document.
Auto-apprentissageLes corrections sont réinjectées, et la classification s'affine au fil du temps sur vos documents.
Scinder

Scindez les fichiers groupés en documents propres

Séparez les fichiers multi-documents pour que chaque partie soit traitée individuellement.

Scinder
Scission par catégorieDéfinissez des règles de scission en langage naturel, et chaque segment est traité individuellement.
Documents répétésSéparez plusieurs documents du même type, comme quatre factures agrafées dans un même PDF, en exécutions indépendantes.
Documents longsDécoupez une liasse de 50 pages en sections, chacune traitée séparément.
Rien ne passe à traversTout ce qui ne correspond à aucune règle atterrit dans un groupe fourre-tout, et aucun document n'est jamais écarté en silence.
Valider

Détectez les données erronées avant qu'elles ne sortent

Vérifiez chaque résultat contre des règles que vous écrivez en langage naturel.

Valider
Des règles en langage naturelÉcrivez des contrôles comme « l'IBAN est valide » ou « le document n'est pas expiré », sans écrire de code.
Signalement automatiqueChaque document est vérifié, et tout ce qui échoue remonte pour revue au lieu de passer entre les mailles.
Contrôles croisésComparez des valeurs entre champs, comme le nom sur une pièce d'identité et le nom sur le contrat.
Human-in-the-loopLes règles automatiques se combinent à la validation humaine, placée exactement où vous le voulez, à grande échelle.
Orchestrer

Exécutez tout le workflow en un seul appel

Reliez chaque étape dans un workflow unique qui s'exécute de bout en bout.

Orchestrer
Graphe composableConnectez Parser, Extraire, Classifier, Scinder et Valider dans un graphe typé pour n'importe quel document.
Branches et conditionsDes nœuds conditionnels envoient chaque type de document ou segment sur son propre chemin.
Un appel, de bout en boutExécutez un workflow entier sur un document en un seul appel API.
Exécution en masseAppliquez un workflow publié à de gros lots via l'API, l'interface ou la synchronisation avec le stockage cloud.
Benchmark

Des documents réels. Des chiffres réels.

Une précision de niveau frontier,
avec confiance et citations visuelles

Mesurer la qualité du parsing de documents est complexe. Cela couvre plusieurs dimensions, dont l’extraction du contenu, les tableaux et la structure du document, chacune exigeant ses propres métriques d’évaluation. Notre Parse Score les réunit en un seul benchmark, en combinant des métriques à l’état de l’art sur plus de 1 000 documents réels face à une vérité terrain soigneusement constituée. anyformat surpasse tous les moteurs d’OCR spécialisés du marché, et c’est la seule solution qui fournit aussi des scores de confiance calibrés et des citations visuelles, rendant chaque résultat extrait à la fois précis et vérifiable.

Parser
Citations visuelles
Confiance calibrée
Parse Score
Coût / 1 000 pages
anyformat
78.1%
$25
Gemini 3.5 Flash
77.9%
$31.33
Claude Opus 4.8
77.3%
$83.50
GPT-5.6
74.2%
$82.15
GPT-4.1
≈
72.3%
$14.43
Mistral OCR 4
≈
70.5%
$4
Azure DI
≈
69.9%
$10
AWS Textract
≈
65.4%
$15
Google Doc AI
≈
55.0%
$1.50
Docling
≈
52.3%
Auto-hébergé
PaddleOCR
≈
43.2%
Auto-hébergé

Précis à la page un.
Toujours précis à la page cinquante.

Le parsing des documents longs est le point de rupture de la plupart des systèmes. Quand les tableaux s’étendent sur des dizaines de pages, les modèles perdent progressivement en couverture et sautent des lignes en silence, même quand le document est parfaitement lisible. Nous avons évalué des documents réels allant jusqu’à 50 pages (≈2 400 lignes) et mesuré combien de lignes étaient correctement récupérées. anyformat reste précis du début à la fin, alors que les principaux modèles frontier et les pipelines OCR par défaut se dégradent rapidement à mesure que le document s’allonge.

Une compréhension native
des mises en page complexes

Nous mesurons le pourcentage de documents extraits parfaitement : chaque ligne correcte et chaque total réconcilié. Sur près de 100 factures réelles, complexes et de formats variés, regroupées par nombre de pages, l’écart se creuse à mesure que les documents grandissent. Dans la tranche la plus difficile (16 pages et plus), anyformat maintient 80 % de factures parfaites, quand le deuxième meilleur modèle n’atteint que 53 %.

Docs parfaits
Facile
Moyen
Difficile
Global
anyformat
98%
94%
80%
94%
GPT-5.6
92%
94%
53%
87%
Claude Opus 4.8
96%
94%
27%
85%
Gemini 3.5 Flash
90%
94%
27%
81%
GPT-4.1
82%
38%
13%
57%

Une confiance calibrée
sur chaque champ extrait

Chaque valeur porte une confiance calibrée, pas un signal non calibré : vous pouvez donc fixer un seuil et approuver automatiquement la majorité des cas à haute confiance. Ce n’est pas non plus un chiffre global unique : anyformat calibre chaque opérateur séparément, pour que le score corresponde au travail qui l’a produit.

99.1%
précision de calibration · ECE adaptatif 0,009
Lire la méthode
Pourquoi anyformat

Conçu pour la production,
pas pour les démos

L'OCR brut ne lit pas la structure. Un LLM brut hallucine et ne peut pas être audité. anyformat combine les deux avec des règles déterministes, un score de confiance et de la validation, pour un résultat structuré, traçable et prêt pour la production.

OCR traditionnel
LLM brut
anyformatanyformat
Lit la mise en page, les tableaux et la structure
–
~
Documents longs, des centaines de pages
~
–
Tableaux complexes sur plusieurs pages
–
~
Scans médiocres et entrées de faible qualité
~
–
Tout format et toute langue, sans templates
–
Citations visuelles : chaque valeur citée à sa position exacte sur la page
–
–
Score de confiance et supervision humaine
–
~
Résidence des données dans l'UE, ISO 27001, zéro rétention
–
–
Conçu pour l'ère des agents

Par des ingénieurs et des agents
pour des ingénieurs et des agents

Appelez les workflows anyformat directement depuis votre code avec le SDK ou la CLI, ou ajoutez l'agent skill et laissez votre agent de codage les construire et les exécuter pour vous en quelques minutes, pas en plusieurs mois.

Terminal
Claude Code
Claude Code
Opus 4.8
SDKs

Installez le SDK pour appeler les workflows anyformat directement depuis votre code.

npm install @anyformat/sdk
CLI

Utilisez la CLI Python pour exécuter et gérer vos workflows depuis le terminal.

uv tool install --python 3.13 anyformat && afx --help
Agent Skill

Ajoutez cette skill pour apprendre à votre agent l'API des workflows anyformat.

npx @anyformat/skill
Au-delà du modèle

Tout ce qui entoure le modèle, intégré.

OCR et parsing avancés, complétés par les capacités nécessaires pour construire et exécuter des workflows fiables, vite et à grande échelle.

annie construit votre workflow

annie configure tout le workflow pour vous en quelques secondes. Aucune configuration manuelle.

Je veux extraire des informations de factures
Création d’un workflow avec parse + extract selon un schéma de facture : fournisseur, numéro de facture, date, échéance, montant.

Confiance par champ

Chaque champ reçoit un score calibré : ne relisez que ce qui le nécessite.

Nom du contrat
99%
Contrat de licence logicielle
Date
80%
2026-03-24
Type de contrat
98%
Travail

Évaluez et surveillez

Évaluez chaque changement sur votre propre dataset avant la mise en production. Une fois en ligne, suivez la précision champ par champ.

Une icône de fiole au-dessus d’une pile de documents, représentant la préparation du dataset

Choisissez le bon mode

Basculez entre Rapide, Standard et Agentique. Optimisez la latence ou la précision, selon ce que chaque tâche exige.

Rapide
Standard
Agentique

annie continue de l’améliorer

Demandez à annie d’améliorer votre workflow. Elle trouve le correctif et l’applique automatiquement.

Précision par itération
#1
#2
#3
#4
#5
#6
1re optimisation
5 champs · 6 itérations
Terminé
92,5%→97,0%+4,5p
Sécurité et certifications

Sécurité de niveau entreprise

anyformat répond nativement aux exigences de sécurité et de conformité des entreprises, pour que vos équipes exécutent leurs workflows documentaires en production en toute confiance.

RGPD
RGPDDonnées personnelles traitées selon les standards du RGPD, avec résidence des données dans l'UE.
ISO 27001
ISO 27001Certification indépendante ISO 27001 pour la gestion de la sécurité de l'information.
Déploiement auto-hébergé
Déploiement auto-hébergéExécutez anyformat dans notre cloud, dans un VPC dédié ou entièrement auto-hébergé dans votre propre infrastructure. Vos données restent exactement là où votre politique l'exige.
Visitez le Trust Center
Cas d'usage

Conçu pour les secteurs
qui n'ont pas droit à l'erreur

Factures, connaissements, demandes de remboursement, contrats… anyformat prend en charge les documents critiques dont dépend chaque secteur, et va en profondeur là où la précision compte le plus.

Comptabilité fournisseurs

Transformez chaque facture, avoir et relevé envoyés par vos fournisseurs en données structurées pour votre ERP.

anyformat les lit quels que soient le fournisseur, la mise en page et la langue, les valide par rapport aux bons de commande et envoie des données propres vers SAP, Oracle ou NetSuite.

“Nous sommes passés d'une saisie manuelle intensive à une validation agile, chaque chiffre restant traçable jusqu'à sa source.”

Responsable des opérations comptabilité fournisseursGroupe industriel international
Le voir en action
Invoice

Questions fréquentes

Les réponses aux questions les plus courantes sur anyformat et ses fonctionnalités. Une autre question ? N’hésitez pas à nous contacter.

anyformat est une plateforme d’intelligence documentaire qui extrait, structure et route les données de n’importe quel document, automatiquement. Elle combine des modèles d’IA avec des règles déterministes et une orchestration de workflows no-code, conçue pour les équipes qui exigent une précision de niveau production.

Commencez par vos documents les plus difficiles.

anyformat fait le gros du travail sur les documents qui font échouer d’autres outils. Parsez, extrayez et validez-les en données propres et fiables, et passez en production en quelques minutes.

Sans carte bancaire · 50 000 crédits gratuits pour commencer

Contact :

info@anyformat.ai
ISO 27001 CertifiedGDPR Compliant

Restez informé

Recevez les nouveautés et actualités produit

Plan du site

  • Accueil
  • Plateforme
  • Clients
  • Sécurité
  • FAQ
  • Tarifs
  • Se connecter
  • Essayez gratuitement

Secteurs

  • Comptabilité fournisseurs
  • Logistique et Supply Chain
  • Services financiers et KYC
  • Santé
  • Immobilier
  • Juridique

Cas d’usage

  • Traitement des factures
  • Tableaux complexes
  • RAG et intelligence documentaire
  • Extraction API-first

Ressources

  • Docs
  • Changelog
  • Blog
  • Presse
  • Sécurité et confiance
Financiado por la Unión Europea – NextGenerationEUGobierno de España – Ministerio para la Transformación Digital y de la Función PúblicaPlan de Recuperación, Transformación y ResilienciaComunidad de Madrid

Copyright © 2026 anyformat.ai · Automatisation des opérations documentaires d’entreprise

Politique de confidentialitéConditions d’utilisationPolitique de cookies
1