O AWS Textract é a API de OCR com machine learning da Amazon, lançada em maio de 2019, que extrai texto, formulários, tabelas e assinaturas de ficheiros JPEG, PNG, PDF e TIFF. Comparações de terceiros colocam a sua deteção de tabelas e linhas de detalhe entre as mais sólidas dos serviços de OCR na cloud, e integra-se nativamente com S3, Lambda, SNS e SQS, com APIs pré-construídas para despesas (AnalyzeExpense), documentos de identificação norte-americanos (AnalyzeID) e processos hipotecários (AnalyzeLending). Aplicam-se limites rígidos: as chamadas síncronas aceitam ficheiros de 10 MB e PDFs de uma única página, os trabalhos assíncronos 500 MB e 3.000 páginas; a deteção de texto cobre seis idiomas, com escrita manual e queries apenas em inglês (documentação da AWS, 2026).
O Textract devolve OCR em bruto, ou seja, blocos de texto, bounding boxes, pares chave-valor e células de tabela, e não impõe qualquer esquema de saída. A funcionalidade Queries está limitada a 15 consultas por página em chamadas síncronas e 30 em assíncronas (documentação da AWS, 2026). Transformar esse resultado em dados prontos para a sua aplicação exige um pipeline de pós-processamento personalizado: mapeamento de campos, regras de validação, gestão de erros e normalização de formatos. A anyformat extrai contra um esquema definido pelo utilizador em zero-shot: defina os campos, carregue um documento, receba JSON validado. Aceita mais de 100 formatos de documento sem modelos, combinando LLMs com regras determinísticas, e as alterações ao esquema aplicam-se de imediato sem deploys de código.
Orquestração de workflows
O Textract não tem camada de workflows: classificação, divisão, encaminhamento, validação, revisão humana e gestão de novas tentativas montam-se com Lambda, Step Functions, SNS, SQS e código personalizado. Esse esforço de engenharia, e não a tarifa por página, é o custo dominante de operar o Textract em produção. A anyformat inclui um construtor visual de workflows (Studio) com ramificações, condições, divisão, encaminhamento, operadores de extração e revisão human-in-the-loop integrada, pelo que as equipas de operações e de engenharia atualizam os workflows sem deploys de código.
Preços
O Textract cobra por página e por funcionalidade: 1,50 $ por 1.000 páginas na deteção de texto, 15 $ para tabelas, 50 $ para formulários, 10 $ para despesas e 70 $ para processos hipotecários (preços da AWS, US West, 2026). A anyformat fatura em créditos, por página e por operador, sem dependência da AWS: 10 créditos custam 0,01 €, pelo que o Parse são 25 créditos por página (0,025 €, publicado como 25 $ por 1.000 páginas), o Extract 35 créditos por página, o Classify 10, o Split 25 e o Validate 25 créditos por regra (preços da anyformat, 2026). O Pay As You Go é gratuito para começar, com uma atribuição única de 50.000 créditos; o Business custa 499 € por mês (399 € com faturação anual) com 500.000 créditos, 5 utilizadores e 10 workflows; e o Enterprise tem preço à medida, com utilizadores e workflows ilimitados, implementação em VPC ou on-premise e retenção zero de dados. Combinar funcionalidades do Textract multiplica a tarifa por página, e o pipeline de Lambda e Step Functions à sua volta acrescenta um custo de engenharia que o preço por página nunca mostra; a métrica que importa é o custo por resultado correto, onde a anyformat obteve 78,1% contra 65,4% do Textract no benchmark de parsing de 2026 (benchmark da anyformat, 2026).
A anyformat obteve 78,1% e o AWS Textract 65,4% num parse score combinado sobre mais de 1.000 documentos reais de mais de 30 tipos (benchmark da anyformat, 2026). O Textract continua sólido em formulários e tabelas padrão, mas aplana layouts multicoluna, degrada-se em tabelas que atravessam várias páginas ou contêm células unidas e não consegue interpretar figuras, gráficos ou diagramas; a anyformat deteta elementos visuais e devolve descrições estruturadas. Em tabelas que crescem até 50 páginas e cerca de 2.400 linhas, a anyformat manteve uma recuperação de linhas de ~99%, e extraiu 94% das faturas de formatos variados com todos os campos e linhas de detalhe corretos (benchmark da anyformat, 2026). Em produção, a L'Oréal reporta 99% de precisão de extração e uma redução de 60% no tempo de processamento em mais de 1.500 faturas mensais.
Confiança e revisão humana
As pontuações de confiança do Textract não estão calibradas, pelo que uma pontuação reportada não corresponde a uma probabilidade real de acerto (benchmark da anyformat, 2026). A anyformat calibra a confiança por campo, medida em 99,1% de precisão de calibração com um Adaptive ECE de 0,009 (benchmark da anyformat, 2026), e anexa citações visuais que ligam cada valor extraído à sua posição exata na página. A calibração é o que faz os limiares funcionarem: os campos de confiança elevada fluem automaticamente e os incertos são encaminhados para revisores.
O Textract corre apenas na AWS, sob jurisdição norte-americana independentemente da região selecionada; para organizações sujeitas ao RGPD ou ao DORA, a escolha da região é um detalhe de configuração, não uma garantia de soberania. A sua postura de conformidade herda certificações de plataforma da AWS como SOC 2 e elegibilidade HIPAA, que cobrem a infraestrutura e não o pipeline de extração construído por cima. A anyformat é nativa da UE, tem certificação ISO 27001 sobre todo o pipeline documental, oferece processamento com retenção zero num único interruptor (o equivalente no Textract exige manter políticas de ciclo de vida do S3 e de retenção do CloudWatch) e implementa-se em cloud, cloud privada ou ambientes on-premise air-gapped. O Textract não tem opção on-premise (documentação da AWS, 2026).
Uma suite de avaliações e o pipeline de produção em torno da extração. A qualidade de extração é uma variável; mantê-la correta depois de entrar em produção é onde os projetos documentais gastam a maior parte do orçamento de engenharia.
Avaliações, disponíveis hoje. Cada workflow de Extract e Classify da anyformat tem um separador Health. Constrói-se um dataset com ground truth verificada, promovendo um documento que o workflow já processou e confirmando os seus valores na interface de revisão, ou carregando documentos anotados com o JSON esperado. Os ficheiros são etiquetados em sub-datasets, pelo que a precisão se lê por fornecedor, por tipo de documento ou por nível de dificuldade em vez de como uma média única. Uma avaliação volta a extrair cada documento abrangido numa versão escolhida do workflow e pontua-o campo a campo, com uma vista de resultado contra esperado em cada falha; as execuções são numeradas e imutáveis, pelo que o efeito de uma alteração é medido em vez de suposto. O Health Overview coloca depois o benchmark do dataset ao lado da precisão de produção em tempo real, da confiança e do through rate, e reporta a diferença entre ambos (Evals). A AWS reporta precisão, recall e F1 para um adaptador Custom Queries treinado contra um conjunto de teste anotado (documentação da AWS, 2026); essa medição limita-se a um adaptador sobre a funcionalidade Queries e não a um pipeline de ponta a ponta, sem segmentação por sub-datasets, sem histórico imutável de execuções nem comparação entre benchmark e produção.
Optimizer, anunciado e ainda não disponível. A anyformat anunciou o Optimizer, um workflow que se ajusta a si próprio contra o seu próprio dataset usando as suas avaliações como objetivo. Está no roteiro, não no produto de hoje (Evals).
O pipeline que não tem de construir. O Textract devolve blocos de texto, bounding boxes, pares chave-valor e células de tabela. Em produção são precisos também pós-processamento, validação de esquema, lógica de novas tentativas e encaminhamento, uma interface de revisão humana, monitorização da precisão e reajustes sempre que muda um layout ou um modelo subjacente; a própria orientação da AWS monta essa camada com Lambda e Step Functions. O Amazon A2I, o ciclo gerido de revisão humana ligado à operação AnalyzeDocument do Textract, fecha o acesso a novos clientes a 30 de julho de 2026 e não vai receber novas funcionalidades (documentação da AWS, 2026). A anyformat entrega essa camada como produto: workflows no-code no Studio, confiança calibrada por campo com encaminhamento para revisão, citações visuais para auditoria e o ciclo de avaliações acima. Montar um workflow de produção com o assistente Annie demora cerca de 5 minutos contra aproximadamente 4 horas de configuração manual (benchmark interno da anyformat, 2026).
Quando escolher o AWS Textract
Escolha o Textract quando a sua stack é nativa da AWS, os seus documentos correspondem às APIs pré-construídas (formulários, tabelas, recibos, identificações norte-americanas, processos hipotecários) e a sua equipa consegue construir e manter o pipeline circundante. O pagamento por uso escala a partir do zero sem compromisso mínimo, e a integração nativa com S3, Lambda e Step Functions mantém todo o fluxo dentro de uma única cloud.
Escolha a anyformat quando precisa de extração validada por esquema, orquestração de workflows e revisão humana sem montar infraestrutura; quando os seus documentos vão além dos formulários padrão, com tabelas longas, mais de 100 formatos ou figuras incorporadas; ou quando a residência europeia dos dados, a implementação on-premise e a confiança calibrada para straight-through processing são requisitos inegociáveis.
As equipas que substituem o Textract citam de forma consistente a camada de workflows em falta, o custo do pós-processamento e a jurisdição norte-americana como fatores decisivos. Para uma visão mais ampla do mercado, consulte o nosso guia das melhores alternativas ao AWS Textract.