Conceito e mecanismo
Classificar uma imagem responde sobre o seu conteúdo global; detetar objetos acrescenta localização de instâncias. OCR extrai caracteres de imagens. Análise de layout conserva estrutura, como tabelas, linhas e posições, útil quando um montante precisa de ficar associado à entidade correta. Document Intelligence oferece modelos de leitura, layout e extração documental. A deteção de uma face identifica a sua presença e posição, sem provar quem é a pessoa. Reconhecimento de identidade é uma capacidade distinta, com requisitos e disponibilidade próprios. Escolhe a saída de que o processo necessita antes de escolher o nome do serviço.
Aplicação guiada
Numa integração financeira fictícia, inclui documentos com baixa resolução, tabelas partidas e separadores decimais diferentes. Compara valores extraídos com a origem e com totais de controlo. Confidence ajuda a encaminhar casos, mas não garante a correção de um resultado individual nem autoriza um lançamento. Define revisão para divergências e mede erros por tipo de documento. O handover deve indicar modelo, versão, layout suportado e tratamento de exceções. Há ainda uma decisão de ciclo de vida: Image Analysis 4.0 está descontinuado, com retirada anunciada para 25-09-2028. Essa indicação não significa retirada de todos os serviços Vision. Para projetos novos, verifica alternativas e suporte durante todo o horizonte de manutenção.
Um valor extraído com confidence elevada continua pendente se contradiz a moeda ou o total do documento.
Armadilhas comuns
OCR como tabela estruturada; face detetada como identidade; confidence como prova; programa histórico como suporte atual.
Tópicos relacionados: Workloads e responsabilidade na operação · Machine learning e avaliação útil · Linguagem, fala e significado operacional
A saída visual precisa de validação funcional e de uma dependência suportada.
Referência: Document Intelligence extraction and layout · AI-900 historical skills measured 2025-05-02; exam retired 2026-06-30