IDP Processamento inteligente de documentos

Documentos viram dados estruturados, validados antes de seguir

Notas fiscais, boletos, contratos e comprovantes passam por um pipeline visual de quatro estágios. O resultado sai conferido contra os seus sistemas, pronto para o próximo robô ou agente.

NFS-e com os campos localizados pelo IDP, os valores extraídos com confiança e a validação por API
Template

Um pipeline montado visualmente, em quatro estágios

Cada estágio tem camadas que podem ser ligadas, desligadas e reordenadas. Etapas desativadas continuam registradas no resultado.

  1. 01

    Pré-processamento

    Filtros de imagem aplicados em ordem, com prévia de cada etapa.

    • Escala de cinza e nitidez
    • Brilho, saturação e matiz
    • Limiarização para documentos ruidosos
  2. 02

    Extração

    O método certo para cada tipo de documento.

    • OCR em nuvem com tabelas e formulários
    • OCR open source multilíngue
    • OCR por modelo de visão
  3. 03

    Pós-processamento

    O texto extraído vira o dado que o seu sistema espera.

    • Estruturação por LLM em linguagem natural
    • Scripts Node.js e Python isolados
    • Etapas encadeadas com payload progressivo
  4. 04

    Validações

    O resultado é conferido antes de seguir adiante.

    • Chamadas a APIs internas e de terceiros
    • Acionamento de robôs de RPA
    • Veredito consolidado por validação
Extração

Do texto corrido às tabelas e formulários

OCR em nuvem, OCR open source e OCR por modelo de visão, escolhidos por template conforme o documento.

Texto na ordem de leitura

Linhas reconhecidas com posição e grau de confiança de cada bloco.

Tabelas

Linhas e colunas reconstruídas em formato tabular, prontas para consumo.

Formulários

Pares chave-valor, incluindo o estado de caixas de seleção.

Multipágina

PDF e TIFF processados página a página. Também PNG, JPG, WEBP, GIF e BMP.

Pós-processamento

Estruture em linguagem natural ou em código

Descreva em um prompt como o conteúdo deve ser normalizado e classificado, ou escreva um script. Nos dois runtimes o contrato é o mesmo: o script lê input e devolve output.

  • Estruturação por LLM, sem codificação
  • Node.js em sandbox isolada e Python em microsserviço dedicado, com tempo limite
  • Editor de código integrado ao builder, com autocompletar
Pós-processamento do IDP: prompt de LLM, script em Node.js e o JSON final da etapa
Validações e saída

O documento só segue quando o dado confere

Valide o resultado contra APIs institucionais ou entregue direto para um robô de RPA, integrando documento e automação no mesmo ciclo de trabalho.

  • APIs HTTP com GET, POST, PUT, PATCH e DELETE, aprovadas em respostas 2xx
  • Resultado encaminhado a robôs do Roberty com mapeamento de entradas
  • Veredito de cada validação, com detalhe e tempo de execução
IDP Template extrai e estrutura os campos
Validação por API confere o cadastro
Robô de RPA lança no sistema de destino
Governança

Templates tratados como software em produção

Teste, publique, meça e volte atrás com o mesmo rigor.

Playground integrado

Rode o pipeline sobre o documento de referência ou sobre um arquivo avulso, estágio por estágio.

Versões imutáveis

Publicação semântica com snapshot completo do template, ativação controlada e rollback.

Bases de testes

Campos esperados e expectativa de sucesso ou falha, executados em lote a cada mudança.

Tempo por etapa

Cada filtro, método de extração, camada e validação cronometrados em toda execução.

Histórico por ambiente

Execuções de produção, desenvolvimento e testes separadas, com resultado detalhado.

Modelo por template

LLM gerenciado via AWS Bedrock, isolado por workspace, ou OpenAI, Gemini e Anthropic pelas suas conexões.

Qual documento a sua equipe ainda digita à mão?

Conte o desafio da sua operação. Um especialista desenha com você o caminho entre o mapeamento e o primeiro robô rodando.