Pular para o conteúdo

Testando um Agente

O teste do editor usa o mesmo agente e o mesmo runtime das conversas reais. Ele é útil para validar uma configuração antes de divulgá-la, mas não é uma simulação isolada: mensagens consomem créditos, conversas ficam salvas e ferramentas podem executar ações reais nos serviços conectados.

Confirme três condições:

  1. O agente está Ativo. Quando está inativo, Testar Agente fica desabilitado e orienta a ativá-lo em Configurações Avançadas.
  2. As mudanças que você quer avaliar foram salvas. O painel sempre executa a versão salva. Se houver alterações pendentes, ele mostra um aviso e a ação Salvar e testar.
  3. Os dados e serviços usados no teste são seguros. Prefira registros descartáveis e pedidos sem impacto. Não teste exclusões, pagamentos, disparos, publicações ou outras ações irreversíveis sem um ambiente controlado no sistema de destino.

Revise Prompts de Sistema, Modelos, Ferramentas e Skills e Configurações Avançadas antes de interpretar um resultado inesperado.

No editor do agente, selecione Testar Agente no topo. Em telas grandes, o teste abre ao lado do formulário; em telas menores, abre como um painel sobre a página. O editor continua no mesmo agente.

O primeiro envio cria uma conversa persistente. Fechar o painel não apaga a conversa.

Na lista de agentes, a ação Conversar é outro fluxo: ela abre uma nova sessão no Hub completo e depende da permissão de acesso ao Hub. Use o painel do editor para iterar sobre a configuração; use o Hub para conferir a experiência completa de conversa e navegação.

O botão Conversas de teste mostra até 20 conversas recentes desse agente. Selecione uma para retomar seu contexto.

Nova conversa limpa o painel e inicia um rascunho sem apagar as anteriores. O novo registro só é criado quando você envia a primeira mensagem. O histórico completo continua disponível no Hub.

Use uma conversa nova quando precisar provar que a resposta não depende de contexto anterior. Retome uma conversa existente quando estiver testando memória, continuidade, correção de dados ou uma sequência de passos.

Registre a entrada usada, o resultado esperado e o resultado atual. Cubra pelo menos:

CenárioO que verificar
Pedido simples dentro do escoporesposta correta, direta e no tom configurado
Pedido complexo dentro do escopodecomposição do problema e ausência de fatos inventados
Pedido fora do escopolimite claro, sem fingir capacidade
Informação insuficientepergunta de esclarecimento antes de assumir dados
Conhecimento vinculadorecuperação do conteúdo certo e admissão quando a base não responde
Ferramenta necessáriaescolha da ferramenta, argumentos, resultado e tratamento de falha
Ferramenta desnecessáriaresposta sem ação externa
Anexo permitidoimagem, arquivo ou áudio processado conforme a configuração multimodal
Guardrailbloqueio ou orientação segura para conteúdo proibido
Transferênciadestino e contexto preservados, quando o agente puder transferir
Continuidadecomportamento coerente ao retomar a mesma conversa

Teste também entradas ambíguas, dados inválidos, serviço indisponível e usuário frustrado. Uma resposta convincente não basta: confirme que o agente fez a ação correta e não ocultou um erro.

Quando houver passos internos, a mensagem mostra um resumo do caminho executado. Abra Ver o caminho e depois Ver detalhes para inspecionar cada etapa. Uma ferramenta concluída inclui o nome, o status, os dados em Input, o Result e, quando registrado, o tempo de execução. Passos de guardrail e processamento de anexos também podem aparecer.

No menu de ações da mensagem do agente, os detalhes podem incluir agente, modelo solicitado e efetivo, provedor, tokens, custo, horário e nomes das ferramentas. Créditos aparecem somente quando a organização permite essa visualização e o usuário tem o nível de acesso necessário.

A página Execuções não é o log detalhado dessas mensagens: ela mantém fluxos legados de agendamentos e follow-ups. Para auditar o teste, use os passos e os detalhes da própria mensagem.

Altere uma variável por vez — prompt, modelo, conhecimento, ferramenta ou configuração avançada —, salve e repita exatamente o mesmo caso em uma conversa nova. Assim você consegue atribuir a mudança de resultado à configuração correta.

Antes de liberar o agente:

  • repita os casos críticos depois do último salvamento;
  • confirme que nenhum dado de outra organização, departamento ou conversa apareceu;
  • confira falhas e efeitos externos, não apenas o texto final;
  • registre exemplos aprovados e reprovados para regressão;
  • execute no Hub ao menos uma jornada completa com as permissões do público real.