Testando um Agente
O teste do editor usa o mesmo agente e o mesmo runtime das conversas reais. Ele é útil para validar uma configuração antes de divulgá-la, mas não é uma simulação isolada: mensagens consomem créditos, conversas ficam salvas e ferramentas podem executar ações reais nos serviços conectados.
Antes de começar
Section titled “Antes de começar”Confirme três condições:
- O agente está Ativo. Quando está inativo, Testar Agente fica desabilitado e orienta a ativá-lo em Configurações Avançadas.
- As mudanças que você quer avaliar foram salvas. O painel sempre executa a versão salva. Se houver alterações pendentes, ele mostra um aviso e a ação Salvar e testar.
- Os dados e serviços usados no teste são seguros. Prefira registros descartáveis e pedidos sem impacto. Não teste exclusões, pagamentos, disparos, publicações ou outras ações irreversíveis sem um ambiente controlado no sistema de destino.
Revise Prompts de Sistema, Modelos, Ferramentas e Skills e Configurações Avançadas antes de interpretar um resultado inesperado.
Abrir o painel de teste
Section titled “Abrir o painel de teste”No editor do agente, selecione Testar Agente no topo. Em telas grandes, o teste abre ao lado do formulário; em telas menores, abre como um painel sobre a página. O editor continua no mesmo agente.
O primeiro envio cria uma conversa persistente. Fechar o painel não apaga a conversa.
Na lista de agentes, a ação Conversar é outro fluxo: ela abre uma nova sessão no Hub completo e depende da permissão de acesso ao Hub. Use o painel do editor para iterar sobre a configuração; use o Hub para conferir a experiência completa de conversa e navegação.
Conversas de teste e histórico
Section titled “Conversas de teste e histórico”O botão Conversas de teste mostra até 20 conversas recentes desse agente. Selecione uma para retomar seu contexto.
Nova conversa limpa o painel e inicia um rascunho sem apagar as anteriores. O novo registro só é criado quando você envia a primeira mensagem. O histórico completo continua disponível no Hub.
Use uma conversa nova quando precisar provar que a resposta não depende de contexto anterior. Retome uma conversa existente quando estiver testando memória, continuidade, correção de dados ou uma sequência de passos.
Matriz mínima de teste
Section titled “Matriz mínima de teste”Registre a entrada usada, o resultado esperado e o resultado atual. Cubra pelo menos:
| Cenário | O que verificar |
|---|---|
| Pedido simples dentro do escopo | resposta correta, direta e no tom configurado |
| Pedido complexo dentro do escopo | decomposição do problema e ausência de fatos inventados |
| Pedido fora do escopo | limite claro, sem fingir capacidade |
| Informação insuficiente | pergunta de esclarecimento antes de assumir dados |
| Conhecimento vinculado | recuperação do conteúdo certo e admissão quando a base não responde |
| Ferramenta necessária | escolha da ferramenta, argumentos, resultado e tratamento de falha |
| Ferramenta desnecessária | resposta sem ação externa |
| Anexo permitido | imagem, arquivo ou áudio processado conforme a configuração multimodal |
| Guardrail | bloqueio ou orientação segura para conteúdo proibido |
| Transferência | destino e contexto preservados, quando o agente puder transferir |
| Continuidade | comportamento coerente ao retomar a mesma conversa |
Teste também entradas ambíguas, dados inválidos, serviço indisponível e usuário frustrado. Uma resposta convincente não basta: confirme que o agente fez a ação correta e não ocultou um erro.
Inspecionar ferramentas e consumo
Section titled “Inspecionar ferramentas e consumo”Quando houver passos internos, a mensagem mostra um resumo do caminho executado. Abra Ver o caminho e depois Ver detalhes para inspecionar cada etapa. Uma ferramenta concluída inclui o nome, o status, os dados em Input, o Result e, quando registrado, o tempo de execução. Passos de guardrail e processamento de anexos também podem aparecer.
No menu de ações da mensagem do agente, os detalhes podem incluir agente, modelo solicitado e efetivo, provedor, tokens, custo, horário e nomes das ferramentas. Créditos aparecem somente quando a organização permite essa visualização e o usuário tem o nível de acesso necessário.
A página Execuções não é o log detalhado dessas mensagens: ela mantém fluxos legados de agendamentos e follow-ups. Para auditar o teste, use os passos e os detalhes da própria mensagem.
Corrigir e repetir
Section titled “Corrigir e repetir”Altere uma variável por vez — prompt, modelo, conhecimento, ferramenta ou configuração avançada —, salve e repita exatamente o mesmo caso em uma conversa nova. Assim você consegue atribuir a mudança de resultado à configuração correta.
Antes de liberar o agente:
- repita os casos críticos depois do último salvamento;
- confirme que nenhum dado de outra organização, departamento ou conversa apareceu;
- confira falhas e efeitos externos, não apenas o texto final;
- registre exemplos aprovados e reprovados para regressão;
- execute no Hub ao menos uma jornada completa com as permissões do público real.