Pular para o conteúdo

Modelos

O Modelo de IA é o modelo de linguagem que produz as respostas do agente. A escolha muda a qualidade do texto, a capacidade de usar ferramentas e anexos, a velocidade, o raciocínio e o consumo de créditos.

O catálogo muda com o tempo. Escolha pelo que o agente precisa fazer e valide o resultado em conversas reais; não dependa de uma lista estática de nomes de modelos.

Em Agentes, abra o agente e selecione Modelo na navegação do editor. A seção mostra somente modelos de texto ativos que estão disponíveis para o plano atual da organização. Modelos de geração de imagem ficam em outro fluxo.

Se a organização não tiver plano ativo, aparece Nenhum plano ativo. Contate o suporte para liberar modelos. Se o agente já usa um modelo que saiu do catálogo disponível, o slug salvo aparece com o selo Indisponível. O SquadOS preserva essa seleção até você escolher e salvar outra; o selo não troca o modelo automaticamente.

O selo Padrão identifica o modelo padrão do sistema. Um agente criado manualmente começa com esse padrão — não necessariamente com o cartão Melhor custo-benefício.

Sem uma busca ativa, até três cartões podem aparecer:

  • Mais barato — Para testes;
  • Melhor custo-benefício — Recomendado;
  • Melhor performance — Máxima capacidade.

Esses rótulos são comparações dentro do catálogo disponível, não garantias de adequação a qualquer tarefa. O SquadOS considera preço, medições públicas de capacidade e o que o agente usa hoje. Um modelo só entra nos cartões se tiver dados suficientes e preservar:

  • uso de ferramentas, quando o agente tem ferramentas ativas;
  • leitura de imagem, quando essa modalidade está habilitada;
  • uma janela de contexto grande o bastante para o prompt atual;
  • o nível de uso de ferramentas exigido pela quantidade de ferramentas ativas.

A equipe SquadOS pode fixar um modelo em um dos cartões. Esse modelo ainda precisa estar disponível para a organização e atender aos requisitos do agente; caso contrário, o cartão é calculado com outro candidato. O mesmo modelo não é repetido em mais de um cartão, por isso podem aparecer menos de três.

Recomendado para este agente é uma marca mais específica: aparece quando a análise encontra uma troca compatível para um modelo atual abaixo do nível exigido. Se o modelo atual não tiver medição pública suficiente, o SquadOS não afirma que a troca é melhor.

O campo Buscar modelos por nome, provedor ou slug… filtra o catálogo e esconde os cartões enquanto a busca estiver ativa. A lista é ordenada por provedor e nome. Cada linha mostra:

  • provedor e nome do modelo;
  • o selo Padrão, quando aplicável;
  • o nível medido de uso de ferramentas: Básico, Intermediário, Poderoso, Elite ou Desconhecido;
  • o preço de saída em cr/1k, isto é, créditos por 1.000 tokens de saída.

Quando existem candidatos dos dois tipos, a lista se divide em Sugeridos e Outros modelos (não sugeridos para esse agente). Abra o segundo grupo para consultar modelos que não preservam alguma capacidade, têm nível insuficiente ou ainda não possuem medição. Uma busca abre os dois grupos; o grupo também abre sozinho quando contém o modelo salvo.

Você ainda pode selecionar um modelo em Outros modelos. Essa escolha não é bloqueada, mas pode fazer o agente perder leitura de imagem, espaço de contexto ou confiabilidade no uso de ferramentas. Reconfigure o agente ou escolha um modelo sugerido antes de salvar.

O painel à direita descreve o modelo selecionado:

  • nome, provedor e descrição;
  • capacidade geral, Inteligência e Ferramentas, quando medidos pela Artificial Analysis;
  • Velocidade e Tempo até a 1ª palavra, quando medidos;
  • taxas de Entrada e Saída em créditos por 1.000 tokens;
  • capacidades declaradas, como Imagem, Arquivos, Thinking e Web Search;
  • controle de Reasoning (pensamento estendido), quando o modelo oferece esse recurso.

Desconhecido ou não medido não significa capacidade baixa: significa que não há medição pública suficiente. O painel atual não exibe o slug, a janela de contexto nem a saída máxima. Consulte Configurações → Modelos de IA para esses dados de catálogo.

Se a área Capacidades ficar vazia, não conclua que o modelo não aceita texto nem ferramentas. Modelos cuja modalidade publicada é apenas texto podem cair nesse estado visual. Valide as capacidades no catálogo e no teste do agente.

O controle de raciocínio só aparece para modelos que o suportam. As opções vêm do próprio modelo e podem incluir Padrão, Desligado, Mínimo, Baixo, Médio, Alto, Muito alto ou Máximo.

  • Padrão deixa o SquadOS aplicar o nível padrão efetivo.
  • Desligado aparece somente quando o provedor permite desligar o raciocínio.
  • Em modelos com raciocínio obrigatório, a tela informa Reasoning é obrigatório neste modelo.
  • Ao trocar de modelo, um nível incompatível volta automaticamente para Padrão.

Mais raciocínio pode ajudar em tarefas complexas, mas aumenta custo e tempo de resposta. Teste níveis diferentes com o mesmo conjunto de perguntas antes de adotar um valor maior.

Selecionar um cartão ou uma linha altera apenas o rascunho. A barra inferior fica pendente quando o modelo ou o nível de raciocínio mudou:

  1. selecione o modelo;
  2. ajuste o raciocínio, se necessário;
  3. escolha Salvar;
  4. aguarde Modelo salvo!.

Descartar restaura o modelo e o raciocínio gravados. Sair da seção com alterações pendentes aciona a proteção de rascunho. Testar Agente usa a versão salva, não a seleção ainda pendente.

As taxas Entrada e Saída permitem comparar o componente variável do modelo. O débito real de uma mensagem depende do conteúdo enviado, prompt, histórico, conhecimento, anexos, rodadas de ferramentas, raciocínio e tamanho da resposta. No modo de créditos SquadOS, o runtime prefere o custo real informado pelo provedor e aplica a fórmula e o arredondamento da plataforma; portanto, somar apenas as duas taxas da tela não prevê exatamente o débito final.

Com uma chave própria da OpenRouter:

  • a OpenRouter cobra o uso do modelo diretamente na conta vinculada;
  • o SquadOS cobra 1 crédito fixo por mensagem de IA pela orquestração;
  • apenas o proprietário pode conectar, atualizar ou remover a chave.

A chave fica em Configurações → Provedor de IA, não em Modelos de IA. Consulte Configurações da Organização e Plano, Créditos e Cobrança.

Para reduzir consumo, combine um modelo adequado com um prompt enxuto, histórico suficiente sem excesso e limite de resposta coerente. Ajuste histórico e saída em Configurações Avançadas e o tratamento de imagens e arquivos em Multimodal.

Use uma matriz curta e repetível:

VerificaçãoO que observar
Resposta conhecidacorreção, clareza e aderência ao prompt
Informação ausenteadmite a lacuna e segue a regra de fallback
Ferramenta necessáriaescolhe a ferramenta certa, envia argumentos válidos e interpreta o retorno
Ferramenta indisponívelfalha de forma segura, sem inventar execução
Imagem ou arquivorespeita a configuração Multimodal e extrai o conteúdo esperado
Conversa longamantém o contexto necessário sem degradar instruções críticas
Custo e latênciaconsumo e tempo são aceitáveis para o volume esperado

Salve antes do teste, use as mesmas entradas para comparar candidatos e verifique efeitos reais das ferramentas. Um texto fluente, sozinho, não prova que o modelo executou a jornada corretamente.