Modelos
O Modelo de IA é o modelo de linguagem que produz as respostas do agente. A escolha muda a qualidade do texto, a capacidade de usar ferramentas e anexos, a velocidade, o raciocínio e o consumo de créditos.
O catálogo muda com o tempo. Escolha pelo que o agente precisa fazer e valide o resultado em conversas reais; não dependa de uma lista estática de nomes de modelos.
Abrir a seção Modelo de IA
Section titled “Abrir a seção Modelo de IA”Em Agentes, abra o agente e selecione Modelo na navegação do editor. A seção mostra somente modelos de texto ativos que estão disponíveis para o plano atual da organização. Modelos de geração de imagem ficam em outro fluxo.
Se a organização não tiver plano ativo, aparece Nenhum plano ativo. Contate o suporte para liberar modelos. Se o agente já usa um modelo que saiu do catálogo disponível, o slug salvo aparece com o selo Indisponível. O SquadOS preserva essa seleção até você escolher e salvar outra; o selo não troca o modelo automaticamente.
O selo Padrão identifica o modelo padrão do sistema. Um agente criado manualmente começa com esse padrão — não necessariamente com o cartão Melhor custo-benefício.
Entender os atalhos
Section titled “Entender os atalhos”Sem uma busca ativa, até três cartões podem aparecer:
- Mais barato — Para testes;
- Melhor custo-benefício — Recomendado;
- Melhor performance — Máxima capacidade.
Esses rótulos são comparações dentro do catálogo disponível, não garantias de adequação a qualquer tarefa. O SquadOS considera preço, medições públicas de capacidade e o que o agente usa hoje. Um modelo só entra nos cartões se tiver dados suficientes e preservar:
- uso de ferramentas, quando o agente tem ferramentas ativas;
- leitura de imagem, quando essa modalidade está habilitada;
- uma janela de contexto grande o bastante para o prompt atual;
- o nível de uso de ferramentas exigido pela quantidade de ferramentas ativas.
A equipe SquadOS pode fixar um modelo em um dos cartões. Esse modelo ainda precisa estar disponível para a organização e atender aos requisitos do agente; caso contrário, o cartão é calculado com outro candidato. O mesmo modelo não é repetido em mais de um cartão, por isso podem aparecer menos de três.
Recomendado para este agente é uma marca mais específica: aparece quando a análise encontra uma troca compatível para um modelo atual abaixo do nível exigido. Se o modelo atual não tiver medição pública suficiente, o SquadOS não afirma que a troca é melhor.
Usar a lista completa
Section titled “Usar a lista completa”O campo Buscar modelos por nome, provedor ou slug… filtra o catálogo e esconde os cartões enquanto a busca estiver ativa. A lista é ordenada por provedor e nome. Cada linha mostra:
- provedor e nome do modelo;
- o selo Padrão, quando aplicável;
- o nível medido de uso de ferramentas: Básico, Intermediário, Poderoso, Elite ou Desconhecido;
- o preço de saída em cr/1k, isto é, créditos por 1.000 tokens de saída.
Quando existem candidatos dos dois tipos, a lista se divide em Sugeridos e Outros modelos (não sugeridos para esse agente). Abra o segundo grupo para consultar modelos que não preservam alguma capacidade, têm nível insuficiente ou ainda não possuem medição. Uma busca abre os dois grupos; o grupo também abre sozinho quando contém o modelo salvo.
Você ainda pode selecionar um modelo em Outros modelos. Essa escolha não é bloqueada, mas pode fazer o agente perder leitura de imagem, espaço de contexto ou confiabilidade no uso de ferramentas. Reconfigure o agente ou escolha um modelo sugerido antes de salvar.
Ler o painel de detalhes
Section titled “Ler o painel de detalhes”O painel à direita descreve o modelo selecionado:
- nome, provedor e descrição;
- capacidade geral, Inteligência e Ferramentas, quando medidos pela Artificial Analysis;
- Velocidade e Tempo até a 1ª palavra, quando medidos;
- taxas de Entrada e Saída em créditos por 1.000 tokens;
- capacidades declaradas, como Imagem, Arquivos, Thinking e Web Search;
- controle de Reasoning (pensamento estendido), quando o modelo oferece esse recurso.
Desconhecido ou não medido não significa capacidade baixa: significa que não há medição pública suficiente. O painel atual não exibe o slug, a janela de contexto nem a saída máxima. Consulte Configurações → Modelos de IA para esses dados de catálogo.
Se a área Capacidades ficar vazia, não conclua que o modelo não aceita texto nem ferramentas. Modelos cuja modalidade publicada é apenas texto podem cair nesse estado visual. Valide as capacidades no catálogo e no teste do agente.
Configurar o raciocínio
Section titled “Configurar o raciocínio”O controle de raciocínio só aparece para modelos que o suportam. As opções vêm do próprio modelo e podem incluir Padrão, Desligado, Mínimo, Baixo, Médio, Alto, Muito alto ou Máximo.
- Padrão deixa o SquadOS aplicar o nível padrão efetivo.
- Desligado aparece somente quando o provedor permite desligar o raciocínio.
- Em modelos com raciocínio obrigatório, a tela informa Reasoning é obrigatório neste modelo.
- Ao trocar de modelo, um nível incompatível volta automaticamente para Padrão.
Mais raciocínio pode ajudar em tarefas complexas, mas aumenta custo e tempo de resposta. Teste níveis diferentes com o mesmo conjunto de perguntas antes de adotar um valor maior.
Salvar ou descartar a troca
Section titled “Salvar ou descartar a troca”Selecionar um cartão ou uma linha altera apenas o rascunho. A barra inferior fica pendente quando o modelo ou o nível de raciocínio mudou:
- selecione o modelo;
- ajuste o raciocínio, se necessário;
- escolha Salvar;
- aguarde Modelo salvo!.
Descartar restaura o modelo e o raciocínio gravados. Sair da seção com alterações pendentes aciona a proteção de rascunho. Testar Agente usa a versão salva, não a seleção ainda pendente.
Entender créditos e OpenRouter própria
Section titled “Entender créditos e OpenRouter própria”As taxas Entrada e Saída permitem comparar o componente variável do modelo. O débito real de uma mensagem depende do conteúdo enviado, prompt, histórico, conhecimento, anexos, rodadas de ferramentas, raciocínio e tamanho da resposta. No modo de créditos SquadOS, o runtime prefere o custo real informado pelo provedor e aplica a fórmula e o arredondamento da plataforma; portanto, somar apenas as duas taxas da tela não prevê exatamente o débito final.
Com uma chave própria da OpenRouter:
- a OpenRouter cobra o uso do modelo diretamente na conta vinculada;
- o SquadOS cobra 1 crédito fixo por mensagem de IA pela orquestração;
- apenas o proprietário pode conectar, atualizar ou remover a chave.
A chave fica em Configurações → Provedor de IA, não em Modelos de IA. Consulte Configurações da Organização e Plano, Créditos e Cobrança.
Para reduzir consumo, combine um modelo adequado com um prompt enxuto, histórico suficiente sem excesso e limite de resposta coerente. Ajuste histórico e saída em Configurações Avançadas e o tratamento de imagens e arquivos em Multimodal.
Escolher e validar
Section titled “Escolher e validar”Use uma matriz curta e repetível:
| Verificação | O que observar |
|---|---|
| Resposta conhecida | correção, clareza e aderência ao prompt |
| Informação ausente | admite a lacuna e segue a regra de fallback |
| Ferramenta necessária | escolhe a ferramenta certa, envia argumentos válidos e interpreta o retorno |
| Ferramenta indisponível | falha de forma segura, sem inventar execução |
| Imagem ou arquivo | respeita a configuração Multimodal e extrai o conteúdo esperado |
| Conversa longa | mantém o contexto necessário sem degradar instruções críticas |
| Custo e latência | consumo e tempo são aceitáveis para o volume esperado |
Salve antes do teste, use as mesmas entradas para comparar candidatos e verifique efeitos reais das ferramentas. Um texto fluente, sozinho, não prova que o modelo executou a jornada corretamente.