Um modelo é o motor de raciocínio por trás de uma execução. O Okou cuida das ferramentas, do contexto e do procedimento; o modelo faz o pensamento. Qual deles está em jogo afeta qualidade, velocidade e quantos créditos uma execução consome.
O modelo mora na thread de chat
O seletor de modelo fica ao lado do campo de chat e controla o modelo daquele chat. A escolha é salva na thread, não no agente e não no workflow.
- Uma nova conversa usa seu modelo padrão pessoal; se ele não estiver definido, usa o padrão do workspace. O padrão do sistema é Auto.
- Trocar o modelo no meio do chat vale para a próxima execução da thread; uma execução já em andamento termina com o modelo com que começou.
- Um chat de automation fixa seu modelo quando é criado, e os disparos seguintes reutilizam esse modelo.
- No Slack, o comando /okou model vincula o modelo para a próxima thread que você abrir — veja Slack.
Agentes e workflows não têm, de propósito, configuração de modelo própria. A thread é o único lugar para olhar.
O que está disponível
O catálogo atual, com os pontos fortes e o custo relativo de cada modelo, está em Modelos. Ele inclui modelos de raciocínio e imagem e muda conforme os modelos e as rotas de provedor disponíveis.
A disponibilidade depende do catálogo atual, do plano, das políticas do workspace e da rota do provedor:
- Free permite usar os modelos integrados habilitados para Free no catálogo atual.
- Os planos pagos dão acesso a mais modelos conforme o catálogo, as políticas do workspace e as conexões disponíveis.
Os administradores escolhem em Settings → Models quais desses modelos os membros podem de fato selecionar e qual é o padrão do espaço de trabalho.
Onde a inferência roda
Um modelo pode ser roteado de mais de um jeito, e a rota é definida pela política do espaço de trabalho, não pelo seletor:
- Built-in — o Okou roda o modelo e isso é cobrado nos créditos do espaço de trabalho. Nada para conectar.
- Sua própria assinatura — cada membro conecta a própria conta Claude ou Codex e as execuções dele passam por ali.
- Uma chave de provedor compartilhada ou um gateway — um administrador fornece a credencial uma vez para o espaço de trabalho.
Uma assinatura pessoal elegível e conectada do Claude ou Codex pode ser usada no Free e nos planos pagos. Chaves de API compartilhadas da organização e gateways personalizados exigem um plano pago. Uma execução via assinatura usa essa assinatura, sem recorrer aos créditos integrados como alternativa. Ferramentas, geração e armazenamento continuam consumindo créditos Okou.
O seletor escolhe um modelo. Ele não substitui a rota que a política atribuiu a esse modelo.
Como escolher
- Case o modelo com a tarefa, não com a tabela de preços. Um modelo barato numa execução agêntica longa pode custar mais que um caro, porque precisa de mais passos para chegar lá.
- Use um modelo barato para volume. Triagem, classificação e pré-filtragem em massa raramente precisam de um modelo de fronteira.
- Use um modelo de fronteira para julgamento. Trabalho de horizonte longo, código e tudo em que uma resposta errada sai cara.
- Defina um padrão de membro para o modelo com que você quer que a maioria dos chats comece, em vez de mexer no seletor toda vez.
Solução de problemas
| O que você vê | O que fazer |
|---|---|
| Selected model is not available | O modelo da thread não é utilizável sob a política atual do espaço de trabalho ou a conexão de provedor. Escolha outro modelo no campo de chat, ou reconecte o provedor em Settings → Models. |
| Um modelo esperado não aparece | Confira o catálogo, seu plano, as políticas do workspace e a rota disponível em Configurações → Modelos. |
| Créditos caindo mais rápido que o esperado | Veja em qual modelo a thread está. As taxas diferem bastante entre os níveis. |
O que vem a seguir
- Veja Créditos e faturamento para como a escolha do modelo aparece na conta.
- Veja Chat para a thread à qual o modelo está preso.

