Um modelo é o motor de raciocínio por trás de uma execução. O Okou cuida das ferramentas, do contexto e do procedimento; o modelo pensa. Qual deles está em jogo afeta a qualidade, a velocidade e quantos créditos uma execução consome.
O modelo fica no thread do chat
O seletor de modelo fica ao lado do campo de mensagem e controla o modelo daquele chat. A escolha é guardada no thread, não no agente nem no fluxo de trabalho.
- Um chat novo parte do seu padrão de membro, e recorre ao padrão do espaço de trabalho quando você não definiu nenhum.
- Trocar de modelo no meio do chat vale para a próxima execução do thread; uma execução já em andamento termina com o modelo com que começou.
- Um chat de automação recebe seu modelo quando é criado pela primeira vez, e os disparos seguintes reaproveitam esse modelo.
- No Slack, o comando /zero model fixa o modelo para o próximo thread que você iniciar — veja Slack.
Agentes e fluxos de trabalho não têm, de propósito, uma configuração de modelo própria. O thread é o único lugar onde olhar.
O que está disponível
O catálogo completo, com no que cada modelo é bom e quanto custa em relação aos outros, está na página Modelos. Ele cobre modelos de raciocínio de fronteira, modelos baratos para alto volume e modelos dedicados de imagem e vídeo, e muda conforme novos modelos são lançados.
Duas regras de plano:
- Free inclui três modelos. Bastam para construir um agente, conectar ferramentas e rodar trabalho de verdade.
- Pro, Team e Enterprise abrem a lista completa.
Os administradores do espaço de trabalho escolhem quais desses modelos os membros podem de fato selecionar, e qual é o modelo padrão, em Configurações → Modelos.
Onde a inferência roda
Um modelo pode ser roteado de mais de uma forma, e a rota é definida pela política do espaço de trabalho, não pelo seletor:
- Integrado — a Okou roda o modelo e a cobrança sai dos créditos do espaço de trabalho. Não há nada a conectar.
- Sua própria assinatura — cada membro conecta a própria conta Claude ou Codex e suas execuções passam por ela.
- Uma chave de provedor compartilhada ou um gateway — um administrador fornece a credencial uma vez para o espaço de trabalho.
Trazer o próprio provedor é um recurso dos planos pagos. Seja qual for a rota, chamadas de ferramentas, geração e armazenamento continuam sendo cobrados em créditos Okou.
O seletor escolhe um modelo. Ele não substitui a rota que a política atribuiu a esse modelo.
Como escolher um
- Ajuste o modelo à tarefa, não à tabela de preços. Numa execução agêntica longa, um modelo barato pode custar mais que um caro, porque precisa de mais passos para chegar lá.
- Use um modelo barato para volume. Triagem, classificação e pré-filtragem em massa raramente precisam de um modelo de fronteira.
- Use um modelo de fronteira para julgamento. Trabalho de horizonte longo, código e tudo em que uma resposta errada sai cara.
- Defina um padrão de membro para o modelo com que você quer que a maioria dos chats comece, em vez de mudar o seletor toda vez.
Solução de problemas
| O que você vê | O que fazer |
|---|---|
| O modelo selecionado não está disponível | O modelo do thread não é utilizável sob a política atual do espaço de trabalho ou com a conexão do provedor. Escolha outro modelo no campo de mensagem, ou reconecte o provedor em Configurações → Modelos. |
| Falta um modelo que você esperava | Os administradores controlam a disponibilidade por espaço de trabalho. No Free, só aparecem os três modelos incluídos. |
| Os créditos caem mais rápido que o esperado | Verifique em que modelo o thread está. As taxas variam bastante entre os níveis. |
O que vem a seguir
- Veja Créditos e faturamento para como a escolha de modelo aparece na conta.
- Veja Chat para o thread ao qual o modelo está preso.