Voltar para a documentaçãoConceitos principais

Modelos

Escolher o motor de raciocínio de uma execução: o seletor de modelo por thread, os limites do plano e o roteamento de provedores.

Última atualização em 5 de outubro de 2026 · 4 min read

Um modelo é o motor de raciocínio por trás de uma execução. O Okou cuida das ferramentas, do contexto e do procedimento; o modelo faz o pensamento. Qual deles está em jogo afeta qualidade, velocidade e quantos créditos uma execução consome.

O modelo mora na thread de chat

O seletor de modelo fica ao lado do campo de chat e controla o modelo daquele chat. A escolha é salva na thread, não no agente e não no workflow.

  • Uma nova conversa usa seu modelo padrão pessoal; se ele não estiver definido, usa o padrão do workspace. O padrão do sistema é Auto.
  • Trocar o modelo no meio do chat vale para a próxima execução da thread; uma execução já em andamento termina com o modelo com que começou.
  • Um chat de automation fixa seu modelo quando é criado, e os disparos seguintes reutilizam esse modelo.
  • No Slack, o comando /okou model vincula o modelo para a próxima thread que você abrir — veja Slack.

Agentes e workflows não têm, de propósito, configuração de modelo própria. A thread é o único lugar para olhar.

O que está disponível

O catálogo atual, com os pontos fortes e o custo relativo de cada modelo, está em Modelos. Ele inclui modelos de raciocínio e imagem e muda conforme os modelos e as rotas de provedor disponíveis.

A disponibilidade depende do catálogo atual, do plano, das políticas do workspace e da rota do provedor:

  • Free permite usar os modelos integrados habilitados para Free no catálogo atual.
  • Os planos pagos dão acesso a mais modelos conforme o catálogo, as políticas do workspace e as conexões disponíveis.

Os administradores escolhem em Settings → Models quais desses modelos os membros podem de fato selecionar e qual é o padrão do espaço de trabalho.

Onde a inferência roda

Um modelo pode ser roteado de mais de um jeito, e a rota é definida pela política do espaço de trabalho, não pelo seletor:

  • Built-in — o Okou roda o modelo e isso é cobrado nos créditos do espaço de trabalho. Nada para conectar.
  • Sua própria assinatura — cada membro conecta a própria conta Claude ou Codex e as execuções dele passam por ali.
  • Uma chave de provedor compartilhada ou um gateway — um administrador fornece a credencial uma vez para o espaço de trabalho.

Uma assinatura pessoal elegível e conectada do Claude ou Codex pode ser usada no Free e nos planos pagos. Chaves de API compartilhadas da organização e gateways personalizados exigem um plano pago. Uma execução via assinatura usa essa assinatura, sem recorrer aos créditos integrados como alternativa. Ferramentas, geração e armazenamento continuam consumindo créditos Okou.

O seletor escolhe um modelo. Ele não substitui a rota que a política atribuiu a esse modelo.

Como escolher

  • Case o modelo com a tarefa, não com a tabela de preços. Um modelo barato numa execução agêntica longa pode custar mais que um caro, porque precisa de mais passos para chegar lá.
  • Use um modelo barato para volume. Triagem, classificação e pré-filtragem em massa raramente precisam de um modelo de fronteira.
  • Use um modelo de fronteira para julgamento. Trabalho de horizonte longo, código e tudo em que uma resposta errada sai cara.
  • Defina um padrão de membro para o modelo com que você quer que a maioria dos chats comece, em vez de mexer no seletor toda vez.

Solução de problemas

O que você vêO que fazer
Selected model is not availableO modelo da thread não é utilizável sob a política atual do espaço de trabalho ou a conexão de provedor. Escolha outro modelo no campo de chat, ou reconecte o provedor em Settings → Models.
Um modelo esperado não apareceConfira o catálogo, seu plano, as políticas do workspace e a rota disponível em Configurações → Modelos.
Créditos caindo mais rápido que o esperadoVeja em qual modelo a thread está. As taxas diferem bastante entre os níveis.

O que vem a seguir