モデル は Run の背後にある推論エンジンです。ツール、コンテキスト、手順は Okou が扱い、考えるのはモデルです。どのモデルが使われているかは、品質、速度、そして Run が消費するクレジット量に影響します。
モデルはチャットスレッドに紐づく
モデルピッカーはチャット入力欄の横にあり、そのチャット のモデルを決めます。選択はスレッドに保存され、エージェントやワークフローには保存されません。
- 新しいチャットは個人のデフォルトモデルを使用し、未設定ならワークスペースのデフォルトを使用します。システムのデフォルトはAutoです。
- チャットの途中でモデルを変えると、そのスレッドの 次の Run から適用されます。すでに進行中の Run は、開始時のモデルのまま完了します。
- Automation のチャットは最初に作成された時点のモデルを引き継ぎ、以降の起動でも同じものを使います。
- Slack では /okou model コマンドが、次に 開始するスレッドのモデルを決めます。Slack を参照してください。
エージェントとワークフローには、意図的に独自のモデル設定がありません。見るべき場所はスレッドだけです。
使えるモデル
各モデルの得意分野と相対的なコストは、最新の**モデル**カタログで確認できます。推論モデルと画像モデルを扱い、モデルやプロバイダの経路の提供状況に応じて更新されます。
利用可否は最新のカタログ、プラン、ワークスペースのポリシー、プロバイダの経路によって決まります:
- Freeでは、最新のカタログでFree向けに有効化されている組み込みモデルを使えます。
- 有料プランでは、カタログ、ワークスペースのポリシー、利用可能な接続に応じて、追加のモデルを使えます。
そのうちどのモデルをメンバーが実際に選べるか、どれをワークスペースの既定にするかは、Settings → Models でワークスペース管理者が決めます。
推論がどこで実行されるか
モデルのルーティングには複数の経路があり、経路を決めるのはピッカーではなくワークスペースのポリシーです。
- Built-in — Okou がモデルを実行し、ワークスペースのクレジットから請求されます。接続は不要です。
- 自分のサブスクリプション — 各メンバーが自分の Claude または Codex アカウントを接続し、そのメンバーの Run はそこを通ります。
- 共有のプロバイダーキーまたはゲートウェイ — 管理者がワークスペース用に認証情報を一度設定します。
条件を満たす個人のClaudeまたはCodexサブスクリプションを接続すると、Freeでも有料プランでも利用できます。組織で共有するAPIキーとカスタムゲートウェイには有料プランが必要です。サブスクリプション経由の実行はその契約を使用し、組み込みクレジットへの自動切り替えは行いません。ツール呼び出し、生成、ストレージには引き続きOkouクレジットを使用します。
ピッカーが選ぶのは モデル です。ポリシーがそのモデルに割り当てた ルート を上書きするものではありません。
選び方
- 価格表ではなく、タスクに合わせて選ぶ。 長いエージェント的な Run では、安いモデルのほうが到達までの手数が増え、高いモデルより高くつくことがあります。
- 量をこなすなら安いモデル。 トリアージ、分類、大量の事前フィルタリングにフロンティアモデルが要ることはまれです。
- 判断が要るならフロンティアモデル。 長い見通しが必要な作業、コード、そして誤答の代償が大きいもの全般です。
- メンバー既定値を設定する。 多くのチャットで使いたいモデルを既定にしておけば、毎回ピッカーを変えずに済みます。
トラブルシューティング
| 表示 | 対処 |
|---|---|
| Selected model is not available | 現在のワークスペースポリシーまたはプロバイダー接続では、そのスレッドのモデルを使えません。入力欄で別のモデルを選ぶか、Settings → Models でプロバイダーを接続し直してください。 |
| 使いたいモデルが表示されない | 設定 → モデルで最新のカタログ、プラン、ワークスペースのポリシー、利用可能な経路を確認してください。 |
| クレジットの減りが想定より速い | そのスレッドがどのモデルを使っているか確認してください。階層によって消費レートは大きく異なります。 |

