Ein Modell ist die Denkmaschine hinter einem Lauf. Okou kümmert sich um die Werkzeuge, den Kontext und das Verfahren; das Modell denkt. Welches im Spiel ist, beeinflusst Qualität, Geschwindigkeit und den Guthabenverbrauch eines Laufs.
Das Modell hängt am Chat-Thread
Der Modellauswähler sitzt neben dem Chat-Eingabefeld und steuert das Modell für diesen Chat. Die Auswahl wird am Thread gespeichert, nicht am Agenten und nicht am Workflow.
- Ein neuer Chat startet mit Ihrer persönlichen Voreinstellung und fällt auf die Workspace-Voreinstellung zurück, wenn Sie keine gesetzt haben.
- Ein Modellwechsel mitten im Chat gilt für den nächsten Lauf im Thread; ein bereits laufender Lauf endet auf dem Modell, mit dem er begonnen hat.
- Ein Automatisierungs-Chat übernimmt sein Modell bei der ersten Erstellung, und spätere Auslösungen verwenden es weiter.
- In Slack bindet der Befehl /zero model das Modell für den nächsten Thread, den Sie starten — siehe Slack.
Agenten und Workflows haben bewusst keine eigene Modelleinstellung. Der Thread ist die einzige Stelle, an der man nachsieht.
Was verfügbar ist
Der vollständige Katalog — wofür jedes Modell gut ist und was es im Verhältnis zu den anderen kostet — steht auf der Seite Modelle. Er reicht von Frontier-Reasoning-Modellen über günstige Modelle für hohe Volumina bis zu eigenen Bild- und Videomodellen und ändert sich, wenn neue Modelle erscheinen.
Zwei Tarifregeln:
- Free enthält drei Modelle. Sie reichen, um einen Agenten zu bauen, Werkzeuge zu verbinden und echte Arbeit laufen zu lassen.
- Pro, Team und Enterprise öffnen die vollständige Liste.
Workspace-Admins legen unter Einstellungen → Modelle fest, welche dieser Modelle Mitglieder tatsächlich wählen können und welches die Workspace-Voreinstellung ist.
Wo die Inferenz läuft
Ein Modell kann auf mehr als einem Weg geroutet werden, und der Weg wird durch die Workspace-Richtlinie bestimmt, nicht durch den Auswähler:
- Integriert — Okou betreibt das Modell, und es wird gegen das Workspace-Guthaben abgerechnet. Nichts zu verbinden.
- Ihr eigenes Abonnement — jedes Mitglied verbindet sein eigenes Claude- oder Codex-Konto, und seine Läufe gehen darüber.
- Ein geteilter Anbieterschlüssel oder Gateway — ein Admin hinterlegt die Zugangsdaten einmal für den Workspace.
Einen eigenen Anbieter mitzubringen ist eine Funktion der kostenpflichtigen Tarife. Unabhängig vom Weg werden Werkzeugaufrufe, Generierung und Speicher weiterhin gegen Okou-Guthaben abgerechnet.
Der Auswähler wählt ein Modell. Er überschreibt nicht den Weg, den die Richtlinie diesem Modell zugewiesen hat.
Eines auswählen
- Passen Sie das Modell zur Aufgabe, nicht zur Preisliste. Ein günstiges Modell kann auf einem langen agentischen Lauf mehr kosten als ein teures, weil es mehr Schritte bis zum Ziel braucht.
- Nutzen Sie ein günstiges Modell für Volumen. Triage, Klassifizierung und Massen-Vorfilterung brauchen selten ein Frontier-Modell.
- Nutzen Sie ein Frontier-Modell für Urteilsvermögen. Arbeit mit langem Horizont, Code und alles, wo eine falsche Antwort teuer ist.
- Setzen Sie eine persönliche Voreinstellung für das Modell, mit dem die meisten Chats starten sollen, statt den Auswähler jedes Mal zu ändern.
Fehlerbehebung
| Was Sie sehen | Was zu tun ist |
|---|---|
| Ausgewähltes Modell ist nicht verfügbar | Das Modell des Threads ist unter der aktuellen Workspace-Richtlinie oder Anbieterverbindung nicht nutzbar. Wählen Sie ein anderes Modell im Eingabefeld, oder verbinden Sie den Anbieter unter Einstellungen → Modelle neu. |
| Ein erwartetes Modell fehlt | Admins steuern die Verfügbarkeit pro Workspace. In Free erscheinen nur die drei enthaltenen Modelle. |
| Guthaben schwindet schneller als erwartet | Prüfen Sie, auf welchem Modell der Thread läuft. Die Raten unterscheiden sich deutlich zwischen den Stufen. |
Wie geht es weiter
- Siehe Guthaben & Abrechnung, wie sich die Modellwahl auf der Rechnung zeigt.
- Siehe Chat für den Thread, an dem das Modell hängt.