Skip to main content
Die benutzerdefinierten Modellanbieter des Codex CLI erfordern die OpenAI Responses API (wire_api = "responses"), und der integrierte Ollama-Anbieter von Codex erreicht nur localhost — er kann kein Modell auf einer anderen Maschine ansprechen. Tokios bedient /v1/responses und übersetzt es in Chat Completions für Ihr Backend, sodass ein Remote-Server, auf dem Ollama, llama.cpp, vLLM oder LM Studio läuft, als Codex-Anbieter über einen normalen https-Endpunkt funktioniert. Diese Seite setzt voraus, dass Sie Tokios und Codex bereits zusammenarbeiten lassen — siehe Verwenden Sie OpenAI Codex mit Ihren eigenen lokalen Modellen für die vollständige config.toml-Anleitung. Lesen Sie weiter, wenn Ihr Modell auf einer anderen Maschine lebt als die, auf der Codex läuft, oder wenn Sie einen Anbieter troubleshooten, der keine Verbindung herstellt.

Voraussetzungen

Codex konfigurieren

Die Anbieterkonfiguration ist dieselbe, ob das Modell neben Ihnen oder im Netzwerk liegt — Tokios ist es, was die Lage irrelevant macht. In ~/.codex/config.toml:
~/.codex/config.toml
Legen Sie Ihren Schlüssel in der Umgebung fest, bevor Sie Codex ausführen:
Ersetzen Sie gemma-tunnel durch den Namen der Bereitstellung, den Sie für das Remote-Modell registriert haben — nicht durch dessen lokale Upstream-Modell-ID und nicht durch eine localhost-Adresse.

Warum dies funktioniert, wenn localhost nicht funktioniert

Codex’ benutzerdefinierte Provider benötigen wire_api = "responses" — Codex spricht die Responses API mit jedem von Ihnen konfigurierten Provider, und sein integrierter Ollama-Provider ist dokumentiert, um eine localhost-Basis-URL hart zu codieren, sodass er nicht auf ein Modell auf einer anderen Maschine verweisen kann. Damit ein Remote-Modell als Codex-Provider funktioniert, müssen zwei Dinge gleichzeitig zutreffen: Der Endpunkt muss die Responses API beantworten, und er muss eine stabile https-Adresse sein, die Codex von überall aus erreichen kann. Die meisten lokalen Inference-Server — Ollama, llama.cpp, vLLM, LM Studio — sprechen nur Chat Completions, nicht Responses. Das Tokios-Gateway sitzt vor Ihrem Connector, akzeptiert /v1/responses von Codex und übersetzt diese in Chat Completions, bevor sie Ihr Backend erreichen. Ihr Backend muss nie wissen, dass Responses existiert, und Codex benötigt niemals einen localhost-Provider — es spricht mit https://api.tokios.com/v1, unabhängig davon, welche Maschine, welches Netzwerk oder welcher Connector dahinterliegt.
disable_response_storage = true wird zusammen mit wire_api = "responses" benötigt. Tokios stellt die Responses-Oberfläche zustandslos bereit, daher darf Codex sich nicht auf serverseitige Antwortspeicherung zwischen den Zügen verlassen.

Überprüfen Sie, ob es funktioniert

Führen Sie eine schnelle Eingabeaufforderung durch das Profil aus:
Wenn Sie den Endpunkt lieber direkt bestätigen möchten, bevor Sie Codex einbeziehen, überprüfen Sie die Playground für Ihre Bereitstellung oder senden Sie eine rohe Anfrage:

Fehlerbehebung

Codex sendet keinen Schlüssel, den Tokios erkennt. Bestätigen Sie, dass OPENAI_API_KEY auf Ihren sk-tok-…-Schlüssel in derselben Shell eingestellt ist, von der aus Sie codex starten, und dass der Schlüssel auf der Keys-Registerkarte nicht geändert oder deaktiviert wurde.
Der model-Wert in [profiles.tokios] stimmt nicht mit einem registrierten Deployment überein. Er muss der öffentliche Name sein, den Sie auf der Models-Registerkarte gewählt haben (z. B. gemma-tunnel) — und nicht die Upstream-Modell-ID, die Ihr Backend lokal verwendet.
The connector paired with that deployment isn’t currently connected, or it’s at its concurrency cap (connector_unavailable / connector_busy). Check that the connector process is running on the machine next to the model and shows Online on the Connectors tab.
Bestätigen Sie, dass Sie mit --profile tokios starten. Ohne einen Profil-Flag verwendet Codex seinen Standard-Provider, nicht den in [model_providers.tokios].

Nächste Schritte

OpenAI Codex Grundinstallation

Die vollständige config.toml-Anleitung, einschließlich des OpenAI SDK-Pfads.

Schnellstart

Pairen Sie einen Connector und registrieren Sie Ihr erstes Modell von Anfang bis Ende.