wire_api = "responses"), und der integrierte Ollama-Anbieter von Codex erreicht nur localhost — er kann kein Modell auf einer anderen Maschine ansprechen. Tokios bedient /v1/responses und übersetzt es in Chat Completions für Ihr Backend, sodass ein Remote-Server, auf dem Ollama, llama.cpp, vLLM oder LM Studio läuft, als Codex-Anbieter über einen normalen https-Endpunkt funktioniert.
Diese Seite setzt voraus, dass Sie Tokios und Codex bereits zusammenarbeiten lassen — siehe Verwenden Sie OpenAI Codex mit Ihren eigenen lokalen Modellen für die vollständige config.toml-Anleitung. Lesen Sie weiter, wenn Ihr Modell auf einer anderen Maschine lebt als die, auf der Codex läuft, oder wenn Sie einen Anbieter troubleshooten, der keine Verbindung herstellt.
Voraussetzungen
- Ein Connector, der neben dem Modell installiert und gepaart ist — auf jener Maschine, nicht auf der, die Codex ausführt
- Ein registrierter Bereitstellungsname für dieses Modell
- Ein Tokios API-Schlüssel (
sk-tok-…) - Codex CLI installed on the machine where you run
codex
Codex konfigurieren
Die Anbieterkonfiguration ist dieselbe, ob das Modell neben Ihnen oder im Netzwerk liegt — Tokios ist es, was die Lage irrelevant macht. In~/.codex/config.toml:
~/.codex/config.toml
gemma-tunnel durch den Namen der Bereitstellung, den Sie für das Remote-Modell registriert haben — nicht durch dessen lokale Upstream-Modell-ID und nicht durch eine localhost-Adresse.
Warum dies funktioniert, wenn localhost nicht funktioniert
Codex’ benutzerdefinierte Provider benötigenwire_api = "responses" — Codex spricht die Responses API mit jedem von Ihnen konfigurierten Provider, und sein integrierter Ollama-Provider ist dokumentiert, um eine localhost-Basis-URL hart zu codieren, sodass er nicht auf ein Modell auf einer anderen Maschine verweisen kann.
Damit ein Remote-Modell als Codex-Provider funktioniert, müssen zwei Dinge gleichzeitig zutreffen: Der Endpunkt muss die Responses API beantworten, und er muss eine stabile https-Adresse sein, die Codex von überall aus erreichen kann. Die meisten lokalen Inference-Server — Ollama, llama.cpp, vLLM, LM Studio — sprechen nur Chat Completions, nicht Responses. Das Tokios-Gateway sitzt vor Ihrem Connector, akzeptiert /v1/responses von Codex und übersetzt diese in Chat Completions, bevor sie Ihr Backend erreichen. Ihr Backend muss nie wissen, dass Responses existiert, und Codex benötigt niemals einen localhost-Provider — es spricht mit https://api.tokios.com/v1, unabhängig davon, welche Maschine, welches Netzwerk oder welcher Connector dahinterliegt.
disable_response_storage = true wird zusammen mit wire_api = "responses" benötigt. Tokios stellt die Responses-Oberfläche zustandslos bereit, daher darf Codex sich nicht auf serverseitige Antwortspeicherung zwischen den Zügen verlassen.Überprüfen Sie, ob es funktioniert
Führen Sie eine schnelle Eingabeaufforderung durch das Profil aus:Fehlerbehebung
401 — fehlender oder ungültiger API-Schlüssel
401 — fehlender oder ungültiger API-Schlüssel
Codex sendet keinen Schlüssel, den Tokios erkennt. Bestätigen Sie, dass
OPENAI_API_KEY auf Ihren sk-tok-…-Schlüssel in derselben Shell eingestellt ist, von der aus Sie codex starten, und dass der Schlüssel auf der Keys-Registerkarte nicht geändert oder deaktiviert wurde.404 — Modell-Deployment nicht gefunden
404 — Modell-Deployment nicht gefunden
Der
model-Wert in [profiles.tokios] stimmt nicht mit einem registrierten Deployment überein. Er muss der öffentliche Name sein, den Sie auf der Models-Registerkarte gewählt haben (z. B. gemma-tunnel) — und nicht die Upstream-Modell-ID, die Ihr Backend lokal verwendet.503 — Connector offline oder ausgelastet
503 — Connector offline oder ausgelastet
The connector paired with that deployment isn’t currently connected, or it’s at its concurrency cap (
connector_unavailable / connector_busy). Check that the connector process is running on the machine next to the model and shows Online on the Connectors tab.Codex fällt auf einen integrierten Provider zurück, anstatt Tokios zu verwenden
Codex fällt auf einen integrierten Provider zurück, anstatt Tokios zu verwenden
Bestätigen Sie, dass Sie mit
--profile tokios starten. Ohne einen Profil-Flag verwendet Codex seinen Standard-Provider, nicht den in [model_providers.tokios].Nächste Schritte
OpenAI Codex Grundinstallation
Die vollständige
config.toml-Anleitung, einschließlich des OpenAI SDK-Pfads.Schnellstart
Pairen Sie einen Connector und registrieren Sie Ihr erstes Modell von Anfang bis Ende.