~/.codex/config.toml, pointez-le vers https://api.tokios.com/v1, et Codex s’exécute contre votre propre modèle local — sur Ollama, LM Studio ou n’importe quel backend compatible OpenAI — depuis n’importe où, via votre tunnel privé.
Prérequis
- Un connecteur Tokios en cours d’exécution apparié avec votre modèle local — voir Installation du connecteur
- Un nom de déploiement de modèle enregistré — voir Enregistrer un modèle
- Une clé API Tokios — voir Clés API
- OpenAI Codex installé
Configurer Codex
Définissez votre clé Tokios dans l’environnement, puis ajoutez un fournisseur et un profil Tokios à~/.codex/config.toml :
~/.codex/config.toml
wire_api = "responses" et disable_response_storage = true sont tous deux requis. Tokios fournit la surface Responses de manière stateless, donc Codex ne doit pas s’appuyer sur le stockage de réponses côté serveur.gemma-tunnel par le nom public du modèle que vous avez enregistré dans la console.
En utilisant le SDK Python d’OpenAI
Pour appeler votre modèle local de manière programmatique avec le SDK OpenAI, pointez le client vers l’URL de base Tokios :openai_tokios.py
L’URL de base du SDK OpenAI doit se terminer par
/v1. Le point de terminaison Tokios est https://api.tokios.com/v1.