https://api.tokios.com/v1, la API Key sur votre clé sk-tok-…, et le Model ID sur le nom de votre déploiement Tokios enregistré — Cline achemine alors chaque requête via votre tunnel privé vers votre modèle local.
Prérequis
- Un connecteur Tokios en cours d’exécution apparié avec votre modèle local — consultez Installation du connecteur
- Un nom de déploiement de modèle enregistré — consultez Enregistrer un modèle
- Une clé API Tokios — consultez Clés API
- L’extension Cline installée dans VS Code (ou un éditeur compatible)
Configurez le fournisseur compatible OpenAI dans Cline
1
Ouvrez les paramètres de Cline
Cliquez sur l’icône d’engrenage dans le panneau Cline pour ouvrir Settings.
2
Sélectionnez le fournisseur compatible OpenAI
Dans la liste déroulante API Provider, choisissez OpenAI Compatible.
3
Définissez l'URL de base
Dans le champ Base URL, saisissez :
4
Définissez la clé API
Dans le champ API Key, collez votre clé Tokios :
5
Définissez l'ID du modèle
Dans le champ Model ID, saisissez le nom de votre déploiement Tokios — le nom public que vous avez enregistré dans l’onglet Models, par exemple
gemma-tunnel. Il ne s’agit pas de l’ID de modèle local/amont utilisé par votre backend.6
Définissez manuellement la fenêtre de contexte et la sortie maximale
Le fournisseur compatible OpenAI ne détecte pas automatiquement les limites du modèle. Renseignez Context Window et Max Output Tokens pour qu’ils correspondent au modèle sous-jacent de votre déploiement afin que Cline dimensionne correctement les requêtes.
Si cela a fonctionné avec curl mais que 400 dans Cline
Si une requêtecurl simple vers https://api.tokios.com/v1/chat/completions aboutit à un succès mais que Cline renvoie un 400, suivez ces étapes dans l’ordre :
L'URL de base correspond à la racine /v1, et non au chemin complet chat/completions
L'URL de base correspond à la racine /v1, et non au chemin complet chat/completions
Cline appends
/chat/completions to whatever you put in Base URL. Enter https://api.tokios.com/v1 — if you paste the full path (https://api.tokios.com/v1/chat/completions), Cline will request a doubled-up path and Tokios returns an error. Tokios serves a stable /v1 OpenAI surface, so the root is unambiguous: it’s always https://api.tokios.com/v1, nothing appended.L'ID du modèle ne correspond pas exactement au nom de votre déploiement
L'ID du modèle ne correspond pas exactement au nom de votre déploiement
Le champ Model ID doit être le nom exact du déploiement public affiché dans l’onglet Models — pas l’ID de modèle amont, ni une variante comportant une faute de frappe. Un nom non conforme se manifeste généralement par un 404, mais des chaînes de modèle malformées (espaces superflus, casse incorrecte dont votre déploiement est strict) peuvent également renvoyer un 400.
Diffusion
Diffusion
Cline demande par défaut des réponses en streaming. Tokios renvoie des événements SSE au format OpenAI standard pour
"stream": true sur /v1/chat/completions, cela devrait donc fonctionner immédiatement. Si un paramètre de requête envoyé par Cline n’est pas pris en charge par votre backend local, ce dernier peut le rejeter sous forme de 400 avant que Tokios n’ait détecté un problème de routage.Corps de requête malformé
Corps de requête malformé
Un 400 indique que Tokios n’a pas pu traiter le corps de la requête lui-même. Si l’URL de base et l’ID du modèle sont corrects, vérifiez la présence d’une option spécifique au fournisseur dans les paramètres avancés de Cline (un champ qu’un backend OpenAI Compatible générique n’attend pas).
Référence d’erreur
Votre modèle, pilotant votre agent, depuis n’importe où
Une fois que Cline est configuré sur Tokios, la même URL de base, clé API et nom de déploiement fonctionnent pour tout autre outil compatible OpenAI que vous exécutez à côté — sans tunnels supplémentaires ni redirection de ports par client.Clients compatibles
Consultez les paramètres d’URL de base et de clé pour chaque autre client pris en charge.
Clés API
Créez, scopez et faites tourner les clés
sk-tok-… pour vos collègues et agents.