Skip to main content
Cline communique avec Tokios via son fournisseur OpenAI Compatible. Définissez le Base URL du fournisseur sur https://api.tokios.com/v1, la API Key sur votre clé sk-tok-…, et le Model ID sur le nom de votre déploiement Tokios enregistré — Cline achemine alors chaque requête via votre tunnel privé vers votre modèle local.

Prérequis

  • Un connecteur Tokios en cours d’exécution apparié avec votre modèle local — consultez Installation du connecteur
  • Un nom de déploiement de modèle enregistré — consultez Enregistrer un modèle
  • Une clé API Tokios — consultez Clés API
  • L’extension Cline installée dans VS Code (ou un éditeur compatible)

Configurez le fournisseur compatible OpenAI dans Cline

1

Ouvrez les paramètres de Cline

Cliquez sur l’icône d’engrenage dans le panneau Cline pour ouvrir Settings.
2

Sélectionnez le fournisseur compatible OpenAI

Dans la liste déroulante API Provider, choisissez OpenAI Compatible.
3

Définissez l'URL de base

Dans le champ Base URL, saisissez :
4

Définissez la clé API

Dans le champ API Key, collez votre clé Tokios :
5

Définissez l'ID du modèle

Dans le champ Model ID, saisissez le nom de votre déploiement Tokios — le nom public que vous avez enregistré dans l’onglet Models, par exemple gemma-tunnel. Il ne s’agit pas de l’ID de modèle local/amont utilisé par votre backend.
6

Définissez manuellement la fenêtre de contexte et la sortie maximale

Le fournisseur compatible OpenAI ne détecte pas automatiquement les limites du modèle. Renseignez Context Window et Max Output Tokens pour qu’ils correspondent au modèle sous-jacent de votre déploiement afin que Cline dimensionne correctement les requêtes.
Le champ Model ID est toujours votre nom de déploiement enregistré, et non l’ID de modèle amont servi par Ollama, llama.cpp, vLLM ou LM Studio. Consultez Enregistrer un modèle.

Si cela a fonctionné avec curl mais que 400 dans Cline

Si une requête curl simple vers https://api.tokios.com/v1/chat/completions aboutit à un succès mais que Cline renvoie un 400, suivez ces étapes dans l’ordre :
Cline appends /chat/completions to whatever you put in Base URL. Enter https://api.tokios.com/v1 — if you paste the full path (https://api.tokios.com/v1/chat/completions), Cline will request a doubled-up path and Tokios returns an error. Tokios serves a stable /v1 OpenAI surface, so the root is unambiguous: it’s always https://api.tokios.com/v1, nothing appended.
Le champ Model ID doit être le nom exact du déploiement public affiché dans l’onglet Models — pas l’ID de modèle amont, ni une variante comportant une faute de frappe. Un nom non conforme se manifeste généralement par un 404, mais des chaînes de modèle malformées (espaces superflus, casse incorrecte dont votre déploiement est strict) peuvent également renvoyer un 400.
Cline demande par défaut des réponses en streaming. Tokios renvoie des événements SSE au format OpenAI standard pour "stream": true sur /v1/chat/completions, cela devrait donc fonctionner immédiatement. Si un paramètre de requête envoyé par Cline n’est pas pris en charge par votre backend local, ce dernier peut le rejeter sous forme de 400 avant que Tokios n’ait détecté un problème de routage.
Un 400 indique que Tokios n’a pas pu traiter le corps de la requête lui-même. Si l’URL de base et l’ID du modèle sont corrects, vérifiez la présence d’une option spécifique au fournisseur dans les paramètres avancés de Cline (un champ qu’un backend OpenAI Compatible générique n’attend pas).

Référence d’erreur

Votre modèle, pilotant votre agent, depuis n’importe où

Une fois que Cline est configuré sur Tokios, la même URL de base, clé API et nom de déploiement fonctionnent pour tout autre outil compatible OpenAI que vous exécutez à côté — sans tunnels supplémentaires ni redirection de ports par client.

Clients compatibles

Consultez les paramètres d’URL de base et de clé pour chaque autre client pris en charge.

Clés API

Créez, scopez et faites tourner les clés sk-tok-… pour vos collègues et agents.