https://api.tokios.com/v1 avec une clé sk-tok-… et Copilot Chat ainsi que le mode agent peuvent appeler votre modèle local sans tunnel.
BYOK est passé en version générale (GA) dans VS Code en avril 2026. L’interface utilisateur des paramètres de Copilot évolue selon les versions, donc confirmez le chemin exact du menu et les libellés des champs par rapport à votre version installée.
Prérequis
- Un connecteur Tokios en cours d’exécution apparié avec votre modèle local — voir Installation du connecteur
- Un nom de déploiement de modèle enregistré — voir Enregistrer un modèle
- Une clé API Tokios (
sk-tok-…) — voir Clés API - VS Code avec les extensions GitHub Copilot et Copilot Chat installées et connectées
- Un plan Copilot incluant BYOK. Le journal des modifications de GitHub pour la version GA d’avril 2026 décrit BYOK comme disponible sur les plans Business/Enterprise, tandis que certaines notes de support applicatif mentionnent également Pro — confirmez les niveaux dont votre compte a besoin avant de résoudre un paramètre manquant.
Pointez Copilot vers Tokios
1
Ouvrez le sélecteur de modèles
Exécutez Chat: Gérer les modèles de langage depuis la palette de commandes, ou ouvrez Copilot Chat et cliquez sur le sélecteur de modèles au-dessus de la zone de saisie du chat, puis sélectionnez Manage Models…. La formulation exacte varie selon la version de Copilot Chat, donc vérifiez la vôtre.
2
Choisissez le fournisseur compatible OpenAI
Sélectionnez l’option pour ajouter un point de terminaison personnalisé compatible OpenAI (BYOK). La documentation de GitHub décrit cela de manière générique comme l’ajout de « n’importe quel autre point de terminaison compatible avec l’API OpenAI Chat Completions », aux côtés de fournisseurs nommés comme Ollama, vLLM et Foundry Local — l’étiquette exacte dans votre version peut légèrement différer.
3
Entrez l'URL de base
Définissez l’URL du point de terminaison sur :
4
Ajoutez votre déploiement comme modèle
Entrez le nom de déploiement public que vous avez enregistré sur l’onglet Models — par exemple,
gemma-tunnel. Il s’agit de la valeur que Copilot envoie dans le champ model ; ce n’est pas l’ID de modèle local d’Ollama, llama.cpp, vLLM ou LM Studio.5
Collez votre clé API Tokios
Collez votre clé
sk-tok-… dans le champ de clé API pour le modèle personnalisé. Copilot l’envoie en tant que jeton Bearer à chaque requête.Remplacez
gemma-tunnel par le nom de déploiement que vous avez enregistré, et sk-tok-YOUR_KEY par votre propre clé. Ne commitez jamais l’un ou l’autre dans un fichier de paramètres partagé.Pourquoi cela nécessite un point de terminaison HTTPS public
Les requêtes BYOK de Copilot sont effectuées depuis VS Code contre le point de terminaison que vous configurez — mais ce point de terminaison doit toujours être accessible depuis l’endroit où l’extension côté client de Copilot s’exécute, et un simplehttp://localhost:11434 ne fonctionne que si VS Code et votre modèle se trouvent sur la même machine. Dès que vous utilisez un autre ordinateur portable, un devcontainer ou un espace de travail distant, localhost ne pointe plus vers votre modèle.
Le connecteur de Tokios est uniquement sortant, donc votre modèle n’ouvre jamais de port entrant, et chaque requête transporte une clé sk-tok-… à portée limitée plutôt qu’aucune clé du tout :
- Aucune exposition non authentifiée — le connecteur se connecte à Tokios ; il n’écoute jamais sur un port, et les requêtes nécessitent une clé valide.
- URL stable —
https://api.tokios.com/v1ne change pas entre les redémarrages, donc vous le configurez une seule fois dans Copilot et il continue de fonctionner depuis n’importe quelle machine. - Clés à portée limitée — une clé peut être restreinte à des déploiements spécifiques et révoquée instantanément en cas de fuite, sans toucher à votre modèle local ou au connecteur.
Dépannage
L'option BYOK est absente du sélecteur de modèle
L'option BYOK est absente du sélecteur de modèle
Votre plan Copilot peut ne pas inclure BYOK. Confirmez si votre compte est sur un niveau qui le prend en charge (voir la note sur les prérequis ci-dessus).
401 erreur
401 erreur
La clé API que Copilot a envoyée est manquante, mal formée ou a été révoquée. Confirmez que vous avez collé la clé
sk-tok-… complète sans espaces superflus, et vérifiez son statut sur l’onglet Keys.404 erreur
404 erreur
La valeur
model envoyée par Copilot ne correspond pas à un déploiement enregistré. Confirmez que le nom du modèle personnalisé dans Copilot correspond exactement au nom public sur l’onglet Models — et non à votre ID de modèle local Ollama/llama.cpp/vLLM/LM Studio.503 erreur
503 erreur
Le connecteur pour ce déploiement est hors ligne ou a atteint sa limite de concurrence. Vérifiez l’onglet Connectors — le connecteur doit afficher Online, et la machine qui l’exécute doit être toujours active et accessible.
Les complétions en ligne utilisent toujours les modèles de GitHub
Les complétions en ligne utilisent toujours les modèles de GitHub
C’est attendu. BYOK affecte uniquement Copilot Chat et le mode agent — les complétions en ligne ne sont pas configurables via BYOK.
Prochaines étapes
Démarrage rapide
Appairez un connecteur, enregistrez un modèle et créez une clé API à partir de zéro.
Clients compatibles
Consultez la configuration de l’URL de base et de la clé pour les autres clients compatibles OpenAI et Anthropic.