localhost ou sur votre réseau local privé — elles nécessitent une URL HTTPS publique. Tokios vous en fournit une à https://api.tokios.com/v1 : associez le connecteur à côté de votre modèle, enregistrez un nom de déploiement, et fournissez à Cursor cette URL avec une clé sk-tok-…. Pas de tunnel ngrok à maintenir ouvert, pas de port non authentifié.
Prérequis
- Un connecteur Tokios en cours d’exécution et associé à votre modèle local — voir Installation du connecteur
- Un nom de déploiement de modèle enregistré — voir Enregistrer un modèle
- Une clé API Tokios (
sk-tok-…) — voir Clés API - Cursor installé
Pourquoi Cursor ne peut pas simplement utiliser localhost
Les requêtes de modèle de Cursor sont effectuées depuis le backend de Cursor, et non depuis le processus de l’éditeur de code sur votre ordinateur portable. Ce backend n’a pas de route vers127.0.0.1 ou vers une machine sur votre réseau domestique ou professionnel — il ne peut appeler qu’une URL accessible sur Internet public via HTTPS. C’est pourquoi pointer Cursor vers une simple http://localhost:11434 ou une IP LAN ne fonctionne pas, et pourquoi toute configuration fonctionnelle, y compris Tokios, doit placer une URL HTTPS publique devant votre modèle local.
Pointez Cursor vers Tokios
1
Ouvrir les paramètres de modèle de Cursor
Ouvrez les paramètres avec Cmd+, (macOS) ou Ctrl+, (Windows/Linux), puis choisissez Models dans la barre latérale. Les libellés des champs varient selon les versions de Cursor, donc vérifiez les vôtres si les noms ci-dessous ne correspondent pas.
2
Remplacer l'URL de base
Définissez Override OpenAI Base URL sur :Conservez le suffixe
/v1 — l’application Cursor ajoute /chat/completions à tout ce que vous saisissez ici.3
Ajoutez votre déploiement en tant que modèle personnalisé
Ajoutez un modèle personnalisé en utilisant le nom de déploiement public que vous avez enregistré dans l’onglet Models — par exemple,
gemma-tunnel. Il s’agit de la valeur que Cursor envoie dans le champ model ; ce n’est pas l’ID de modèle local d’Ollama, llama.cpp, vLLM ou LM Studio.4
Collez votre clé API Tokios
Collez votre clé
sk-tok-… dans le champ de clé API de Cursor pour le modèle personnalisé. Cursor l’envoie en tant que jeton Bearer à chaque requête.Remplacez
gemma-tunnel par le nom de déploiement que vous avez enregistré, et sk-tok-YOUR_KEY par votre propre clé. Ne validez jamais l’un ou l’autre dans un fichier de configuration partagé.Pourquoi cela bat un tunnel ngrok
L’architecture cloud-only de Cursor est exactement la raison pour laquelle la solution de contournement courante consiste enngrok http 11434 plus OLLAMA_HOST=0.0.0.0 (ou OLLAMA_ORIGINS=*) afin de rendre Ollama accessible. Cette combinaison fonctionne, mais elle laisse votre modèle en écoute sans authentification derrière une URL qui change à chaque redémarrage du tunnel — quiconque trouve cette URL pendant qu’elle est active peut appeler votre modèle.
Le connecteur de Tokios est uniquement sortant, donc votre modèle n’ouvre jamais de port entrant, et chaque requête qui lui est adressée porte une clé sk-tok-… à périmètre défini au lieu de rien du tout :
- Aucune exposition non authentifiée — le connecteur se connecte à Tokios ; il n’écoute jamais sur un port, et les requêtes nécessitent une clé valide.
- URL stable —
https://api.tokios.com/v1ne change pas entre les redémarrages, donc vous la configurez une seule fois dans Cursor. - Clés à périmètre défini — une clé peut être limitée à des déploiements spécifiques et révoquée instantanément en cas de fuite, sans toucher à votre modèle local ou au connecteur.
Dépannage
401 erreur
401 erreur
La clé API envoyée par Cursor est manquante, mal formée ou a été révoquée. Confirmez que vous avez collé la clé
sk-tok-… complète sans espaces superflus, et vérifiez son statut sur l’onglet Keys.404 erreur
404 erreur
La valeur
model envoyée par Cursor ne correspond pas à un déploiement enregistré. Confirmez que le nom du modèle personnalisé dans Cursor correspond exactement au nom public sur l’onglet Models — pas à votre ID de modèle amont local Ollama/llama.cpp/vLLM/LM Studio.503 erreur
503 erreur
Le connecteur pour ce déploiement est hors ligne ou atteint sa limite de concurrence. Vérifiez l’onglet Connectors — le connecteur doit afficher le statut Online, et la machine qui l’exécute doit être toujours allumée et accessible.
Étapes suivantes
Clients compatibles
Consultez la configuration de l’URL de base et de la clé pour les autres clients compatibles OpenAI et Anthropic.
Clés API
Créez, scopez et faites tourner les clés
sk-tok-… pour les collègues et les agents.