Skip to main content
Die Completion- und Agent-Funktionen von Cursor laufen über Cursor’s Cloud, nicht auf Ihrem Rechner, sodass sie kein Modell auf localhost oder Ihrem privaten LAN erreichen können — sie benötigen einen öffentlichen HTTPS-Endpunkt. Tokios stellt Ihnen einen unter https://api.tokios.com/v1 bereit: Paaren Sie den Connector neben Ihrem Modell, registrieren Sie einen Deployment-Namen und übergeben Sie Cursor diese URL mit einem sk-tok-…-Schlüssel. Kein ngrok-Tunnel, der offen gehalten werden muss, kein unauthentifizierter Port.

Voraussetzungen

  • Ein laufender Tokios-Connector, der mit Ihrem lokalen Modell gepaart ist — siehe Connector Install
  • Ein registrierter Modell-Deployment-Name — siehe Register a Model
  • Ein Tokios API-Schlüssel (sk-tok-…) — siehe API Keys
  • Cursor installiert

Warum Cursor nicht einfach localhost verwenden kann

Die Modell-Anfragen von Cursor werden vom Cursor-Backend ausgeführt, nicht vom Code-Editor-Prozess auf Ihrem Laptop. Dieses Backend hat keine Route zu 127.0.0.1 oder zu einem Rechner in Ihrem Heim- oder Büronetzwerk — es kann nur einen Endpunkt aufrufen, der über HTTPS im öffentlichen Internet erreichbar ist. Deshalb funktioniert das Pointieren von Cursor auf ein bloßes http://localhost:11434 oder eine LAN-IP nicht, und warum jede funktionierende Einrichtung — einschließlich Tokios — eine öffentliche HTTPS-URL vor Ihr lokales Modell stellen muss.

Cursor auf Tokios richten

1

Öffnen Sie die Modelleinstellungen von Cursor

Öffnen Sie die Einstellungen mit Cmd+, (macOS) oder Ctrl+, (Windows/Linux) und wählen Sie dann Models in der Seitenleiste. Die Feldbezeichnungen variieren je nach Cursor-Version, also prüfen Sie Ihre Version, falls die unten genannten Namen nicht übereinstimmen.
2

Überschreiben Sie die Basis-URL

Legen Sie Override OpenAI Base URL fest auf:
Behalten Sie das /v1-Suffix bei — Cursor hängt /chat/completions an alles an, was Sie hier eingeben.
3

Fügen Sie Ihre Deployment als benutzerdefiniertes Modell hinzu

Fügen Sie ein benutzerdefiniertes Modell hinzu, indem Sie den öffentlichen Deployment-Namen verwenden, den Sie im Models-Tab registriert haben — zum Beispiel gemma-tunnel. Dies ist der Wert, den Cursor im model-Feld sendet; es handelt sich nicht um die lokale Modell-ID von Ollama, llama.cpp, vLLM oder LM Studio.
4

Fügen Sie Ihren Tokios API-Schlüssel ein

Fügen Sie Ihren sk-tok-…-Schlüssel in das API-Schlüsselfeld von Cursor für das benutzerdefinierte Modell ein. Cursor sendet ihn bei jeder Anfrage als Bearer-Token.
Ersetzen Sie gemma-tunnel durch den von Ihnen registrierten Deployment-Namen und sk-tok-YOUR_KEY durch Ihren eigenen Schlüssel. Übertragen Sie niemals eines von beiden in eine gemeinsam genutzte Konfigurationsdatei.
Die Überschreibung gilt für Cursors Chat- und Agenten-Panel (Cmd/Ctrl+L). Die Tab-Autovervollständigung und die Inline-Bearbeitung laufen weiterhin auf Cursors eigenen Modellen, unabhängig von dieser Einstellung, sodass diese 2-Funktionen Ihr lokales Modell niemals erreichen.

Warum dies einem ngrok-Tunnel überlegen ist

Die Cloud-nur-Architektur von Cursor ist genau der Grund, warum die gängige Workaround-Lösung ngrok http 11434 plus OLLAMA_HOST=0.0.0.0 (oder OLLAMA_ORIGINS=*) ist, um Ollama überhaupt erreichbar zu machen. Diese Kombination funktioniert, lässt Ihr Modell jedoch ohne Authentifizierung hinter einer URL lauschen, die bei jedem Neustart des Tunnels wechselt — jeder, der diese URL findet, während sie aktiv ist, kann Ihr Modell aufrufen. Der Connector von Tokios ist nur ausgehend, sodass Ihr Modell niemals einen eingehenden Port öffnet, und jede Anfrage daran trägt einen scoped sk-tok-…-Schlüssel statt gar nichts:
  • Keine unauthentifizierte Exposition — der Connector wählt ausgehend zu Tokios; er hört niemals auf einem Port, und Anfragen benötigen einen gültigen Schlüssel.
  • Stabile URL — https://api.tokios.com/v1 ändert sich nicht zwischen Neustarts, sodass Sie es einmal in Cursor konfigurieren.
  • Gescopedte Schlüssel — ein Schlüssel kann auf bestimmte Deployments beschränkt und bei einem Leak sofort widerrufen werden, ohne Ihr lokales Modell oder den Connector zu berühren.

Fehlerbehebung

Der von Cursor gesendete API-Schlüssel fehlt, ist fehlerhaft oder wurde widerrufen. Bestätigen Sie, dass Sie den vollständigen sk-tok-…-Schlüssel ohne zusätzliche Leerzeichen eingefügt haben, und prüfen Sie seinen Status auf der Keys-Registerkarte.
Der von Cursor gesendete model-Wert stimmt mit keinem registrierten Deployment überein. Bestätigen Sie, dass der benutzerdefinierte Modellname in Cursor exakt mit dem öffentlichen Namen auf der Models-Registerkarte übereinstimmt — nicht mit Ihrer lokalen Ollama/llama.cpp/vLLM/LM Studio-Modell-ID.
Der Connector für dieses Deployment ist offline oder hat seinConcurrency-Limit erreicht. Prüfen Sie die Connectors-Registerkarte — der Connector muss als Online angezeigt werden, und die Maschine, die ihn ausführt, muss weiterhin hoch und erreichbar sein.

Nächste Schritte

Kompatible Clients

Siehe Konfiguration der Basis-URL und des Schlüssels für andere OpenAI- und Anthropic-kompatible Clients.

API-Schlüssel

Erstellen, einengen und rotieren Sie sk-tok-…-Schlüssel für Teammitglieder und Agenten.