https://api.tokios.com/v1 mit einem sk-tok-…-Schlüssel ein, und Copilot Chat sowie der Agentenmodus können Ihr lokales Modell ohne Tunnel aufrufen.
BYOK wurde in VS Code im April 2026 allgemein verfügbar (GA). Die Benutzeroberfläche der Copilot-Einstellungen ändert sich mit den Releases, daher bestätigen Sie den genauen Menüpfad und die Feldbezeichnungen anhand Ihrer installierten Version.
Voraussetzungen
- Ein laufender Tokios Connector, der mit Ihrem lokalen Modell gekoppelt ist — siehe Connector Install
- Ein registrierter Name für die Modellbereitstellung — siehe Register a Model
- Ein Tokios API-Schlüssel (
sk-tok-…) — siehe API Keys - VS Code mit installierten und angemeldeten GitHub Copilot- und Copilot Chat-Erweiterungen
- Ein Copilot-Plan, der BYOK umfasst. Das GitHub-Changelog für die allgemeine Verfügbarkeit im April 2026 beschreibt BYOK als verfügbar für Business/Enterprise-Pläne, während einige App-Support-Hinweise auch Pro erwähnen — bestätigen Sie, welche Stufen Ihr Konto benötigt, bevor Sie die Fehlersuche bei einer fehlenden Einstellung beginnen.
Copilot auf Tokios ausrichten
1
Öffnen Sie den Modell-Auswahldialog
Führen Sie Chat: Language Models verwalten aus der Befehlspalette aus, oder öffnen Sie Copilot Chat und klicken Sie auf den Modell-Auswahldialog über dem Chat-Eingabefeld, und wählen Sie dann Manage Models…. Die genaue Bezeichnung variiert je nach Copilot Chat-Version, also prüfen Sie Ihre Version.
2
Wählen Sie den OpenAI-kompatiblen Anbieter
Wählen Sie die Option zum Hinzufügen eines benutzerdefinierten OpenAI-kompatiblen Endpunkts (BYOK). Die GitHub-Dokumentation beschreibt dies allgemein als das Hinzufügen „jedes anderen Endpunkts, der mit der OpenAI Chat Completions API kompatibel ist“, neben benannten Anbietern wie Ollama, vLLM und Foundry Local — die genaue Bezeichnung in Ihrer Version kann leicht abweichen.
3
Geben Sie die Basis-URL ein
Legen Sie die Endpunkt-URL fest auf:
4
Fügen Sie Ihre Bereitstellung als Modell hinzu
Geben Sie den öffentlichen Bereitstellungsnamen ein, den Sie auf der Models-Registerkarte registriert haben — zum Beispiel
gemma-tunnel. Dies ist der Wert, den Copilot im model-Feld sendet; es handelt sich nicht um die lokale Modell-ID von Ollama, llama.cpp, vLLM oder LM Studio.5
Fügen Sie Ihren Tokios-API-Schlüssel ein
Fügen Sie Ihren
sk-tok-…-Schlüssel in das API-Schlüsselfeld für das benutzerdefinierte Modell ein. Copilot sendet ihn bei jeder Anfrage als Bearer-Token.Ersetzen Sie
gemma-tunnel durch den von Ihnen registrierten Bereitstellungsnamen und sk-tok-YOUR_KEY durch Ihren eigenen Schlüssel. Übertragen Sie niemals eines von beiden in eine gemeinsam genutzte Einstellungsdatei.Warum dies einen öffentlichen HTTPS-Endpunkt erfordert
Die BYOK-Anfragen von Copilot werden von VS Code aus gegen den von Ihnen konfigurierten Endpunkt gesendet — dieser Endpunkt muss jedoch weiterhin erreichbar sein, überall dort, wo die Client-seitige Erweiterung von Copilot ausgeführt wird, und ein reinerhttp://localhost:11434 funktioniert nur, wenn VS Code und Ihr Modell auf exakt derselben Maschine laufen. Sobald Sie sich auf einem anderen Laptop, einem Devcontainer oder einem Remote-Arbeitsbereich befinden, zeigt localhost nicht mehr auf Ihr Modell.
Der Connector von Tokios ist nur ausgehend, sodass Ihr Modell niemals einen eingehenden Port öffnet, und jede Anfrage trägt einen scoped sk-tok-…-Schlüssel anstelle von gar nichts:
- Keine unauthentifizierte Exposition — der Connector wählt ausgehend zu Tokios; er hört niemals auf einem Port, und Anfragen benötigen einen gültigen Schlüssel.
- Stabile URL —
https://api.tokios.com/v1ändert sich nicht zwischen Neustarts, sodass Sie es einmal in Copilot einrichten und es von jeder Maschine aus weiter funktioniert. - Umfangsspezifische Schlüssel — ein Schlüssel kann auf bestimmte Deployments beschränkt und im Falle eines Lecks sofort widerrufen werden, ohne Ihr lokales Modell oder den Connector zu berühren.
Fehlerbehebung
BYOK-Option fehlt im Modell-Auswahlfeld
BYOK-Option fehlt im Modell-Auswahlfeld
Ihr Copilot-Plan enthält möglicherweise kein BYOK. Bestätigen Sie, ob Ihr Konto auf einem Tarif ist, der dies unterstützt (siehe die obige Voraussetzung).
401-Fehler
401-Fehler
Der von Copilot gesendete API-Schlüssel fehlt, ist fehlerhaft oder wurde widerrufen. Bestätigen Sie, dass Sie den vollständigen
sk-tok-…-Schlüssel ohne zusätzliche Leerzeichen eingefügt haben, und prüfen Sie seinen Status auf der Keys-Registerkarte.404-Fehler
404-Fehler
Der von Copilot gesendete
model-Wert stimmt nicht mit einer registrierten Deployment überein. Stellen Sie sicher, dass der benutzerdefinierte Modellname in Copilot exakt dem öffentlichen Namen auf der Models-Registerkarte entspricht — nicht Ihrer lokalen Ollama/llama.cpp/vLLM/LM Studio-Modell-ID.503-Fehler
503-Fehler
Der Connector für dieses Deployment ist offline oder hat sein gleichzeitiges Limit erreicht. Überprüfen Sie die Connectors-Registerkarte — der Connector muss als Online angezeigt werden, und die Maschine, die ihn ausführt, muss weiterhin aktiv und erreichbar sein.
Inline-Vervollständigungen verwenden weiterhin die Modelle von GitHub
Inline-Vervollständigungen verwenden weiterhin die Modelle von GitHub
Dies ist beabsichtigt. BYOK betrifft nur Copilot Chat und den Agentenmodus — Inline-Vervollständigungen sind nicht über BYOK konfigurierbar.
Nächste Schritte
Schnellstart
Pairen Sie einen Connector, registrieren Sie ein Modell und erstellen Sie einen API-Schlüssel von Grund auf neu.
Kompatible Clients
Siehe Einrichtung von Basis-URL und Schlüssel für andere OpenAI- und Anthropic-kompatible Clients.