Skip to main content
Die Bring Your Own Key-Einstellung (BYOK) von GitHub Copilot in VS Code akzeptiert „jeden Endpunkt, der mit der OpenAI Chat Completions API kompatibel ist“. Tokios ist einer dieser Endpunkte: Richten Sie Copilot auf https://api.tokios.com/v1 mit einem sk-tok-…-Schlüssel ein, und Copilot Chat sowie der Agentenmodus können Ihr lokales Modell ohne Tunnel aufrufen. BYOK wurde in VS Code im April 2026 allgemein verfügbar (GA). Die Benutzeroberfläche der Copilot-Einstellungen ändert sich mit den Releases, daher bestätigen Sie den genauen Menüpfad und die Feldbezeichnungen anhand Ihrer installierten Version.

Voraussetzungen

  • Ein laufender Tokios Connector, der mit Ihrem lokalen Modell gekoppelt ist — siehe Connector Install
  • Ein registrierter Name für die Modellbereitstellung — siehe Register a Model
  • Ein Tokios API-Schlüssel (sk-tok-…) — siehe API Keys
  • VS Code mit installierten und angemeldeten GitHub Copilot- und Copilot Chat-Erweiterungen
  • Ein Copilot-Plan, der BYOK umfasst. Das GitHub-Changelog für die allgemeine Verfügbarkeit im April 2026 beschreibt BYOK als verfügbar für Business/Enterprise-Pläne, während einige App-Support-Hinweise auch Pro erwähnen — bestätigen Sie, welche Stufen Ihr Konto benötigt, bevor Sie die Fehlersuche bei einer fehlenden Einstellung beginnen.
BYOK gilt nur für Copilot Chat und den Agentenmodus. Es ändert nichts an den Inline-Codevervollständigungen — diese verwenden weiterhin die eigenen Vervollständigungsmodelle von GitHub, unabhängig von jedem von Ihnen hinzugefügten BYOK-Modell.

Copilot auf Tokios ausrichten

1

Öffnen Sie den Modell-Auswahldialog

Führen Sie Chat: Language Models verwalten aus der Befehlspalette aus, oder öffnen Sie Copilot Chat und klicken Sie auf den Modell-Auswahldialog über dem Chat-Eingabefeld, und wählen Sie dann Manage Models…. Die genaue Bezeichnung variiert je nach Copilot Chat-Version, also prüfen Sie Ihre Version.
2

Wählen Sie den OpenAI-kompatiblen Anbieter

Wählen Sie die Option zum Hinzufügen eines benutzerdefinierten OpenAI-kompatiblen Endpunkts (BYOK). Die GitHub-Dokumentation beschreibt dies allgemein als das Hinzufügen „jedes anderen Endpunkts, der mit der OpenAI Chat Completions API kompatibel ist“, neben benannten Anbietern wie Ollama, vLLM und Foundry Local — die genaue Bezeichnung in Ihrer Version kann leicht abweichen.
3

Geben Sie die Basis-URL ein

Legen Sie die Endpunkt-URL fest auf:
4

Fügen Sie Ihre Bereitstellung als Modell hinzu

Geben Sie den öffentlichen Bereitstellungsnamen ein, den Sie auf der Models-Registerkarte registriert haben — zum Beispiel gemma-tunnel. Dies ist der Wert, den Copilot im model-Feld sendet; es handelt sich nicht um die lokale Modell-ID von Ollama, llama.cpp, vLLM oder LM Studio.
5

Fügen Sie Ihren Tokios-API-Schlüssel ein

Fügen Sie Ihren sk-tok-…-Schlüssel in das API-Schlüsselfeld für das benutzerdefinierte Modell ein. Copilot sendet ihn bei jeder Anfrage als Bearer-Token.
Ersetzen Sie gemma-tunnel durch den von Ihnen registrierten Bereitstellungsnamen und sk-tok-YOUR_KEY durch Ihren eigenen Schlüssel. Übertragen Sie niemals eines von beiden in eine gemeinsam genutzte Einstellungsdatei.

Warum dies einen öffentlichen HTTPS-Endpunkt erfordert

Die BYOK-Anfragen von Copilot werden von VS Code aus gegen den von Ihnen konfigurierten Endpunkt gesendet — dieser Endpunkt muss jedoch weiterhin erreichbar sein, überall dort, wo die Client-seitige Erweiterung von Copilot ausgeführt wird, und ein reiner http://localhost:11434 funktioniert nur, wenn VS Code und Ihr Modell auf exakt derselben Maschine laufen. Sobald Sie sich auf einem anderen Laptop, einem Devcontainer oder einem Remote-Arbeitsbereich befinden, zeigt localhost nicht mehr auf Ihr Modell. Der Connector von Tokios ist nur ausgehend, sodass Ihr Modell niemals einen eingehenden Port öffnet, und jede Anfrage trägt einen scoped sk-tok-…-Schlüssel anstelle von gar nichts:
  • Keine unauthentifizierte Exposition — der Connector wählt ausgehend zu Tokios; er hört niemals auf einem Port, und Anfragen benötigen einen gültigen Schlüssel.
  • Stabile URL — https://api.tokios.com/v1 ändert sich nicht zwischen Neustarts, sodass Sie es einmal in Copilot einrichten und es von jeder Maschine aus weiter funktioniert.
  • Umfangsspezifische Schlüssel — ein Schlüssel kann auf bestimmte Deployments beschränkt und im Falle eines Lecks sofort widerrufen werden, ohne Ihr lokales Modell oder den Connector zu berühren.

Fehlerbehebung

Ihr Copilot-Plan enthält möglicherweise kein BYOK. Bestätigen Sie, ob Ihr Konto auf einem Tarif ist, der dies unterstützt (siehe die obige Voraussetzung).
Der von Copilot gesendete API-Schlüssel fehlt, ist fehlerhaft oder wurde widerrufen. Bestätigen Sie, dass Sie den vollständigen sk-tok-…-Schlüssel ohne zusätzliche Leerzeichen eingefügt haben, und prüfen Sie seinen Status auf der Keys-Registerkarte.
Der von Copilot gesendete model-Wert stimmt nicht mit einer registrierten Deployment überein. Stellen Sie sicher, dass der benutzerdefinierte Modellname in Copilot exakt dem öffentlichen Namen auf der Models-Registerkarte entspricht — nicht Ihrer lokalen Ollama/llama.cpp/vLLM/LM Studio-Modell-ID.
Der Connector für dieses Deployment ist offline oder hat sein gleichzeitiges Limit erreicht. Überprüfen Sie die Connectors-Registerkarte — der Connector muss als Online angezeigt werden, und die Maschine, die ihn ausführt, muss weiterhin aktiv und erreichbar sein.
Dies ist beabsichtigt. BYOK betrifft nur Copilot Chat und den Agentenmodus — Inline-Vervollständigungen sind nicht über BYOK konfigurierbar.

Nächste Schritte

Schnellstart

Pairen Sie einen Connector, registrieren Sie ein Modell und erstellen Sie einen API-Schlüssel von Grund auf neu.

Kompatible Clients

Siehe Einrichtung von Basis-URL und Schlüssel für andere OpenAI- und Anthropic-kompatible Clients.