https://api.tokios.com/v1 并填入 sk-tok-… 类型的 API 令牌,Copilot Chat 与智能代理模式即可直接调用您的本地模型,无需额外搭建隧道。
BYOK 功能于 2026 年四月在 VS Code 中正式发布。由于 Copilot 的设置界面会随版本更新而调整,请务必对照您当前安装的版本确认具体的菜单路径与字段名称。
前置条件
- 已成功运行且与本地模型配对的 Tokios 连接器——详情参见 连接器安装指南
- 已注册的模型部署名称——详情参见 模型注册指南
- 有效的 Tokios API 令牌(
sk-tok-…)——详情参见 API 令牌管理页面 - 已安装 GitHub Copilot 与 Copilot Chat 扩展且完成登录的 VS Code 环境
- 包含 BYOK 权限的 Copilot 订阅套餐。GitHub 在 2026 年四月的版本更新说明中指明该功能适用于商业版与企业版套餐,部分技术支持文档亦提及专业版亦可支持——请在排查设置缺失问题前确认您的账号符合对应权限要求。
将 Copilot 指向 Tokios
1
打开模型选择器
在命令面板中执行 Chat: Manage Language Models,或者进入 Copilot Chat 后点击聊天输入框上方的模型选择器,接着选择 Manage Models…。具体文字表述会因 Copilot Chat 版本而异,请参照您所使用的版本。
2
选择与 OpenAI 兼容的提供商
选取用于添加自定义 OpenAI 兼容端点(BYOK)的选项。GitHub 的文档将其统称为“添加任何符合 OpenAI Chat Completions API 规范的端点”,同时列举了 Ollama、vLLM 以及 Foundry Local 等知名提供商;您所使用的版本中该选项的名称可能略有不同。
3
输入基础 URL
将端点 URL 设置为:
4
把您的部署内容添加为模型
Enter the public deployment name you registered on the Models tab — for example,
gemma-tunnel. This is the value Copilot sends in the model field; it is not Ollama’s, llama.cpp’s, vLLM’s, or LM Studio’s local model id.5
粘贴您的 Tokios API 密钥
将
sk-tok-… 密钥填入自定义模型的 API 密钥字段。Copilot 会在每次请求时将其作为 Bearer 令牌发送。请将
gemma-tunnel 替换为您注册的部署名称,将 sk-tok-YOUR_KEY 替换为您自己的密钥。切勿将二者写入任何共享的配置文件中。为何需要一个公开的 HTTPS 端点
Copilot 的 BYOK 请求由 VS Code 发送至您所配置的端点;不过该端点必须能被任何运行 Copilot 客户端扩展的设备访问才行。若仅使用http://localhost:11434,则仅当 VS Code 与您的模型位于同一台机器上时才可正常工作。一旦您换用其他笔记本电脑、开发容器或远程工作区,localhost 便无法再指向您的模型了。
Tokios 的连接器仅支持出站连接,因此您的模型无需开放任何入站端口;每次请求都会附带一个限定了使用范围的 sk-tok-… 令牌,而非完全无验证机制:
- 杜绝未授权访问 — 该连接器仅向 Tokios 发起连接,不会监听任何端口,且所有请求都必须携带有效的令牌方可通过。
- 稳定的 URL —
https://api.tokios.com/v1的值在重启后也不会改变,您只需在 Copilot 中设置一次即可确保其在任意设备上均能正常使用。 - 限定范围的令牌 — 此类令牌可被限定仅用于特定部署场景;即便发生泄露,也能立即予以撤销,且无需改动本地模型或连接器配置。
故障排查
模型选择界面中未出现 BYOK 选项
模型选择界面中未出现 BYOK 选项
您当前的 Copilot 套餐可能并不包含 BYOK 功能。请确认您的账户所属套餐是否支持此功能(参见上文的前提条件说明)。
401 错误
401 错误
Copilot 发送的 API 密钥缺失、格式有误或已被撤销。请确认您粘贴的
sk-tok-… 令牌内容完整且不含多余空格,随后前往 Keys 页面查看该令牌的当前状态。404 错误
404 错误
Copilot 返回的
model 值与任何已注册的部署均不匹配。请确认 Copilot 中设置的自定义模型名称与 Models 页面上显示的公开名称完全一致,切勿使用 Ollama、llama.cpp、vLLM 或 LM Studio 中的本地模型 ID。503 错误
503 错误
对应部署所使用的连接器处于离线状态,或者已达到并发处理上限。请查看 Connectors 页面,确保连接器状态显示为 Online,同时运行该连接器的机器也处于正常运行且可访问状态。
内联补全功能仍会使用 GitHub 提供的模型
内联补全功能仍会使用 GitHub 提供的模型
这属于正常情况。BYOK 仅对 Copilot Chat 及智能代理模式生效,内联补全功能无法通过 BYOK 进行配置。
后续操作指引
快速入门
配对连接器、注册模型并全新创建 API 密钥。
兼容的客户端
可查阅其他兼容 OpenAI 与 Anthropic 协议的客户端的基础 URL 及密钥配置方法。