Skip to main content
Codex CLI의 사용자 지정 모델 제공자는 OpenAI Responses API(wire_api = "responses")를 필요로 하며, Codex에 내장된 Ollama 제공자는 localhost에만 도달할 수 있습니다. 즉, 다른 머신의 모델을 대상으로 할 수 없습니다. Tokios는 /v1/responses를 제공하고 백엔드용 Chat Completions로 변환하므로, Ollama, llama.cpp, vLLM 또는 LM Studio를 실행하는 원격 머신이 일반 https 엔드포인트를 통해 Codex 제공자로 작동합니다. 이 페이지는 이미 Tokios와 Codex가 함께 작동하고 있다고 가정합니다 — OpenAI Codex를 자체 로컬 모델과 함께 사용하기에서 전체 config.toml 연습을 참조하세요. 모델이 Codex를 실행하는 머신과 다른 머신에 있거나, 연결되지 않는 제공업체를 문제 해결하는 경우 계속 읽으세요.

전제 조건

  • 모델 옆에 설치되고 페어링된 커넥터 — 그 머신이 어느 머신이든, Codex를 실행하는 머신이 아니라.
  • A registered deployment name for that model
  • Tokios API 키 (sk-tok-…)
  • Codex CLI installed on the machine where you run codex

Codex 구성

공급자 구성은 모델이 바로 옆에 있든 네트워크 너머에 있든 동일합니다. Tokios가 위치를 무관하게 만드는 것입니다. ~/.codex/config.toml에서의 설정은 다음과 같습니다.
~/.codex/config.toml
Codex를 실행하기 전에 환경에 키를 설정하세요.
원격 모델에 대해 등록한 배포 이름으로 gemma-tunnel를 바꾸십시오. 로컬 업스트림 모델 ID도 아니고 localhost 주소도 아닙니다.

localhost에서는 작동하지 않는데 이것이 작동하는 이유

Codex의 사용자 지정 제공자에는 wire_api = "responses"가 필요합니다 — Codex는 구성한 모든 제공자에 Responses API를 사용하며, 기본 제공되는 Ollama 제공자는 localhost 기본 URL을 하드코딩하도록 문서화되어 있어 다른 머신의 모델을 가리킬 수 없습니다. 원격 모델이 Codex 공급자로 작동하려면 두 가지가 동시에 충족되어야 합니다. 엔드포인트가 Responses API에 응답해야 하고, Codex가 실행되는 어디에서든 도달할 수 있는 안정적인 https 주소여야 합니다. 대부분의 로컬 추론 서버(Ollama, llama.cpp, vLLM, LM Studio)는 Chat Completions만 지원하며 Responses는 지원하지 않습니다. Tokios 게이트웨이는 커넥터 앞에 위치하여 Codex로부터 /v1/responses를 받아 백엔드에 도달하기 전에 Chat Completions로 변환합니다. 백엔드는 Responses가 존재한다는 사실을 알 필요가 없으며, Codex도 localhost 공급자가 필요하지 않습니다. 뒤에 어떤 머신, 네트워크 또는 커넥터가 있든 Codex는 https://api.tokios.com/v1와 통신합니다.
disable_response_storage = true는 wire_api = "responses"와 함께 필요합니다. Tokios는 Responses surface를 상태 비저장 방식으로 제공하므로, Codex는 턴 사이에 서버 측 응답 저장에 의존해서는 안 됩니다.

작동하는지 확인하세요

프로필을 통해 빠른 프롬프트를 실행하세요.
Codex를 사용하기 전에 엔드포인트를 직접 확인하려면 Playground를 배포에서 확인하거나 원시 요청을 보내십시오.

문제 해결

Codex가 Tokios가 인식하는 키를 보내지 않습니다. OPENAI_API_KEY이(가) sk-tok-… 키로 설정되어 있는지, codex를 실행하는 동일한 셸에서인지, 그리고 해당 키가 Keys 탭에서 교체 또는 비활성화되지 않았는지 확인하세요.
The model value in [profiles.tokios] doesn’t match a registered deployment. It must be the public name you chose on the Models tab (for example, gemma-tunnel) — not the upstream model id your backend uses locally.
해당 배포와 연결된 커넥터가 현재 연결되어 있지 않거나 동시성 제한에 도달했습니다 (connector_unavailable / connector_busy). 커넥터 프로세스가 모델 옆의 머신에서 실행 중이고 Online을 Connectors 탭에 표시하는지 확인하세요.
Confirm you’re launching with --profile tokios. Without a profile flag, Codex uses its default provider, not the one in [model_providers.tokios].

다음 단계

OpenAI Codex 기본 설정

전체 config.toml 워크스루이며, OpenAI SDK 경로를 포함합니다.

빠른 시작

커넥터를 페어링하고 첫 번째 모델을 엔드 투 엔드로 등록하세요.