Skip to main content
Continue는 YAML 구성 파일에서 모델 설정을 읽습니다. 각 모델 블록은 provider, model, apiBase를 설정합니다. apiBase를 https://api.tokios.com/v1에 sk-tok-… 키와 함께 지정하고 Tokios 배포 이름을 model로 사용하면 Continue는 하나의 인증된 엔드포인트를 통해 로컬 모델에 도달합니다. LAN에 개방 포트가 필요하지 않습니다.

사전 요구 사항

  • A running Tokios connector paired with your local model — see Connector Install
  • A registered model deployment name — see Register a Model
  • A Tokios API key (sk-tok-…) — see API Keys
  • 편집기에 Continue가 설치되어 있어야 합니다.

Continue 구성

1

Continue의 구성 파일 열기

Continue는 홈 디렉터리에서 YAML 구성을 읽습니다.
디렉터리는 .continue이며, 앞에 점이 있습니다. 이전 Continue 릴리스에서는 config.json를 대신 사용했습니다. 해당하는 경우, YAML로 마이그레이션하거나 아래 블록을 버전이 기대하는 JSON 스키마로 변환하세요.
2

OpenAI 호환 모델 블록 추가

OpenAI 호환 provider를 사용하여 모델 항목을 추가하고, apiBase는 Tokios를 가리키고, model는 사용자의 public deployment name 으로 설정합니다. 예를 들어, gemma-tunnel로 지정합니다.
model는 Models 탭에서 등록한 배포 이름이며 Ollama, llama.cpp, vLLM, LM Studio 로컬 모델 ID가 아닙니다. 설치된 Continue 버전의 구성 스키마와 비교하여 정확한 YAML 키 이름(provider, apiBase, apiKey)을 확인하세요.
3

채팅, 편집, 자동 완성을 같은 모델로 지정하세요.

Continue를 사용하면 서로 다른 모델에 채팅, 편집, 자동 완성 등 서로 다른 역할을 할당할 수 있습니다. 로컬 모델이 처리할 각 역할에 대해 동일한 Tokios 모델 블록을 참조하면 모든 역할이 동일한 Tokios 엔드포인트를 호출합니다. 설치된 Continue 버전의 구성 스키마에서 정확한 역할 할당 구문을 확인하십시오.
등록한 배포 이름으로 gemma-tunnel를 바꾸고, 자신의 키로 sk-tok-YOUR_KEY를 바꾸세요. 둘 중 어느 것도 공유되거나 체크인된 구성 파일에 커밋하지 마세요.

Don’t bind Ollama to 0.0.0.0

Continue의 문서화된 방식으로 다른 머신의 Ollama 인스턴스에 도달하려면 Ollama가 실행 중인 머신에서 OLLAMA_HOST=0.0.0.0를 설정하고 apiBase를 해당 머신의 원시 LAN IP(예를 들어 http://192.168.1.50:11434)로 지정하는 것입니다. 그렇게 하면 Ollama가 모든 네트워크 인터페이스에서 수신 대기하게 되며, Ollama에는 기본 제공 인증이 없으므로 네트워크에서 해당 포트에 도달할 수 있는 모든 것이 자격 증명 없이 모델을 나열하고 추론을 실행할 수 있습니다. Ollama를 127.0.0.1에 유지하고 대신 그 옆에서 Tokios 커넥터를 실행하세요. 커넥터는 https://api.tokios.com로 외부 연결을 시도하며, Ollama는 인바운드 포트를 열지 않습니다. 따라서 모든 요청에는 유효한 sk-tok-… 키가 필요합니다.
  • 인증되지 않은 노출 없음 — 아무것도 LAN이나 머신의 포트에 직접 도달할 필요가 없습니다.
  • 동일한 apiBase를 어느 네트워크에서든 — https://api.tokios.com/v1는 Continue가 같은 LAN에 있든 완전히 다른 건물에 있든 작동합니다.
  • 범위 지정 가능하고 취소 가능한 키 — Keys 탭에서 유출된 키를 차단하되 Ollama나 커넥터는 건드리지 마세요.

문제 해결

Continue가 보낸 API 키가 누락되었거나 형식이 잘못되었거나 취소되었습니다. 구성의 apiKey에 전체 sk-tok-… 키가 추가 공백 없이 포함되어 있는지 확인하고, Keys 탭에서 상태를 확인하세요.
키는 존재하지만 model에서 참조한 배포에 범위가 지정되어 있지 않거나 계정이 정지되었습니다. Keys 탭에서 키의 모델 패턴을 확인하세요.
구성의 model 값이 등록된 배포와 일치하지 않습니다. Models 탭의 공개 이름과 정확히 일치하는지 확인하세요. Ollama/llama.cpp/vLLM/LM Studio 로컬 모델 ID가 아닙니다.
해당 배포의 커넥터가 오프라인 상태이거나 동시성 한도에 도달했습니다. Connectors 탭을 확인하세요 — 커넥터가 Online로 표시되어야 하며, 이를 실행하는 머신이 계속 켜져 있고 연결 가능해야 합니다.

다음 단계

Ollama 원격 액세스

Ollama를 0.0.0.0에 바인딩하는 것, 포트 포워딩, 그리고 터널에 반대하는 전체 사례와 아웃바운드 전용 대안을 확인하세요.

호환 클라이언트

다른 OpenAI 및 Anthropic 호환 클라이언트의 기본 URL 및 키 설정을 확인하세요.