provider, model, and apiBase. Point that apiBase at https://api.tokios.com/v1 with an sk-tok-… key and your Tokios deployment name as the model, and Continue reaches your local model over one authenticated endpoint — no open port on your LAN required.
前提条件
- A running Tokios connector paired with your local model — see Connector Install
- A registered model deployment name — see Register a Model
- A Tokios API key (
sk-tok-…) — see API Keys - ご使用のエディターにContinueがインストール済みであること
Continueの設定方法
1
Continue用の設定ファイルを開く
Continueはホームディレクトリ内にあるYAML形式の設定ファイルを読み込む:ディレクトリ名は
.continue となっており、先頭にドットが付いています。古いバージョンのContinueでは config.json が使用されていました。もし現在その名前のディレクトリをお使いの場合は、YAML形式へ移行するか、あるいは下記のブロックをご使用のバージョンで求められるJSONスキーマ形式へ変換する必要があります。2
OpenAI互換モデルのブロックを追加する
OpenAI互換な
provider を使ってモデルエントリを追加し、apiBase にはTokiosのエンドポイントを指定し、model にはご自身の パブリックなデプロイ名 を設定します。例えば gemma-tunnel のように記述します。model には Models タブで登録したデプロイ名を記入します。これはOllamaやllama.cpp、vLLM、LM Studioで使用するローカルモデルのIDとは異なります。ご使用のContinueバージョンで求められる設定スキーマに基づき、provider、apiBase、apiKey といったキー名を正確に確認してください。3
チャット・編集・オートコンプリート機能で同一モデルを利用させる
Continueではチャット・編集・オートコンプリートといった各機能に別々のモデルを割り当てることが可能です。ローカルモデルを各機能で利用させたい場合は、同じ
Tokios モデルブロックをそれぞれの機能ごとに指定します。そうすればすべての機能が同一のTokiosエンドポイントを呼び出すことになります。正確な役割割り当ての構文については、ご使用のContinueバージョンの設定スキーマをご確認ください。Replace
gemma-tunnel with the deployment name you registered, and sk-tok-YOUR_KEY with your own key. Never commit either into a shared or checked-in config file.Don’t bind Ollama to 0.0.0.0
別マシン上で稼働するOllamaインスタンスに接続するための標準的な方法は、Ollamaを実行するマシンでOLLAMA_HOST=0.0.0.0 を設定し、 apiBase にそのマシンのLAN IPアドレス(例えば http://192.168.1.50:11434 など)を指定することです。これによりOllamaはすべてのネットワークインターフェースで待ち受けるようになりますが、Ollamaには認証機能が備わっていません。そのためネットワーク上からポートにアクセス可能な者は誰でもモデル一覧の取得や推論実行が可能になってしまいます。
Ollamaは 127.0.0.1 のままにして、その隣でTokiosコネクターを実行させるべきです。コネクターは https://api.tokios.com へ接続しますが、Ollama側では受信用ポートが開かれません。またOllamaへ送信されるすべてのリクエストには有効な sk-tok-… キーが必須となります。
- 認証なしでの外部公開は厳禁 — LANやマシンのポートに直接アクセスできる状態にしてはいけません。
- どのネットワークからでも同一の
apiBaseを利用可能 — Continueが同一LAN内にあっても別の建物内にあっても、https://api.tokios.com/v1は問題なく機能します。 - スコープ指定可能かつ取り消し可能なキー — Keysタブから漏洩したキーを無効化でき、Ollamaやコネクター側には影響を与えません。
トラブルシューティング
401エラー
401エラー
送信されたAPIキーが存在しない、形式が不正である、または既に無効化されている可能性があります。設定内容を確認し、
apiKey欄に余分な空白を含まず完全な sk-tok-… キーが記載されていることを確かめ、さらに Keysタブでその状態を確認してください。403エラー
403エラー
キー自体は存在するものの、
modelで指定したデプロイに対してスコープが適用されていないか、アカウントが一時停止中である可能性があります。Keysタブで該当キーのモデルパターンを確認してください。404エラー
404エラー
設定内容の
model値が登録済みのデプロイ名と一致していません。Modelsタブに記載されている公開名と完全に同一であることを確認してください。Ollama/llama.cpp/vLLM/LM Studio上のローカルモデルIDではありません。503エラー
503エラー
該当デプロイ用のコネクターがオフライン状態、または同時接続数の上限に達しています。Connectorsタブを確認し、コネクターの状態が Onlineとなっていること、およびそのコネクターを実行中のマシンが正常に稼働し通信可能であることを確かめてください。
次に行うべき手順
Ollamaのリモートアクセス
Ollamaを
0.0.0.0に結び付けたり、ポートフォワーディングやトンネルを利用したりすることに対する反対意見の全容、ならびに送信専用の代替手段について確認してください。互換性のあるクライアント
その他のOpenAIやAnthropicと互換性のあるクライアント向けのベースURLやAPIキーの設定方法についてご覧ください。