APIプロバイダーとモデルサーバーをUnslothに接続
OpenAI、Anthropic、Ollama、llama.cpp、vLLM、その他のプロバイダーのモデルを、単一のローカルUIインターフェースから実行する方法を学びましょう。 Unslothは、LLMの実行と学習のためのオープンソースリポジトリです。ChatGPT/CodexのサブスクリプションをUnslothに直接接続することもできます。
モデルがUnslothの推論機能経由で実行されていても、独自のリモートOpenAI互換エンドポイントで実行されていても、Web検索、コード実行、ディープリサーチなどを含むUnslothの完全なツール群にアクセスさせることができます。
接続すると、コード実行、ツール呼び出し、画像生成、その他の機能を、ローカルモデルとクラウドモデルの両方で使う同じUnslothチャットインターフェース内で実行できます。
Unslothは独自に プロンプトキャッシュ をサポートし(精度を落とさずに多くのトークンを節約できます)、OpenAIの組み込み Web検索 や コード実行.
接続
接続は2つのグループに分かれます。モデルを代わりに実行するホスト済みAPIプロバイダーと、あなたが実行または管理するモデルサーバーです。
クラウドプロバイダー - アカウントのAPIキーを使用するホスト済みAPI:
モデルサーバー - ローカル、ネットワーク上、またはリモートマシン上で実行される推論サーバー:
クイックスタート
外部プロバイダーのモデルを実行するには、APIキーを追加し、Unslothに表示させるモデルを選択します。この例では、 OpenAIを使います。Anthropicや他のプロバイダーでも同じ手順で設定できます。
モデルサーバーに接続
このフローを使用するのは llama.cpp, vLLM、および Ollamaです。接続したいサーバーを起動するか、場所を確認してください。
起動 llama-server で、提供したいモデルを使います:
これにより、以下のAPIエンドポイントが公開されます: http://localhost:8080/v1
APIキーを必須にするには、以下を追加します:
起動 vLLM サーバーで、提供したいモデルを使います:
APIキーを必須にするには、以下を追加します:
これにより、以下のAPIエンドポイントが公開されます: http://localhost:8000/v1
起動 Ollama、その後、使いたいモデルを取得します:
これにより、以下のAPIエンドポイントが公開されます: http://localhost:11434/v1
これでモデルサーバーに接続できます。 設定 → 接続を開いてから、 プロバイダーを追加.
llama.cpp、vLLM、またはOllamaを選択してから、サーバーの ベースURL.
llama.cppの例:
http://localhost:8080/v1Ollamaの例:
http://localhost:11434/v1

クリック モデルを読み込む をクリックして利用可能なモデルIDを取得するか、サーバーが /models.
を公開していない場合は、モデルIDを手動で入力します。 その後、 有効にしたモデルは、 プロバイダーを追加 の モデルを選択 ドロップダウンに表示されます。
外部
コード実行 有効にすると、対応するOpenAIおよびAnthropicのモデルは、プロバイダーのサンドボックス内でコードを実行し、問題の解決、データ分析、ファイル操作ができます。 Anthropicのモデルは、Claudeのプロバイダー側コード実行ツールを使用します。OpenAIは再利用可能なコンテナを使用し、作成、削除、 外部 設定から選択できます。新しいスレッドで同じコンテナを選択すると、そのファイルと状態を引き継いで続行できます。

プロンプトキャッシュ
プロンプトキャッシュは、同じ長いプレフィックスをリクエストで再利用する際の遅延とコストを削減します。OpenAI、Anthropic、llama.cppを含む、互換性のあるプロバイダーとサーバーでサポートされています。サイドパネルの プロンプトキャッシュ 設定を使って、対応する接続のキャッシュ動作を制御します。

llama.cppでは、プロンプトキャッシュはデフォルトで有効になっており、起動時に無効化できます llama-server 以下を使って:
Web検索と推論
プロバイダー側のWeb検索は、OpenAI、Anthropic、OpenRouter、Mistral、Gemini、Kimiの対応モデルで利用できます。Think制御は選択したモデルに応じて動作を変えます。オン/オフ切り替えを使うモデルもあれば、推論努力モデルではモデル固有の思考レベルを使うものもあります。

画像生成
GPTやGeminiと同様に、Unslothも画像生成をサポートしています。「画像を編集」ボタンをクリックして新しいプロンプトを入力すれば、画像を直接編集して、改善または再生成できます。画像は要求時に自動生成されますが、この動作はオフに切り替えることもできます。ダウンロードボタンもあり、元のフル解像度で画像を保存できます。


トラブルシューティング
プロバイダーへの接続に失敗した場合は、APIキーが選択したプロバイダーのものか、そして選択したモデルへのアクセス権があるかを確認してください。
をクリックした後にモデルが表示されない場合は モデルを再読み込み、そのモデルがアカウントで利用できない可能性があります。Unslothのデフォルトモデル一覧を使うか、別のモデルを選ぶことができます。
最終更新
役に立ちましたか?




