For the complete documentation index, see llms.txt. This page is also available as Markdown.

Unsloth Startを使ってローカルLLMでコーディングエージェントを実行

Unsloth を使うと接続できます Claude Code, Codex、Hermes、OpenCode、Pi、およびその他のコーディングエージェントをローカルモデルへ接続するために、 unsloth start コマンド。ワークフロー全体を自分のハードウェア上でオフライン実行できます。 Unsloth 起動ごとにエンドポイント、API キー、プロバイダ、モデル、コンテキスト長を自動的に設定するため、変更せずにお好みのエージェントを使用できます。このガイドでは、オフライン利用のためにコマンドラインからモデルを起動し、Unsloth に接続する方法を説明します。

クイックスタート

まず、次があることを確認してください Unsloth がインストールされている。次に Unsloth を開き、モデルを読み込み、プロジェクトフォルダに移動して、ターミナルで次のコマンドを実行します:

unsloth start claude

以下を置き換えることができます claude を、次の任意のエージェントに:

Qwen3.5 をローカルで使用して動作する Claude Code。
エージェント
コマンド

Claude Code

unsloth start claude

OpenAI Codex

unsloth start codex

Hermes エージェント

unsloth start hermes

OpenClaw

unsloth start openclaw

OpenCode

unsloth start opencode

Unsloth は一時的な、またはセッション単位のプロバイダ設定を使用します。エージェントの通常の設定ファイルに Unsloth プロバイダを追加しません。

Codex は現在、次を介して配信される GGUF モデルを必要とします llama-server バックエンド。

エージェントガイド

コマンドラインからモデルを読み込む

unsloth start launching Codex with a local GGUF model in Unsloth Studio
Unsloth start はモデルを見つけるか読み込み、コーディングエージェントを設定して、現在のプロジェクトから起動します。

エージェントを起動しながら、モデルを選択して読み込めます:

この :UD-Q4_K_XL サフィックスは GGUF の量子化設定を選択します。

明示的な --gguf-variant は、モデル名の後に書かれた量子化設定を上書きします。

デフォルトのローカルアドレスでは、 --model を渡すと unsloth start Unsloth Studio がまだ実行されていない場合に、一時的なサーバーを起動できます。一時的なサーバーはエージェント終了時に停止します。Unsloth がすでに実行中の場合、コマンドはそこに接続し、そのまま実行を継続します。

ローカル LLM に接続されたエージェントの例を以下で確認してください:

OpenCode
Hermes
Claude Code
Codex
OpenClaw

リモートの Unsloth サーバーに接続する

エージェントを起動する前に、Unsloth の URL と API キーを設定します:

キーは次でも渡せます --api-key。検証済みのローカル Unsloth サーバーの場合、 unsloth start API キーを自動的に作成するか再利用します。

オプション

オプション
機能

--model, -m

モデルを選択します。指定しない場合は、Unsloth が報告する最初のモデルを使用します。

--api-key

Unsloth API キーを指定します。次も設定できます UNSLOTH_API_KEY.

--launch / --no-launch

エージェントを起動するか、生成された環境とコマンドを表示します。

--serve / --no-serve

ローカルサーバーの自動起動を許可または禁止します。

--gguf-variant

GGUF の量子化バリアントを選択します。

--context-length, --max-seq-length

モデルの読み込み時に要求されるコンテキスト長を設定します。

--load-in-4bit / --no-load-in-4bit

Hugging Face の非 GGUF モデルに対する 4 ビット読み込みを制御します。

--tensor-parallel / --no-tensor-parallel

マルチ GPU システム向けの tensor-parallel GGUF 読み込みを有効または無効にします。

--persist / --no-persist

該当する場合は、Unsloth が管理するエージェントのホームを維持します。

--yolo

選択したエージェントの非プロンプトモードまたは信頼モードを使用します。

-h, --help

コマンドのヘルプを表示します。

Load オプションは、Unsloth が要求されたモデルを読み込むか整合させる必要があるときに使用されます。

通常のコマンドをエージェントに渡す

Unsloth のオプションではない引数は、選択したエージェントに渡されます:

ネイティブのオプション一覧は、エージェント自身のヘルプコマンドを使用してください。

セッションと --persist

--persist 管理されたストレージを保持します。会話を自動では再開しません。エージェントの通常の再開コマンドも渡してください。

エージェント

必要ですか --persist?

再開の例

Claude Code

いいえ。Claude は通常のセッションストアを使用します。

unsloth start claude --continue

OpenAI Codex

はい。管理される Codex のホームは既定で一時的です。

unsloth start codex --persist resume --last

OpenClaw

はい。管理される設定、ワークスペース、セッションは既定で一時的です。

次を使用: --persist 同じネイティブのセッション ID で。

OpenCode

いいえ。OpenCode は通常のセッションストアを使用します。

unsloth start opencode run --continue "Continue"

Hermes エージェント

はい。管理される Hermes のホームは既定で一時的です。

unsloth start hermes --persist --continue --oneshot "Continue"

Pi コーディングエージェント

はい。管理される Pi のホームは既定で一時的です。

unsloth start pi --persist --continue

Codex、OpenClaw、Hermes、Pi では、 --persist 最初の起動時と、セッションに戻るときに再度使用してください。

名前付きセッションには安定したセッション ID を使用します:

実行せずに起動コマンドを表示する

生成された環境とコマンドを表示します。出力には接続認証情報が含まれる場合があるため、ログやスクリーンショットで公開しないでください。

権限バイパスモード

--yolo 選択したエージェントの trust モードまたは non-prompting モードに対応します。承認プロンプトを減らし、事前確認なしでエージェントにコマンドを実行させることができます。

よくある問題

Unsloth サーバーが見つかりませんでした

Unsloth を起動してモデルを読み込むか、`--model` を渡して Unsloth が一時的なローカルサーバーを起動できるようにしてください。

Codex が接続しません

`llama-server` で実行されている GGUF モデルを使用してください。現在の Codex 連携では Unsloth の transformers バックエンドは使用しません。

セッションが復元されませんでした

Codex、OpenClaw、Hermes、Pi では、最初と以後の起動で `--persist` を使用し、その後エージェントのネイティブな再開オプションを渡してください。

最終更新

役に立ちましたか?