Unsloth Start を使ってローカル LLM でコーディングエージェントを実行する
Unsloth では接続できます Claude Code, Codex、Hermes、OpenCode、その他のコーディングエージェントを、以下を介してローカルモデルに接続できます unsloth start コマンド。ワークフロー全体を、自身のハードウェア上でオフライン実行できます。 Unsloth は、起動ごとにエンドポイント、API キー、プロバイダー、モデル、コンテキスト長を自動設定するため、変更を加えずに好みのエージェントを使用できます。このガイドでは、オフラインで使用するモデルをコマンドラインから起動し、Unsloth に接続する方法を説明します。
クイックスタート
まず、以下があることを確認してください Unsloth がインストール済み。次に Unsloth を開き、モデルをロードし、プロジェクトフォルダーに移動して、ターミナルで次のコマンドを実行します。
unsloth start claude次のものを置き換えられます claude を、以下の任意のエージェントに置き換えられます:

Claude Code
unsloth start claude
OpenAI Codex
unsloth start codex
DeepSeek Harness
unsloth start dsh
OpenCode
unsloth start opencode
Hermes Agent
unsloth start hermes
OpenClaw
unsloth start openclaw
Pi Agent
unsloth start pi
Unsloth は一時的またはセッションスコープのプロバイダー設定を使用します。エージェントの通常の設定ファイルに Unsloth プロバイダーを追加することはありません。
エージェントガイド
コマンドラインからモデルをロードする

エージェントの起動中にモデルを選択してロードできます:
設定・サンプリングフラグが指定されていない場合、Unsloth はコンテキスト長、温度などを含む、モデルに最適な推奨設定を自動的に選択します。
この :UD-Q4_K_XL サフィックスは GGUF 量子化を選択します。
デフォルトのローカルアドレスでは、以下を渡すと --model 次のことができます unsloth start Unsloth Studio がすでに実行中でない場合に、一時サーバーを起動します。一時サーバーはエージェントの終了時に停止します。Unsloth がすでに実行中の場合、コマンドはそれに接続し、実行したままにします。
ローカル LLM に接続されるエージェントの例については、以下を参照してください:





リモートの Unsloth サーバーに接続する
エージェントを起動する前に Unsloth URL と API キーを設定します:
キーは以下を使って渡すこともできます --api-key。検証済みのローカル Unsloth サーバーでは、 unsloth start API キーを自動的に作成または再利用します。
フラグ + オプション
設定・サンプリングフラグが指定されていない場合、Unsloth はコンテキスト長、温度などを含む、モデルに最適な推奨設定を自動的に選択します。
それ以外の場合は、これらのフラグを適宜カスタマイズできます:
--model, -m
モデルを選択します。指定しない場合は、Unsloth によって報告された最初のモデルを使用します。
--api-key
Unsloth API キーを指定します。以下を設定することもできます UNSLOTH_API_KEY.
--launch / --no-launch
エージェントを起動するか、生成された環境とコマンドを表示します。
--serve / --no-serve
ローカルサーバーの自動起動を許可または防止します。
--gguf-variant
GGUF 量子化バリアントを選択します。
--reasoning
チャットで推論を使用します: on、off、または auto。auto はモデルのチャットテンプレートに従います。通常は on です。
--reasoning-effort
モデルのチャットテンプレートに渡す推論努力度です(例: medium)。レベルはモデルごとに異なるため、そのモデルが受け付けるものを使用してください。未設定の場合はテンプレート独自の設定を維持します。
--context-length, --max-seq-length
モデルのロード時に要求するコンテキスト長を設定します。
--load-in-4bit / --no-load-in-4bit
非 GGUF の Hugging Face モデルに対する 4 ビットロードを制御します。
--tensor-parallel / --no-tensor-parallel
マルチ GPU システム向けのテンソル並列 GGUF ロードを有効または無効にします。
--persist / --no-persist
該当する場合、Unsloth 管理下のエージェントホームを保持します。
--yolo
選択したエージェントの非確認モードまたは信頼モードを使用します。
-h, --help
コマンドのヘルプを表示します。
ロードオプションは、Unsloth が要求されたモデルをロードまたは調整する必要がある場合に使用されます。
通常のコマンドをエージェントに渡す
Unsloth オプションではない引数は、選択したエージェントに渡されます:
ネイティブオプションの完全な一覧については、エージェント独自のヘルプコマンドを使用してください。
セッションと --persist
--persist 管理対象ストレージを保持します。これだけでは会話を再開しません。エージェントの通常の再開コマンドも渡してください。
エージェント
必要ですか --persist?
再開の例
Claude Code
いいえ。Claude は通常のセッションストアを使用します。
unsloth start claude --continue
OpenAI Codex
はい。管理対象の Codex ホームはデフォルトで一時的です。
unsloth start codex --persist resume --last
OpenClaw
はい。管理対象の設定、ワークスペース、セッションはデフォルトで一時的です。
使用してください --persist 同じネイティブセッション ID とともに。
OpenCode
いいえ。OpenCode は通常のセッションストアを使用します。
unsloth start opencode run --continue "続行"
Hermes Agent
はい。管理対象の Hermes ホームはデフォルトで一時的です。
unsloth start hermes --persist --continue --oneshot "続行"
Pi コーディングエージェント
はい。管理対象の Pi ホームはデフォルトで一時的です。
unsloth start pi --persist --continue
Codex、OpenClaw、Hermes、Pi では、以下を使用してください --persist 初回起動時と、セッションに戻る際にも使用してください。
名前付きセッションには、安定したセッション ID を使用します:
実行せずに起動コマンドを出力する
これにより生成された環境とコマンドが出力されます。出力には接続認証情報が含まれる可能性があるため、ログやスクリーンショットで公開しないでください。
権限バイパスモード
--yolo は、選択したエージェントの信頼モードまたは非確認モードに対応します。承認プロンプトを減らし、エージェントが事前確認なしでコマンドを実行できるようにする場合があります。
制限のないエージェント操作が許容される環境でのみ使用してください。
よくある問題
最終更新
役に立ちましたか?







