For the complete documentation index, see llms.txt. This page is also available as Markdown.

Hermes AgentでローカルAIモデルを実行する方法

Hermes Agentを使ってローカルでオープンLLMを使用するためのガイド。

このガイドを使うと、オープンLLMをローカルで実行できます Hermes エージェント 経由で Unsloth。Nous ResearchのHermes Agentは オープンソースの モデルエンドポイントに接続し、タスクを実行し、記憶と学習済みスキルを通じて時間の経過とともに改善する自律型AIエージェントです。

Hermesは任意の ローカルモデル に対して、Unslothの OpenAI 互換 APIを通じて公開されたものならどれでも動作します。以下を含みます: DeepSeek、Qwen、Gemma、その他。Hermesはエージェントクライアントとして機能し、Unslothは ローカル API 完全にオフラインです。

セットアップ後、Hermes経由で送信されるすべてのプロンプトは、デバイス上のローカルモデルを使って実行されます。

Unsloth経由でHermes上でローカル実行されているQwen3.5。

Hermesのセットアップ🦥 ローカルモデルを接続

このチュートリアルでは、Hermesをインストールして、 unsloth/Qwen3.6-27B-GGUF Unslothから提供されるモデルを使うように設定します。別のモデルを使いたいですか? Unslothに読み込ませて設定を更新すれば、ほかの任意のモデルに差し替えられます。

Hermes Agentのセットアップ

前提条件:

この Hermes コマンドラインインストーラーはLinux、macOS、WSL2をサポートしています。以下を確認してください Git がインストールされていること。Linuxでは、さらに curlxz-utilsをインストールしてください。インストーラーは自動的に uv、Python 3.11、Node.js 22、 ripgrep、そして ffmpeg.

1. インストーラーを実行する

curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

インストーラーは:

  • プラットフォームを検出し、依存関係を確認します。

  • Hermesを ~/.hermes/hermes-agent/.

  • にクローンし、Pythonの仮想環境を作成してPython依存関係をインストールします。

  • browser-toolの依存関係とPlaywrightのChromiumエンジンをインストールします。

  • を追加し、 hermes コマンドを追加してセットアップウィザードを起動します。

Playwrightは sudo を要求して、Chromiumの共有システムライブラリをインストールする場合があります。Hermes自体にroot権限は不要です。

2. シェルを再読み込みする ことで、 hermes コマンドが PATH:

3. インストールを確認する:

そのコマンドが見つかれば、Hermesはインストールされています。すべては以下の場所にあります ~/.hermes/:

パス
内容

~/.hermes/config.yaml

主な設定(モデル、プロバイダー、ツール、TTSなど)

~/.hermes/.env

APIキーおよびその他の秘密情報

~/.hermes/hermes-agent/

Hermesのソース + 仮想環境

~/.hermes/cron/, sessions/, logs/

実行時データ

~/.hermes/skills/

インストール済みスキル(Skills Hubから同期)

インストールの完全なリファレンス: hermes-agent.nousresearch.com/docs/getting-started/installation。インストーラーが不足している前提条件を報告した場合は、それをインストールして、ワンライナーを再実行してください。インストーラーは冪等です。

⚡ クイックスタート

Hermesをインストールした後、Hermesがローカルモデルの推論を提供・実行できるようにするため、Unsloth Desktopをインストールする必要があります。

1

Unslothをダウンロード

始める最も簡単な方法は、次のものをインストールすることです Unsloth Desktop アプリです。対応環境は macOS、Linux、 Windows, NVIDIA, AMD、Intel、およびCPU構成です。

Unslothをダウンロード

あるいは、手動インストールを希望する場合:

macOS、Linux、WSL:

Windows PowerShell:

2

インストール

  1. Unslothインストーラを開き(.dmg, .exe ファイル)

  2. MacではUnslothをアプリケーションにドラッグし、Windowsではセットアップを完了してください。

  3. アプリを起動し、インストール完了を待ちます

3

モデルを選択

上部の『モデルを選択』ドロップダウンまたは『Model hub』タブを開き、デバイスに合ったモデルと量子化を選んでダウンロードします。完了したら、すぐにチャットを開始できます。セットアップは不要です。

4

Unslothの準備が整いました

チャットを始めるには、メッセージを入力してEnterを押します。

Hermesを接続します。 実行 unsloth start hermes をUnslothが開いているターミナルで実行してください。APIキーを発行し、設定を書き込み、読み込んだモデルに対してHermesを起動します。

⚡ Hermes Agentを unsloth start

モデルで直接Hermesを起動するには、次を実行します:

Unsloth は使用すべき正しいパラメータを自動的に選択しますが、変更することもできます。

Unsloth Studioでモデルを読み込んだ状態で、次を実行します:

Hermes Agent connected to a local model through Unsloth Studio
Unsloth Studioプロバイダー経由で実行されているHermes Agent。

Unslothは、Unslothプロバイダー、モデル、コンテキスト設定があらかじめ構成された別の管理ホームからHermesを起動します。既存のHermesセットアップは変更されません。

この管理ホームは既定では一時的です。セッションと状態を保持したい場合は、 --persist 初回起動時から次を追加してください:

後で最新のセッションに戻るには、次を実行します:

特定のセッションを再度開くには、代わりに --resume <session-id-or-title> を使用します。

完全な unsloth start モデル選択、リモート接続、高度なオプションのリファレンス。

Hermesのプロバイダーを自分で管理したい場合は、下のセットアップウィザードも引き続き利用できます。

🔑 APIキーの作成

  1. サイドバーを開き、左下のあなたの Unsloth アバターをクリックします。

  2. 移動します 設定API.

  3. 覚えやすい名前を入力します(例: hermes-agent-macbook).

  4. (任意) 有効期限を設定します。

  5. クリックして 作成.

  6. キーはすぐにコピーしてください。 Unslothはハッシュのみを保存するため、再表示はできません。

すべてのキーは次の sk-unsloth- プレフィックスで始まります。キーは同じページからいつでも失効できます。失効したキーで行われたリクエストは次で失敗します 401 Unauthorized.

🦥 HermesをUnsloth APIと統合

Hermesは各チャットターンを設定済みの推論プロバイダーに送り、 OpenAI互換 エンドポイントに接続します。インストール時、または後からセットアップウィザードでプロバイダーを設定できます。

1. セットアップウィザードを開く:

選択 モデルとプロバイダー を「何をしたいですか?」メニューから選んで、推論エンドポイントのみを設定するか、 フルセットアップ を選んで、すべて(TTS、ツール、メッセージングゲートウェイ、エージェント設定)を順に設定します。

2. カスタムOpenAI互換エンドポイントを選択 Hermesが推論プロバイダーを尋ねてきたときに。

3. プロンプトに入力する Hermesの案内に従って:

プロンプト

APIベースURL

http://localhost:8888/v1 (Unslothのポート + /v1)

APIキー

あなたの sk-unsloth-… キー

検出されたモデル: … このモデルを使いますか?

Y (Hermesは GET /v1/models)

トークン単位のコンテキスト長

(自動検出するには空欄のままにしてください)

表示名

お好きなものを何でも、たとえば unsloth-api

Hermesはエンドポイントを検証し /v1/models 、続行前に検出されたモデルを確認します。

4. 残りのプロンプトは既定値を受け入れる (TTS、ツール、メッセージングゲートウェイ、エージェント設定)は、後からいつでも再設定できます。Hermesはすべてを書き込みます ~/.hermes/config.yaml~/.hermes/.env.

5. Hermesを起動する:

起動バナーには、ステータスバーにUnslothのモデル名が表示されます(例: unsloth/Qwen3.6-27B-GGUF)と表示され、プロンプトは入力待ちになります。

後でモデルだけを再設定するには、次を実行します hermes setup model。設定ファイルを直接編集するには、 hermes config edit を開きます ~/.hermes/config.yaml あなたの $EDITOR.

任意: Unslothサーバーを調整

unsloth run ローカルAPIサーバーを起動し、アプリが接続するためのモデルを読み込みます。起動時のサーバーの動作もカスタマイズできます。

次を使用: --reasoning off で思考をオフにするか、 --reasoning on 推論対応モデルでオンにします。

これでサーバーは次で起動します 0.0.0.0:8888。これにより、ローカルネットワーク上の他のデバイスが接続できます。 -p サーバーが使用するポートを変更します。スマートフォン、ノートPC、その他ネットワーク上のデバイスからAPIサーバーに接続したい場合は、次のように起動します -H 0.0.0.0.

アプリによっては、個別リクエストごとに生成設定を上書きする場合があります。さらに高度な実行時設定については、メインの APIチューニング セクションを参照してください。

最終更新

役に立ちましたか?