如何将 Ollama 连接到 Unsloth
设置
1
2
常用 Ollama 命令
命令
作用
ollama create -f Modelfile最后更新于
这有帮助吗?
Ollama 让你可以在自己的硬件上运行本地 LLM,并且 Unsloth 可以轻松地将这些模型直接连接并运行到一个开源 UI 聊天界面中。在本指南中,你将学习如何安装 Ollama、运行原生 Ollama 模型或来自 Hugging Face 的 GGUF 模型、将 Ollama 连接到 Unsloth,并开始与本地 AI 模型聊天。
无论你是想使用像 Qwen这样的模型、导入一个 GGUF 文件,还是通过 OpenAI 兼容的端点暴露你的本地 Ollama 服务器,这份教程都涵盖了从安装到第一次聊天的完整设置。
使用安装脚本安装 Ollama:
curl -fsSL https://ollama.com/install.sh | sh你也可以从以下地址手动下载 Ollama: ollama.com/download.
从 PowerShell 安装 Ollama:
irm https://ollama.com/install.ps1 | iex你也可以从以下地址手动下载 Ollama: ollama.com/download.
使用安装脚本安装 Ollama:
curl -fsSL https://ollama.com/install.sh | sh你也可以从以下地址手动下载 Ollama: ollama.com/download.
官方 Ollama Docker 镜像是 ollama/ollama ,在 Docker Hub 上。
docker run -d \
-v ollama:/root/.ollama \
-p 11434:11434 \
--name ollama \
ollama/ollamaOllama 通常运行在:
http://localhost:11434你可以通过两种常见方式选择模型:
在以下地址搜索原生 Ollama 模型 ollama.com/search,然后复制模型名称。
使用 Hugging Face 上的 GGUF 模型,然后从以下位置复制 Ollama 命令 使用此模型.
对于 Ollama 模型,先拉取并运行它:
ollama pull qwen3.6:35b-a3b
ollama run qwen3.6:35b-a3b如果 Ollama 应用或服务尚未运行,请先启动它:
ollama serve如果你使用的是 Hugging Face 上的 GGUF 模型,获取命令最简单的方法是从模型页面上获取。
打开你想使用的模型,点击 使用此模型,然后在本地应用列表中选择 Ollama 。然后从下拉菜单中选择你想要的量化方式,再复制生成的命令。

例如,使用 Ollama:
ollama run hf.co/unsloth/Qwen3.6-35B-A3B-GGUF:UD-Q4_K_XL这有助于避免仓库名称或量化标签出错。
在设置你想暴露给 Unsloth 的模型时使用这些命令:
ollama run qwen3.6:35b-a3b
运行模型并打开交互式聊天
ollama pull qwen3.6:35b-a3b
下载模型而不启动聊天
ollama ls
列出已下载的模型
ollama ps
列出当前正在运行的模型
ollama stop qwen3.6:35b-a3b
停止正在运行的模型
ollama rm qwen3.6:35b-a3b
移除已下载的模型
ollama serve
启动 Ollama 服务器
如果你要将本地 GGUF 导入 Ollama,请创建一个 Modelfile,然后运行:
ollama create -f Modelfile如果未检测到 Ollama,请确保 Ollama 应用或服务正在运行。然后在 Unsloth 中再次点击 加载模型 。
完整命令列表请参见 Ollama CLI 参考.
最后更新于
这有帮助吗?
这有帮助吗?

