如何将 MCP 服务器与本地 LLM 一起使用
通过截图学习如何将 MCP 服务器连接到开源 AI 模型。
这份分步指南向你展示如何连接 模型上下文协议(MCP) 服务器到本地 LLM,例如 Qwen 或 Gemma,因此你运行的任何模型都可以通过 MCP 调用外部工具和服务。 将 MCP 连接到本地模型后,它就能安全地使用你的本地文件、应用、数据库和工具,而不只是基于记忆聊天,从而构建一个更有用、更私密、也可替换的 AI 助手,能够在你的真实环境中执行操作。
我们将使用开源仓库 Unsloth 和 llama.cpp ,因为它们是本地模型推理/部署的热门框架。MCP 适用于本地 GGUF 模型和云端 提供商模型. 我们还会展示如何使用 多个 MCP 服务器 。
MCP 工具可与其他模型能力一起工作,例如 代码执行 和 网页搜索,因此单个模型可以在同一轮对话中搜索网页、运行代码,并调用你连接的服务。
使用场景
一旦连接了 MCP 服务器,你就可以让本地模型执行许多自动化任务。下面是一些例子:
搜索文档: “找到相关文档并总结设置步骤。” - 可使用 Context7。
分析代码库: “梳理这个仓库,并解释认证、计费和数据访问分别在哪里发生。” - 可使用 GitHub 官方 MCP 和 GitMCP 来分析仓库。
使用嵌入搜索网页 - 可使用 Exa 的 MCP 服务器进行带上下文嵌入支持的语义网页搜索。
调试网站 UI - 可使用 Playwright 和 Chrome DevTools MCP 服务器来驱动网站并查找问题修复。
快速开始
我们将使用两种方式把你设备上的本地模型连接到 MCP 服务器。两种方式都使用开源包: Unsloth 和 llama.cpp 用于运行、提供服务并部署你的模型。
Unsloth MCP 指南Llama.cpp MCP 指南
🦥 Unsloth 指南
在这个示例中,我们将使用 Unsloth 将任意本地模型连接到 MCP 服务器,例如 Qwen3.6 或 Gemma 4 以及以下 MCP 服务器: Vercel, Context7, Exa 和 Hugging Face。然后我们会问模型它能用这些做什么。相同步骤适用于任何 MCP 服务器。
设置 Unsloth Studio
现在我们需要安装并设置 Unsloth,这将使你能够在 UI 界面中运行云端模型。 请看这里 以获取更详细的说明。
步骤 1:设置 Unsloth
打开 终端 ,然后输入下面的命令来安装 Unsloth。
curl -fsSL https://unsloth.ai/install.sh | sh环境和所需包现在将开始安装。提示出现时输入 Y 并按回车继续。设置完成后,服务器将可在本地端口上使用 8888.

如果你在安装时跳过了启动应用,也可以稍后使用 unsloth studio -p 8888启动它。若要允许网络中其他设备连接,请改用 unsloth studio -H 0.0.0.0 -p 8888 。
步骤 2:启动 Unsloth
打开你常用的浏览器并输入 http://127.0.0.1:8888 到地址栏中。如果这是你第一次安装 Unsloth,你会被转到密码页面,需要创建一个新密码。随后你应该会看到如下所示的聊天页面。
步骤 1:设置 Unsloth
打开你的终端应用程序。你可以通过按 Ctrl + Alt + T来启动它,或者搜索 Terminal ,在系统应用菜单中找到它。
点击 Windows 开始菜单,输入你已安装发行版的名称(例如 Ubuntu),然后打开它。
在 WSL,确保你的 NVIDIA 驱动 已安装在 Windows 上(不是在 WSL 内),并且 CUDA 工具包 已安装在你的 WSL 发行版中。详情请参见下面的系统要求。
要安装,请复制并运行安装命令:
然后:
点击终端窗口内
使用
Ctrl + Shift + V按
回车
Unsloth 将开始设置环境并安装所需包,如下所示。在询问你是否允许 Studio 现在启动时,输入 Y 并按 回车 。这将会在你的本地 8888 端口上启动 Unsloth。

如果你在安装过程中选择不启动 Unsloth,也可以随时使用 unsloth studio -p 8888 来启动 Unsloth 应用。如果你希望你的 Unsloth 实例可被 PC/计算机之外的客户端访问,请添加 -H 0.0.0.0 到 unsloth studio 命令中。
步骤 2:启动 Unsloth
打开你常用的浏览器并输入 http://127.0.0.1:8888 到地址栏中。如果这是你第一次安装 Unsloth,你会被转到密码页面,需要创建一个新密码。之后,Unsloth 应该会按下方所示在聊天页面打开。
启用 MCP
点击聊天工具栏中的“MCP”。

Unsloth Studio 默认支持 Context7、Exa 和 Hugging Face 的 MCP。开启 Exa 网页搜索 将会禁用我们现有的默认搜索工具。
添加自定义 MCP 服务器
要添加 Vercel MCP 服务器,点击“Add custom MCP”,你会看到一个弹出窗口:

填写服务器详细信息:
显示名称:一个友好的标签,例如
Vercel.URL:服务器的基础端点,例如
https://mcp.vercel.com.请在下面选择一种认证方式。
对于需要基于浏览器认证的服务器(GitHub、Linear、Vercel 等),请开启 使用 OAuth 登录。首次连接时会打开浏览器窗口,以便你授权 Unsloth。
对于使用令牌认证的服务器,请关闭 OAuth,然后点击 添加请求头 在 自定义请求头下方。添加一个 Authorization 请求头,并填入你的令牌:

使用多个 MCP 服务器
如果调用 3 个左右的多个 MCP 服务器会怎么样?我们将使用 Unsloth Studio 默认提供的 Exa、Context7 和 Hugging Face MCP 服务器,并全部启用。
如果你问“Unsloth 是否支持 Qwen 微调”,Exa 会提供非常详细的信息:

然后继续追问“搜索 Unsloth 文档了解如何执行这个操作”,这时会使用 Context7 来查找文档:

然后输入“搜索 Hugging Face 上的 unsloth/Qwen 模型”,Hugging Face 的 MCP 服务器就会被调用:

另一个具体使用场景示例
一旦服务器连接成功,就可以用自然语言让模型做实际工作。以下是使用 Vercel 服务器的一些示例:
调试失败的构建: “获取我最近一次部署的构建日志,并告诉我它为什么失败。”
检查部署状态: “列出我最近的部署及其状态。”
搜索文档: “在 Vercel 文档中搜索如何设置自定义域名。”
域名调研: “
myproject.dev可用吗,费用大概是多少?”
🦙 Llama.cpp 指南
使用 GGUF 启动 llama-server
在这个示例中我们使用 Gemma 4 E4B GGUF:
对于更大的 Gemma 4 26B-A4B 模型:
如需更多推理参数调整,请参见我们的 Gemma 4 指南.
你可以测试服务器:
故障排除
如果服务器连接失败或其工具没有出现,请检查 URL 是否是服务器的基础端点(例如 https://mcp.vercel.com),而不是文档页或控制面板页。对于 OAuth 服务器,请在浏览器登录窗口打开后完成登录;对于基于令牌的服务器,请验证 Authorization 请求头以及令牌是否有效。
点击 刷新 如果连接后工具没有显示出来,请刷新,并确保单独服务器开关和 使用 MCP 服务器 总开关都已开启。
安全说明
只连接你信任的 MCP 服务器。审查所请求的权限,并在读取私有数据、更改部署、购买域名或修改项目的操作中保持人工确认开启。尤其要注意将 MCP 服务器与网页搜索或其他工具结合使用,因为提示注入内容可能会尝试触发不需要的工具调用。
热门 MCP 服务器
以下是一些你可以连接的热门且实用的 MCP 服务器列表:
最后更新于
这有帮助吗?




