Comment connecter Ollama à Unsloth
Mis à jour
Ce contenu vous a-t-il été utile ?
Ollama vous permet d’exécuter des LLM locaux sur votre propre matériel, et Unsloth rend facile la connexion et l’exécution de ces modèles directement dans une interface de chat UI open source. Dans ce guide, vous apprendrez à installer Ollama, à exécuter des modèles natifs Ollama ou des modèles GGUF depuis Hugging Face, à connecter Ollama à Unsloth et à commencer à discuter avec des modèles d’IA locaux.
Que vous souhaitiez utiliser des modèles comme Qwen, importer un fichier GGUF ou exposer votre serveur Ollama local via un point de terminaison compatible OpenAI, ce guide couvre toute la configuration, de l’installation jusqu’au premier chat.
Installez Ollama avec le script d’installation :
curl -fsSL https://ollama.com/install.sh | shVous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.
Installez Ollama depuis PowerShell :
irm https://ollama.com/install.ps1 | iexVous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.
Installez Ollama avec le script d’installation :
curl -fsSL https://ollama.com/install.sh | shVous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.
L’image Docker officielle d’Ollama est ollama/ollama sur Docker Hub.
docker run -d \
-v ollama:/root/.ollama \
-p 11434:11434 \
--name ollama \
ollama/ollamaOllama s’exécute généralement à :
http://localhost:11434Vous pouvez choisir un modèle de deux façons courantes :
Recherchez des modèles natifs Ollama sur ollama.com/search, puis copiez le nom du modèle.
Utilisez un modèle GGUF depuis Hugging Face, puis copiez la commande Ollama depuis Utiliser ce modèle.
Pour un modèle Ollama, récupérez-le et exécutez-le :
ollama pull qwen3.6:35b-a3b
ollama run qwen3.6:35b-a3bSi l’application ou le service Ollama n’est pas déjà en cours d’exécution, démarrez-le d’abord :
ollama serveSi vous utilisez un modèle GGUF de Hugging Face, le moyen le plus simple d’obtenir la commande est depuis la page du modèle.
Ouvrez le modèle que vous souhaitez utiliser, cliquez sur Utiliser ce modèle, puis choisissez Ollama dans la liste des applications locales. Choisissez la quantification souhaitée dans le menu déroulant, puis copiez la commande générée.

Par exemple, avec Ollama :
ollama run hf.co/unsloth/Qwen3.6-35B-A3B-GGUF:UD-Q4_K_XLCela permet d’éviter les erreurs avec le nom du dépôt ou la balise de quantification.
Ouvrez Paramètres → Connexions, puis cliquez sur Ajouter une connexion.
Sélectionnez Ollama, puis saisissez les détails de votre connexion :

Utilisez l’URL Ollama indiquée dans le formulaire Unsloth. Dans la plupart des configurations locales, il s’agit de :
http://localhost:11434Si Unsloth demande une URL de base compatible OpenAI, utilisez :
http://localhost:11434/v1Ollama n’a normalement pas besoin de clé API. Laissez le champ de clé API vide, sauf si vous utilisez un proxy qui en exige une.
Cliquez sur Charger les modèles pour récupérer les modèles en cours d’exécution dans Ollama, ou saisissez vous-même l’ ID du modèle par exemple qwen3.6.
Utilisez-les lors de la configuration du modèle que vous souhaitez exposer à Unsloth :
ollama run qwen3.6:35b-a3b
Exécuter un modèle et ouvrir un chat interactif
ollama pull qwen3.6:35b-a3b
Télécharger un modèle sans lancer le chat
ollama ls
Lister les modèles téléchargés
ollama ps
Lister les modèles actuellement en cours d’exécution
ollama stop qwen3.6:35b-a3b
Arrêter un modèle en cours d’exécution
ollama rm qwen3.6:35b-a3b
Supprimer un modèle téléchargé
ollama serve
Démarrer le serveur Ollama
Si vous importez un GGUF local dans Ollama, créez un Modelfile, puis exécutez :
ollama create -f ModelfileSi Ollama n’est pas détecté, assurez-vous que l’application ou le service Ollama est en cours d’exécution. Ensuite, cliquez à nouveau sur Charger les modèles dans Unsloth.
Pour la liste complète des commandes, consultez la référence CLI Ollama.
Mis à jour
Ce contenu vous a-t-il été utile ?
Ce contenu vous a-t-il été utile ?

