For the complete documentation index, see llms.txt. This page is also available as Markdown.

Comment connecter Ollama à Unsloth

Ollama vous permet d’exécuter des LLM locaux sur votre propre matériel, et Unsloth rend facile la connexion et l’exécution de ces modèles directement dans une interface de chat UI open source. Dans ce guide, vous apprendrez à installer Ollama, à exécuter des modèles natifs Ollama ou des modèles GGUF depuis Hugging Face, à connecter Ollama à Unsloth et à commencer à discuter avec des modèles d’IA locaux.

Que vous souhaitiez utiliser des modèles comme Qwen, importer un fichier GGUF ou exposer votre serveur Ollama local via un point de terminaison compatible OpenAI, ce guide couvre toute la configuration, de l’installation jusqu’au premier chat.

Configuration

1

Installer ou préparer Ollama

Installez Ollama avec le script d’installation :

curl -fsSL https://ollama.com/install.sh | sh

Vous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.

Installez Ollama depuis PowerShell :

irm https://ollama.com/install.ps1 | iex

Vous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.

Installez Ollama avec le script d’installation :

curl -fsSL https://ollama.com/install.sh | sh

Vous pouvez aussi télécharger Ollama manuellement depuis ollama.com/download.

L’image Docker officielle d’Ollama est ollama/ollama sur Docker Hub.

docker run -d \
  -v ollama:/root/.ollama \
  -p 11434:11434 \
  --name ollama \
  ollama/ollama

Ollama s’exécute généralement à :

http://localhost:11434
2

Exécuter un modèle

Vous pouvez choisir un modèle de deux façons courantes :

  • Recherchez des modèles natifs Ollama sur ollama.com/search, puis copiez le nom du modèle.

  • Utilisez un modèle GGUF depuis Hugging Face, puis copiez la commande Ollama depuis Utiliser ce modèle.

Pour un modèle Ollama, récupérez-le et exécutez-le :

ollama pull qwen3.6:35b-a3b
ollama run qwen3.6:35b-a3b

Si l’application ou le service Ollama n’est pas déjà en cours d’exécution, démarrez-le d’abord :

ollama serve

Choisir un GGUF sur Hugging Face

Si vous utilisez un modèle GGUF de Hugging Face, le moyen le plus simple d’obtenir la commande est depuis la page du modèle.

Ouvrez le modèle que vous souhaitez utiliser, cliquez sur Utiliser ce modèle, puis choisissez Ollama dans la liste des applications locales. Choisissez la quantification souhaitée dans le menu déroulant, puis copiez la commande générée.

Par exemple, avec Ollama :

ollama run hf.co/unsloth/Qwen3.6-35B-A3B-GGUF:UD-Q4_K_XL

Cela permet d’éviter les erreurs avec le nom du dépôt ou la balise de quantification.

3

Connecter Ollama à Unsloth

Ouvrez Paramètres → Connexions, puis cliquez sur Ajouter une connexion.

Sélectionnez Ollama, puis saisissez les détails de votre connexion :

Utilisez l’URL Ollama indiquée dans le formulaire Unsloth. Dans la plupart des configurations locales, il s’agit de :

http://localhost:11434

Si Unsloth demande une URL de base compatible OpenAI, utilisez :

http://localhost:11434/v1

Ollama n’a normalement pas besoin de clé API. Laissez le champ de clé API vide, sauf si vous utilisez un proxy qui en exige une.

Cliquez sur Charger les modèles pour récupérer les modèles en cours d’exécution dans Ollama, ou saisissez vous-même l’ ID du modèle par exemple qwen3.6.

4

Prêt à discuter

Après avoir cliqué sur Ajouter une connexion, les modèles que vous avez activés apparaîtront désormais sous Connecté dans le menu déroulant Sélectionner un modèle .

Commandes Ollama courantes

Utilisez-les lors de la configuration du modèle que vous souhaitez exposer à Unsloth :

Commande
Ce qu’elle fait

ollama run qwen3.6:35b-a3b

Exécuter un modèle et ouvrir un chat interactif

ollama pull qwen3.6:35b-a3b

Télécharger un modèle sans lancer le chat

ollama ls

Lister les modèles téléchargés

ollama ps

Lister les modèles actuellement en cours d’exécution

ollama stop qwen3.6:35b-a3b

Arrêter un modèle en cours d’exécution

ollama rm qwen3.6:35b-a3b

Supprimer un modèle téléchargé

ollama serve

Démarrer le serveur Ollama

Si vous importez un GGUF local dans Ollama, créez un Modelfile, puis exécutez :

ollama create -f Modelfile

Si Ollama n’est pas détecté, assurez-vous que l’application ou le service Ollama est en cours d’exécution. Ensuite, cliquez à nouveau sur Charger les modèles dans Unsloth.

Pour la liste complète des commandes, consultez la référence CLI Ollama.

Mis à jour

Ce contenu vous a-t-il été utile ?