> For the complete documentation index, see [llms.txt](https://unsloth.ai/docs/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://unsloth.ai/docs/fr/modeles.md).

# Modèles

- [Qwen3.8 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.8.md): Guide pour exécuter localement les quants Qwen3.8, y compris Qwen3.8-27B, sur votre configuration locale.
- [Muse Glimmer - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/muse-glimmer.md): Découvrez comment exécuter le nouveau modèle Muse Glimmer 30B de Meta.
- [Guide de fine-tuning Muse Glimmer](https://unsloth.ai/docs/fr/modeles/muse-glimmer/train.md): Entraînez le modèle Muse Glimmer 30B de Meta avec Unsloth.
- [DeepSeek-V4 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/deepseek-v4.md): Exécutez DeepSeek-V4-Pro-0813 et DeepSeek-V4-Flash-0731 localement sur votre propre appareil !
- [Kimi K3 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k3.md): Guide pour exécuter localement les quants Kimi K3 sur votre configuration locale.
- [Tutoriels sur les grands modèles de langage (LLM)](https://unsloth.ai/docs/fr/modeles/tutorials.md)
- [Qwen3 - Comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune.md): Apprenez à exécuter et fine-tuner Qwen3 localement avec Unsloth + nos quants Dynamic 2.0
- [Qwen3-VL : guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune/qwen3-vl-how-to-run-and-fine-tune.md): Apprenez à fine-tuner et exécuter Qwen3-VL localement avec Unsloth.
- [Qwen3-2507 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune/qwen3-2507.md): Exécutez localement sur votre appareil les versions Thinking et Instruct de Qwen3-30B-A3B-2507 et 235B-A22B !
- [MiniMax-M2.7 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/minimax-m27.md): Exécutez le LLM MiniMax-M2.7 localement sur votre propre appareil !
- [GLM-5 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-5.md): Exécutez le nouveau modèle GLM-5 de Z.ai sur votre propre appareil local !
- [Kimi K2.5 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/kimi-k2.5.md): Guide pour exécuter Kimi-K2.5 sur votre propre appareil local !
- [GLM-4.7-Flash : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.7-flash.md): Exécutez et fine-tunez GLM-4.7-Flash localement sur votre appareil !
- [Gemma 3 - Guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/gemma-3-how-to-run-and-fine-tune.md): Comment exécuter efficacement Gemma 3 avec nos GGUF sur llama.cpp, Ollama, Open WebUI et comment fine-tuner avec Unsloth !
- [Gemma 3n : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/gemma-3-how-to-run-and-fine-tune/gemma-3n-how-to-run-and-fine-tune.md): Exécutez localement le nouveau Gemma 3n de Google avec des GGUF dynamiques sur llama.cpp, Ollama, Open WebUI et fine-tunez avec Unsloth !
- [Qwen3-Coder : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-coder-how-to-run-locally.md): Exécutez Qwen3-Coder-30B-A3B-Instruct et 480B-A35B localement avec les quants dynamiques Unsloth.
- [MiniMax-M2.5 : guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/minimax-m25.md): Exécutez MiniMax-M2.5 localement sur votre propre appareil !
- [Guide pour exécuter et fine-tuner DeepSeek-OCR 2](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-ocr-2.md): Guide sur la façon d'exécuter et de fine-tuner DeepSeek-OCR-2 localement.
- [GLM-4.7 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.7.md): Un guide sur la façon d'exécuter le modèle Z.ai GLM-4.7 sur votre propre appareil local !
- [Comment exécuter Qwen-Image-2512 localement dans ComfyUI](https://unsloth.ai/docs/fr/modeles/tutorials/qwen-image-2512.md): Tutoriel pas à pas pour exécuter Qwen-Image-2512 sur votre appareil local avec ComfyUI.
- [Tutoriel pour exécuter Qwen-Image-2512 dans stable-diffusion.cpp](https://unsloth.ai/docs/fr/modeles/tutorials/qwen-image-2512/stable-diffusion.cpp.md): Tutoriel pour utiliser Qwen-Image-2512 dans stable-diffusion.cpp.
- [Devstral 2 - Guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/devstral-2.md): Guide pour exécuter localement les modèles Mistral Devstral 2 : 123B-Instruct-2512 et Small-2-24B-Instruct-2512.
- [Ministral 3 - Guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/ministral-3.md): Guide pour les modèles Mistral Ministral 3, à exécuter ou fine-tuner localement sur votre appareil
- [DeepSeek-OCR : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-ocr-how-to-run-and-fine-tune.md): Guide sur la façon d'exécuter et de fine-tuner DeepSeek-OCR localement.
- [Kimi K2 Thinking : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/kimi-k2-thinking-how-to-run-locally.md): Guide pour exécuter Kimi-K2-Thinking et Kimi-K2 sur votre propre appareil local !
- [GLM-4.6 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.6-how-to-run-locally.md): Un guide sur la façon d'exécuter les modèles Z.ai GLM-4.6 et GLM-4.6V-Flash sur votre propre appareil local !
- [Qwen3-Next : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-next.md): Exécutez les versions Qwen3-Next-80B-A3B-Instruct et Thinking localement sur votre appareil !
- [FunctionGemma : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/functiongemma.md): Découvrez comment exécuter et fine-tuner FunctionGemma localement sur votre appareil et votre téléphone.
- [DeepSeek-V3.1 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-v3.1-how-to-run-locally.md): Un guide sur la façon d'exécuter DeepSeek-V3.1 et Terminus sur votre propre appareil local !
- [DeepSeek-R1-0528 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-0528-how-to-run-locally.md): Un guide sur la façon d'exécuter DeepSeek-R1-0528, y compris Qwen3, sur votre propre appareil local !
- [Liquid LFM2.5 : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/lfm2.5.md): Exécutez et fine-tunez LFM2.5 Instruct et Vision localement sur votre appareil !
- [Magistral : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/magistral-how-to-run-and-fine-tune.md): Découvrez Magistral - les nouveaux modèles de raisonnement de Mistral.
- [IBM Granite 4.0](https://unsloth.ai/docs/fr/modeles/tutorials/ibm-granite-4.0.md): Comment exécuter IBM Granite-4.0 avec les GGUF Unsloth sur llama.cpp, Ollama, et comment fine-tuner !
- [Llama 4 : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/llama-4-how-to-run-and-fine-tune.md): Comment exécuter Llama 4 localement à l'aide de nos GGUF dynamiques, qui récupèrent la précision par rapport à la quantification standard.
- [Grok 2](https://unsloth.ai/docs/fr/modeles/tutorials/grok-2.md): Exécutez localement le modèle Grok 2 de xAI !
- [Devstral : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/devstral-how-to-run-and-fine-tune.md): Exécutez et fine-tunez Mistral Devstral 1.1, y compris Small-2507 et 2505.
- [Comment exécuter des LLM locaux avec Docker : guide étape par étape](https://unsloth.ai/docs/fr/modeles/tutorials/how-to-run-llms-with-docker.md): Découvrez comment exécuter des grands modèles de langage (LLM) avec Docker et Unsloth sur votre appareil local.
- [DeepSeek-V3-0324 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-v3-0324-how-to-run-locally.md): Comment exécuter DeepSeek-V3-0324 localement à l'aide de nos quants dynamiques qui récupèrent la précision
- [DeepSeek-R1 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-how-to-run-locally.md): Un guide sur la façon d'exécuter nos quants dynamiques 1.58-bit pour DeepSeek-R1 en utilisant llama.cpp.
- [DeepSeek-R1 Dynamic 1.58-bit](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-how-to-run-locally/deepseek-r1-dynamic-1.58-bit.md): Consultez les tableaux de comparaison des performances des quants GGUF dynamiques d'Unsloth par rapport aux quants IMatrix standard.
- [Phi-4 Reasoning : comment exécuter et fine-tuner](https://unsloth.ai/docs/fr/modeles/tutorials/phi-4-reasoning-how-to-run-and-fine-tune.md): Apprenez à exécuter et fine-tuner localement les modèles de raisonnement Phi-4 avec Unsloth + nos quants Dynamic 2.0
- [QwQ-32B : comment exécuter efficacement](https://unsloth.ai/docs/fr/modeles/tutorials/qwq-32b-how-to-run-effectively.md): Comment exécuter efficacement QwQ-32B avec nos corrections de bugs et sans générations interminables + GGUF.
- [Cogito v2.1 : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/cogito-v2-how-to-run-locally.md): Les LLM Cogito v2.1 font partie des modèles ouverts les plus puissants au monde, entraînés avec IDA. La version v1 existe aussi en 4 tailles : 70B, 109B, 405B et 671B, ce qui vous permet de choisir celle qui correspond le mieux à votre matériel.
- [Inkling - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/inkling.md): Découvrez comment exécuter localement les modèles multimodaux Inkling de Thinking Machine Labs.
- [Qwen3.6 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.6.md): Exécutez les nouveaux modèles Qwen3.6-27B et 35B-A3B localement !
- [Gemma 4 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/gemma-4.md): Exécutez localement les nouveaux modèles Gemma 4 de Google, y compris E2B, E4B, 26B A4B et 31B.
- [Gemma 4 QAT](https://unsloth.ai/docs/fr/modeles/gemma-4/qat.md): Exécutez localement les modèles Google Gemma 4 QAT, y compris E2B, E4B, 12B, 26B-A4B et 31B.
- [Guide de fine-tuning Gemma 4](https://unsloth.ai/docs/fr/modeles/gemma-4/train.md): Entraînez Gemma 4 de Google avec Unsloth.
- [NVIDIA Nemotron 3.5 Lightning : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3.5.md)
- [GLM-5.2 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.2.md): Exécutez le nouveau modèle GLM-5.2 de Z.ai sur du matériel local !
- [Kimi K2.7 Code - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k2.7-code.md): Guide pas à pas pour exécuter Kimi K2.7 Code sur votre propre appareil local.
- [Comment exécuter des modèles MTP : guide de prédiction multi-token](https://unsloth.ai/docs/fr/modeles/mtp.md)
- [DiffusionGemma - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/diffusiongemma.md)
- [MiniMax M3 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/minimax-m3.md): Exécutez le LLM MiniMax M3 localement sur votre propre appareil !
- [Qwen3.5 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.5.md): Exécutez les nouveaux LLM Qwen3.5, y compris Medium : Qwen3.5-35B-A3B, 27B, 122B-A10B, et Small : Qwen3.5-0.8B, 2B, 4B, 9B et 397B-A17B sur votre appareil local !
- [Guide de fine-tuning Qwen3.5](https://unsloth.ai/docs/fr/modeles/qwen3.5/fine-tune.md): Découvrez comment fine-tuner les LLM Qwen3.5 avec Unsloth.
- [Benchmarks GGUF Qwen3.5](https://unsloth.ai/docs/fr/modeles/qwen3.5/gguf-benchmarks.md): Découvrez les performances des GGUF dynamiques Unsloth + analyse de la perplexité, de la divergence KL et de MXFP4.
- [Kimi K2.6 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k2.6.md): Guide pas à pas pour exécuter Kimi-K2.6 sur votre propre appareil local.
- [NVIDIA Nemotron 3 Ultra - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3-ultra.md): Exécutez Nemotron-3-Ultra-550B-A55B localement sur votre appareil !
- [NVIDIA Nemotron 3 Nano Omni - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3-nano-omni.md): Exécutez et fine-tunez Nemotron-3-Nano-Omni-30B-A3B localement sur votre appareil !
- [Mistral 3.5 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/mistral-3.5.md): Guide pour les modèles Mistral 3.5, à exécuter ou fine-tuner localement sur votre appareil
- [IBM Granite 4.1 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/ibm-granite-4.1.md): Exécutez IBM Granite-4.1 avec les GGUF Unsloth et découvrez comment fine-tuner !
- [GLM-5.1 - Comment exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.1.md): Exécutez le nouveau modèle GLM-5.1 de Z.ai sur votre propre appareil local !
- [Qwen3-Coder-Next : comment exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3-coder-next.md): Guide pour exécuter Qwen3-Coder-Next localement sur votre appareil !
- [NVIDIA Nemotron 3 Nano - Guide d'exécution](https://unsloth.ai/docs/fr/modeles/nemotron-3.md): Exécutez et fine-tunez NVIDIA Nemotron 3 Nano localement sur votre appareil !
- [NVIDIA Nemotron-3-Super : guide d'exécution](https://unsloth.ai/docs/fr/modeles/nemotron-3/nemotron-3-super.md): Exécutez et fine-tunez NVIDIA Nemotron-3-Super-120B-A12B localement sur votre appareil !
- [gpt-oss : guide d'exécution](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune.md): Exécutez et fine-tunez les nouveaux modèles open source d'OpenAI !
- [Apprentissage par renforcement gpt-oss](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/gpt-oss-reinforcement-learning.md)
- [Tutoriel : comment entraîner gpt-oss avec RL](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/gpt-oss-reinforcement-learning/tutorial-how-to-train-gpt-oss-with-rl.md): Apprenez à entraîner OpenAI gpt-oss avec GRPO pour battre automatiquement 2048 localement ou sur Colab.
- [Tutoriel : comment fine-tuner gpt-oss](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/tutorial-how-to-fine-tune-gpt-oss.md): Apprenez pas à pas à entraîner OpenAI gpt-oss localement avec Unsloth.
- [Entraînement gpt-oss à long contexte](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/long-context-gpt-oss-training.md)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://unsloth.ai/docs/fr/modeles.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
