> For the complete documentation index, see [llms.txt](https://unsloth.ai/docs/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://unsloth.ai/docs/fr/modeles.md).

# Modèles

- [Qwen3.8 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.8.md): Guide pour exécuter les quantifications Qwen3.8, y compris Qwen3.8-27B, sur votre configuration locale.
- [Guide d'affinage Qwen3.8](https://unsloth.ai/docs/fr/modeles/qwen3.8/train.md): Découvrez comment affiner Qwen3.8-27B avec Unsloth.
- [Qwen3.8-Flash-Next : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.8-next.md): Guide pour exécuter Qwen3.8-Flash-Next localement.
- [GLM-5.3-Flash : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.3-flash.md): Exécutez le nouveau modèle GLM-5.3-Flash, alias ox-alpha, de Z.ai.
- [DeepSeek-V4 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/deepseek-v4.md): Exécutez DeepSeek-V4-Pro-0813 et DeepSeek-V4-Flash-0731 localement sur votre propre appareil !
- [Tutoriels sur les grands modèles de langage (LLM)](https://unsloth.ai/docs/fr/modeles/tutorials.md)
- [Qwen3 - comment exécuter et affiner](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune.md): Apprenez à exécuter et affiner Qwen3 localement avec Unsloth + nos quantifications Dynamic 2.0
- [Qwen3-VL : guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune/qwen3-vl-how-to-run-and-fine-tune.md): Apprenez à affiner et exécuter Qwen3-VL localement avec Unsloth.
- [Qwen3-2507 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-how-to-run-and-fine-tune/qwen3-2507.md): Exécutez localement sur votre appareil les versions Thinking et Instruct de Qwen3-30B-A3B-2507 et 235B-A22B !
- [MiniMax-M2.7 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/minimax-m27.md): Exécutez le LLM MiniMax-M2.7 localement sur votre propre appareil !
- [GLM-5 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-5.md): Exécutez le nouveau modèle GLM-5 de Z.ai sur votre propre appareil local !
- [Kimi K2.5 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/kimi-k2.5.md): Guide pour exécuter Kimi-K2.5 sur votre propre appareil local !
- [GLM-4.7-Flash : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.7-flash.md): Exécutez et affinez GLM-4.7-Flash localement sur votre appareil !
- [Gemma 3 - guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/gemma-3-how-to-run-and-fine-tune.md): Comment exécuter efficacement Gemma 3 avec nos GGUF sur llama.cpp, Ollama, Open WebUI et comment l'affiner avec Unsloth !
- [Gemma 3n : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/gemma-3-how-to-run-and-fine-tune/gemma-3n-how-to-run-and-fine-tune.md): Exécutez le nouveau Gemma 3n de Google localement avec des GGUF Dynamic sur llama.cpp, Ollama, Open WebUI et affinez avec Unsloth !
- [Qwen3-Coder : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-coder-how-to-run-locally.md): Exécutez Qwen3-Coder-30B-A3B-Instruct et 480B-A35B localement avec les quantifications Dynamic d'Unsloth.
- [MiniMax-M2.5 : guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/minimax-m25.md): Exécutez MiniMax-M2.5 localement sur votre propre appareil !
- [DeepSeek-OCR 2 : guide pour exécuter et affiner](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-ocr-2.md): Guide sur la manière d'exécuter et d'affiner DeepSeek-OCR-2 localement.
- [GLM-4.7 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.7.md): Un guide sur la manière d'exécuter le modèle Z.ai GLM-4.7 sur votre propre appareil local !
- [Comment exécuter Qwen-Image-2512 localement dans ComfyUI](https://unsloth.ai/docs/fr/modeles/tutorials/qwen-image-2512.md): Tutoriel pas à pas pour exécuter Qwen-Image-2512 sur votre appareil local avec ComfyUI.
- [Tutoriel : exécuter Qwen-Image-2512 dans stable-diffusion.cpp](https://unsloth.ai/docs/fr/modeles/tutorials/qwen-image-2512/stable-diffusion.cpp.md): Tutoriel pour utiliser Qwen-Image-2512 dans stable-diffusion.cpp.
- [Devstral 2 - guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/devstral-2.md): Guide pour exécuter localement les modèles Mistral Devstral 2 : 123B-Instruct-2512 et Small-2-24B-Instruct-2512.
- [Ministral 3 - guide d'exécution](https://unsloth.ai/docs/fr/modeles/tutorials/ministral-3.md): Guide pour les modèles Mistral Ministral 3, pour les exécuter ou les affiner localement sur votre appareil
- [DeepSeek-OCR : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-ocr-how-to-run-and-fine-tune.md): Guide sur la manière d'exécuter et d'affiner DeepSeek-OCR localement.
- [Kimi K2 Thinking : guide pour exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/kimi-k2-thinking-how-to-run-locally.md): Guide pour exécuter Kimi-K2-Thinking et Kimi-K2 sur votre propre appareil local !
- [GLM-4.6 : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/glm-4.6-how-to-run-locally.md): Un guide sur la manière d'exécuter les modèles Z.ai GLM-4.6 et GLM-4.6V-Flash sur votre propre appareil local !
- [Qwen3-Next : guide d'exécution locale](https://unsloth.ai/docs/fr/modeles/tutorials/qwen3-next.md): Exécutez localement sur votre appareil les versions Thinking et Instruct de Qwen3-Next-80B-A3B !
- [FunctionGemma : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/functiongemma.md): Découvrez comment exécuter et affiner FunctionGemma localement sur votre appareil et votre téléphone.
- [DeepSeek-V3.1 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-v3.1-how-to-run-locally.md): Un guide sur la manière d'exécuter DeepSeek-V3.1 et Terminus sur votre propre appareil local !
- [DeepSeek-R1-0528 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-0528-how-to-run-locally.md): Un guide sur la manière d'exécuter DeepSeek-R1-0528, y compris Qwen3, sur votre propre appareil local !
- [Liquid LFM2.5 : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/lfm2.5.md): Exécutez et affinez LFM2.5 Instruct et Vision localement sur votre appareil !
- [Magistral : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/magistral-how-to-run-and-fine-tune.md): Découvrez Magistral - les nouveaux modèles de raisonnement de Mistral.
- [IBM Granite 4.0](https://unsloth.ai/docs/fr/modeles/tutorials/ibm-granite-4.0.md): Comment exécuter IBM Granite-4.0 avec les GGUF d'Unsloth sur llama.cpp, Ollama, et comment l'affiner !
- [Llama 4 : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/llama-4-how-to-run-and-fine-tune.md): Comment exécuter Llama 4 localement en utilisant nos GGUF dynamiques, qui récupèrent la précision par rapport à la quantification standard.
- [Grok 2](https://unsloth.ai/docs/fr/modeles/tutorials/grok-2.md): Exécutez le modèle Grok 2 de xAI localement !
- [Devstral : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/devstral-how-to-run-and-fine-tune.md): Exécutez et affinez Mistral Devstral 1.1, y compris Small-2507 et 2505.
- [Comment exécuter des LLM locaux avec Docker : guide pas à pas](https://unsloth.ai/docs/fr/modeles/tutorials/how-to-run-llms-with-docker.md): Découvrez comment exécuter des grands modèles de langage (LLM) avec Docker et Unsloth sur votre appareil local.
- [DeepSeek-V3-0324 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-v3-0324-how-to-run-locally.md): Comment exécuter DeepSeek-V3-0324 localement en utilisant nos quantifications dynamiques, qui récupèrent la précision
- [DeepSeek-R1 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-how-to-run-locally.md): Un guide sur la manière d'exécuter nos quantifications dynamiques 1,58 bit pour DeepSeek-R1 en utilisant llama.cpp.
- [DeepSeek-R1 dynamique 1,58 bit](https://unsloth.ai/docs/fr/modeles/tutorials/deepseek-r1-how-to-run-locally/deepseek-r1-dynamic-1.58-bit.md): Consultez les tableaux comparatifs de performances des quantifications Dynamic GGUF d'Unsloth par rapport aux quantifications IMatrix standard.
- [Phi-4 Reasoning : comment l'exécuter et l'affiner](https://unsloth.ai/docs/fr/modeles/tutorials/phi-4-reasoning-how-to-run-and-fine-tune.md): Apprenez à exécuter et affiner localement les modèles de raisonnement Phi-4 avec Unsloth + nos quantifications Dynamic 2.0
- [QwQ-32B : comment l'exécuter efficacement](https://unsloth.ai/docs/fr/modeles/tutorials/qwq-32b-how-to-run-effectively.md): Comment exécuter QwQ-32B efficacement avec nos correctifs et sans générations sans fin + GGUF.
- [Cogito v2.1 : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/tutorials/cogito-v2-how-to-run-locally.md): Les LLM Cogito v2.1 sont parmi les modèles ouverts les plus puissants au monde, entraînés avec l'IDA. La version v1 existe aussi en 4 tailles : 70B, 109B, 405B et 671B, ce qui vous permet de choisir la taille la mieux adaptée à votre matériel.
- [Gemma 4 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/gemma-4.md): Exécutez localement les nouveaux modèles Gemma 4 de Google, y compris E2B, E4B, 26B A4B et 31B.
- [Gemma 4 QAT](https://unsloth.ai/docs/fr/modeles/gemma-4/qat.md): Exécutez localement les modèles Gemma 4 QAT de Google, y compris E2B, E4B, 12B, 26B-A4B et 31B.
- [Guide d'affinage Gemma 4](https://unsloth.ai/docs/fr/modeles/gemma-4/train.md): Entraînez Gemma 4 de Google avec Unsloth.
- [GLM-5.3 - Comment l’exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.3.md): Exécutez le nouveau modèle GLM-5.3 de Z.ai.
- [Muse Glimmer - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/muse-glimmer.md): Découvrez comment exécuter le nouveau modèle Muse Glimmer 30B de Meta.
- [Guide d'affinage Muse Glimmer](https://unsloth.ai/docs/fr/modeles/muse-glimmer/train.md): Entraînez le modèle Muse Glimmer 30B de Meta avec Unsloth.
- [Inkling - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/inkling.md): Découvrez comment exécuter localement les modèles multimodaux Inkling de Thinking Machine Labs.
- [Qwen3.6 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.6.md): Exécutez localement les nouveaux modèles Qwen3.6-27B et 35B-A3B !
- [Kimi K3 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k3.md): Guide pour exécuter les quantifications Kimi K3 sur votre configuration locale.
- [GLM-5.2 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.2.md): Exécutez le nouveau modèle GLM-5.2 de Z.ai sur du matériel local !
- [Kimi K2.7 Code - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k2.7-code.md): Guide pas à pas pour exécuter Kimi K2.7 Code sur votre propre appareil local.
- [Comment exécuter les modèles MTP : guide de prédiction multi-token](https://unsloth.ai/docs/fr/modeles/mtp.md)
- [DiffusionGemma - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/diffusiongemma.md)
- [MiniMax M3 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/minimax-m3.md): Exécutez le LLM MiniMax M3 localement sur votre propre appareil !
- [Qwen3.5 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3.5.md): Exécutez les nouveaux LLM Qwen3.5, y compris Medium : Qwen3.5-35B-A3B, 27B, 122B-A10B, et Small : Qwen3.5-0.8B, 2B, 4B, 9B et 397B-A17B, sur votre appareil local !
- [Guide d'affinage Qwen3.5](https://unsloth.ai/docs/fr/modeles/qwen3.5/fine-tune.md): Découvrez comment affiner les LLM Qwen3.5 avec Unsloth.
- [Benchmarks GGUF Qwen3.5](https://unsloth.ai/docs/fr/modeles/qwen3.5/gguf-benchmarks.md): Découvrez les performances des GGUF dynamiques d'Unsloth + analyse de la perplexité, de la divergence KL et de MXFP4.
- [NVIDIA Nemotron 3.5 Lightning : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3.5.md)
- [Kimi K2.6 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/kimi-k2.6.md): Guide pas à pas pour exécuter Kimi-K2.6 sur votre propre appareil local.
- [NVIDIA Nemotron 3 Ultra - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3-ultra.md): Exécutez Nemotron-3-Ultra-550B-A55B localement sur votre appareil !
- [NVIDIA Nemotron 3 Nano Omni - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/nemotron-3-nano-omni.md): Exécutez et affinez Nemotron-3-Nano-Omni-30B-A3B localement sur votre appareil !
- [Mistral 3.5 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/mistral-3.5.md): Guide pour les modèles Mistral 3.5, pour les exécuter ou les affiner localement sur votre appareil
- [IBM Granite 4.1 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/ibm-granite-4.1.md): Exécutez IBM Granite-4.1 avec les GGUF d'Unsloth et découvrez comment l'affiner !
- [GLM-5.1 - comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/glm-5.1.md): Exécutez le nouveau modèle GLM-5.1 de Z.ai sur votre propre appareil local !
- [Qwen3-Coder-Next : comment l'exécuter localement](https://unsloth.ai/docs/fr/modeles/qwen3-coder-next.md): Guide pour exécuter Qwen3-Coder-Next localement sur votre appareil !
- [NVIDIA Nemotron 3 Nano - guide d'exécution](https://unsloth.ai/docs/fr/modeles/nemotron-3.md): Exécutez et affinez NVIDIA Nemotron 3 Nano localement sur votre appareil !
- [NVIDIA Nemotron-3-Super : guide d'exécution](https://unsloth.ai/docs/fr/modeles/nemotron-3/nemotron-3-super.md): Exécutez et affinez NVIDIA Nemotron-3-Super-120B-A12B localement sur votre appareil !
- [gpt-oss : guide d'exécution](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune.md): Exécutez et affinez les nouveaux modèles open source d'OpenAI !
- [Apprentissage par renforcement gpt-oss](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/gpt-oss-reinforcement-learning.md)
- [Tutoriel : comment entraîner gpt-oss avec RL](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/gpt-oss-reinforcement-learning/tutorial-how-to-train-gpt-oss-with-rl.md): Apprenez à entraîner OpenAI gpt-oss avec GRPO pour battre 2048 de manière autonome, localement ou sur Colab.
- [Tutoriel : comment affiner gpt-oss](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/tutorial-how-to-fine-tune-gpt-oss.md): Apprenez pas à pas comment entraîner OpenAI gpt-oss localement avec Unsloth.
- [Entraînement gpt-oss à long contexte](https://unsloth.ai/docs/fr/modeles/gpt-oss-how-to-run-and-fine-tune/long-context-gpt-oss-training.md)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://unsloth.ai/docs/fr/modeles.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
