> For the complete documentation index, see [llms.txt](https://docs.clore.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.clore.ai/guides/guides_v2-fr/readme.md).

# Introduction

> **205 guides pratiques** pour déployer des modèles d'IA, des charges de travail GPU et des plateformes d'IA sur [Clore.ai](https://clore.ai) — la place de marché décentralisée de location de GPU.

{% hint style="success" %}
Tous les exemples peuvent être exécutés sur des serveurs GPU loués via le [Marketplace Clore.ai](https://clore.ai/marketplace). Louez des GPU puissants auprès de **$0.03/hr**, facturé à la minute.
{% endhint %}

## Qu'est-ce que Clore.ai ?

[Clore.ai](https://clore.ai) est une place de marché GPU de pair à pair où vous louez des GPU directement auprès d'autres personnes — comme Airbnb pour le calcul. Des milliers de GPU sont disponibles 24h/24 et 7j/7, des RTX 3060 économiques aux H100 d'entreprise. Payez avec **CLORE**, **BTC**, **USDT**, ou **USDC**.

### Pourquoi Clore.ai pour l'IA ?

* **Abordable** — RTX 4090 à partir de 0,14 $/h (contre 1,50–3 $/h sur les grands clouds)
* **Aucun engagement** — location à l'heure, sans contrat
* **Accès root complet** — conteneurs Docker avec passthrough GPU
* **Large sélection de GPU** — plus de 2 200 serveurs, plus de 6 700 GPU répertoriés, environ 1 200 libres à tout moment
* **Payez comme vous voulez** — paiements en crypto (CLORE, BTC, USDT/USDC)

## 📚 Catégories de guides

| Catégorie                                                                                                            | Guides | Points forts                                                                                                                                                           |
| -------------------------------------------------------------------------------------------------------------------- | ------ | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| 🤖 [Modèles de langage](/guides/guides_v2-fr/modeles-de-langage/language-models.md)                                  | **53** | Qwen3.8-27B, GLM-5.2, MiniMax M3, Nemotron 3 Ultra, Mistral Small 4, Kimi K3, DeepSeek V4, MiMo-V2.5-Pro, Hy3 Preview, GLM-5.1, Llama 4, Gemma 3, Ollama, vLLM, SGLang |
| 🤖 [Plateformes d'IA et agents](/guides/guides_v2-fr/plateformes-ia-et-agents/ai-platforms.md)                       | **18** | Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent                                                                       |
| 🔊 [Audio et voix](/guides/guides_v2-fr/audio-et-voix/audio-voice.md)                                                | **23** | MOSS-TTS, Voxtral TTS, Whisper, Qwen3-TTS, MiniMax Speech 2.6, Dia, ChatTTS, Kokoro, Fish Speech, MeloTTS, StyleTTS2                                                   |
| 🎬 [Génération de vidéos](/guides/guides_v2-fr/generation-video/video-generation.md)                                 | **15** | LTX-2.5, Wan2.1, Wan 2.2 VBVR, FramePack, CubeComposer 4K 360°, LTX-2, CogVideoX, SkyReels, HunyuanVideo, Mochi-1, AnimateDiff                                         |
| 🎨 [Génération d'images](/guides/guides_v2-fr/generation-dimages/image-generation.md)                                | **11** | FLUX.2 Klein, HunyuanImage 3.0, SD 3.5, ComfyUI, InvokeAI, SD WebUI Forge                                                                                              |
| 🧠 [Entraînement](/guides/guides_v2-fr/entrainement/training.md)                                                     | **12** | Unsloth, Axolotl, LoRA, DreamBooth, DeepSpeed, LLaMA-Factory, TRL, LitGPT, Mergekit                                                                                    |
| 🏁 [Premiers pas](/guides/guides_v2-fr/premiers-pas/getting-started.md)                                              | **10** | Comparaison de GPU, tarification en direct, location partielle de GPU, compatibilité CUDA, FAQ, dépannage                                                              |
| 👁️ [Modèles de vision](/guides/guides_v2-fr/modeles-de-vision/vision-models.md)                                     | **6**  | Qwen2.5-VL, SAM2, LLaVA, Florence-2                                                                                                                                    |
| 🖼️ [Traitement d'images](/guides/guides_v2-fr/traitement-dimages/image-processing.md)                               | **6**  | Real-ESRGAN, ControlNet, Depth Anything, ICLight                                                                                                                       |
| 🧊 [Génération 3D](/guides/guides_v2-fr/generation-3d/3d-generation.md)                                              | **6**  | Hunyuan World 2.0, TRELLIS, Hunyuan3D 2.1, TripoSR, Gaussian Splatting, Nerfstudio                                                                                     |
| 🎭 [Visages parlants](/guides/guides_v2-fr/tetes-parlantes/talking-heads.md)                                         | **3**  | LivePortrait, SadTalker, Wav2Lip                                                                                                                                       |
| 👤 [Visage et identité](/guides/guides_v2-fr/visage-et-identite/face-identity.md)                                    | **3**  | FaceFusion, InstantID, IP-Adapter                                                                                                                                      |
| ⚙️ [Avancé](/guides/guides_v2-fr/avance/advanced.md)                                                                 | **5**  | Multi-GPU, intégration d'API, traitement par lots                                                                                                                      |
| 🔧 [Autres charges de travail](/guides/guides_v2-fr/autres-charges-de-travail/other-workloads.md)                    | **3**  | Blender, Kandinsky, OpenClaw                                                                                                                                           |
| 💻 [Outils de codage IA](/guides/guides_v2-fr/outils-de-codage-ia/ai-coding.md)                                      | **2**  | Aider, TabbyML (Copilot auto-hébergé)                                                                                                                                  |
| 📊 [Comparaisons](/guides/guides_v2-fr/comparaisons/comparisons.md)                                                  | **7**  | Service de LLM, fine-tuning, génération vidéo, TTS, frameworks RAG, bases de données vectorielles                                                                      |
| 📹 [Traitement vidéo](/guides/guides_v2-fr/traitement-video/video-processing.md)                                     | **2**  | FFmpeg NVENC, interpolation RIFE                                                                                                                                       |
| 🎵 [Génération de musique](/guides/guides_v2-fr/generation-musicale/music-generation.md)                             | **1**  | ACE-Step (alternative open source à Suno)                                                                                                                              |
| 🔍 [Vision par ordinateur](/guides/guides_v2-fr/vision-par-ordinateur/computer-vision.md)                            | **2**  | Détection YOLOv9/v10                                                                                                                                                   |
| 🗄️ [RAG / bases de données vectorielles](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/rag-vectordb.md) | **6**  | LlamaIndex, RAGFlow, ChromaDB, Qdrant, Milvus, Weaviate                                                                                                                |
| 🔄 [MLOps](/guides/guides_v2-fr/mlops-et-deploiement/mlops.md)                                                       | **4**  | MLflow, Triton Inference Server, BentoML, ClearML                                                                                                                      |
| ⚡ [DevOps GPU](/guides/guides_v2-fr/devops-gpu/devops-gpu.md)                                                        | **2**  | TensorRT-LLM, ONNX Runtime                                                                                                                                             |
| 🔬 [Science](/guides/guides_v2-fr/science-et-recherche/science.md)                                                   | **3**  | AlphaFold2, ESMFold, dynamique moléculaire GROMACS                                                                                                                     |
| 🎮 [Jeux vidéo / streaming](/guides/guides_v2-fr/jeux-video-et-streaming/gaming-streaming.md)                        | **1**  | Jeu à distance Sunshine + Moonlight                                                                                                                                    |
| ₿ [Minage de cryptomonnaies](/guides/guides_v2-fr/crypto-et-minage/crypto-mining.md)                                 | **1**  | Minage CPU/GPU avec XMRig                                                                                                                                              |

## 🔥 Quoi de neuf (août 2026)

### Récapitulatif de mise à jour — 24 août 2026

Neuf nouveaux guides couvrant tout ce qui a été publié en poids ouverts entre mai et août, ainsi qu'une vérification de cohérence sur toute la collection : les images de base correspondent désormais à la flotte actuelle de GPU, et chaque prix est tiré de la place de marché en direct plutôt que d'un instantané vieux de plusieurs mois.

**Nouveaux guides sur les modèles**

* 🤖 **Qwen3.8-27B** 🆕 — le modèle dense vision-langage 27B d'Alibaba (14 août, **Apache 2.0**). Contexte natif de 262 k extensible à 1 M, attention hybride Gated DeltaNet, 15,4 Go en Q4. Le seul modèle de classe frontier qui tourne sur une seule RTX 4090 — [guide](/guides/guides_v2-fr/modeles-de-langage/qwen38-27b.md)
* 🤖 **GLM-5.2** 🆕 — le MoE d'environ 750B/40B actifs de Z.ai (13 juin, **MIT**). Terminal-Bench 2.1 81,0, SWE-bench Pro 62,1, contexte solide d'1 M via l'attention clairsemée IndexShare. Fonctionne en Q2 sur une configuration de 10× RTX 5090 — [guide](/guides/guides_v2-fr/modeles-de-langage/glm-5-2.md)
* 🤖 **MiniMax M3** 🆕 — MoE multimodal natif 428B/23B actifs (1er juin). MiniMax Sparse Attention réduit le calcul par jeton à 1 M de contexte à environ 1/20 de GQA — [guide](/guides/guides_v2-fr/modeles-de-langage/minimax-m3.md)
* 🤖 **NVIDIA Nemotron 3 Ultra** 🆕 — hybride Mamba-2 + MoE 550B/55B actifs (4 juin, **OpenMDW-1.1**: poids, données, recette et environnement RL). La version NVFP4 officielle tient sur une configuration de 4× RTX PRO 6000 — [guide](/guides/guides_v2-fr/modeles-de-langage/nemotron-3-ultra.md)
* 🤖 **Mistral Small 4** 🆕 — 119B au total, seulement **6,5B actifs**, Apache 2.0, contexte 256 k, vision et un commutateur de raisonnement. 40 Go en Q2, donc deux RTX 4090 le font tourner — [guide](/guides/guides_v2-fr/modeles-de-langage/mistral-small4.md)
* 🤖 **Kimi K3** 🆕 — le modèle frontier à poids ouverts 2,8T de Moonshot (poids du 27 juillet). La vérité : il ne tient sur aucune configuration de la place de marché, à aucun niveau de quantification, et voici quoi exécuter à la place — [guide](/guides/guides_v2-fr/modeles-de-langage/kimi-k3.md)
* 🎬 **LTX-2.5** 🆕 — modèle vidéo à poids ouverts de 22B avec audio synchronisé (11 août), prise en charge de ComfyUI dès le premier jour, de 720p à 4K. La recommandation officielle est 32 Go de VRAM, ce qui correspond exactement à une RTX 5090 — [guide](/guides/guides_v2-fr/generation-video/ltx-video-2-5.md)

**Nouveaux guides de plateforme**

* 🏁 **Location partielle de GPU** 🆕 — retirez 1 ou 2 GPU d'une configuration à 8 GPU et payez proportionnellement. Pris en charge sur 60 % des serveurs listés, 2 153 emplacements GPU individuels libres lors du dernier instantané — [guide](/guides/guides_v2-fr/premiers-pas/partial-gpu-rental.md)
* 🏁 **Compatibilité CUDA et PyTorch** 🆕 — la série RTX 50 nécessite CUDA 12.8+ et PyTorch 2.7+, la Tesla V100 a perdu la prise en charge cu128 dans PyTorch 2.11, CUDA 13 commence à partir de Turing. La matrice, par génération de carte — [guide](/guides/guides_v2-fr/premiers-pas/cuda-pytorch-compatibility.md)

**Mis à jour**

* **DeepSeek V4** — les deux niveaux ont été actualisés : Flash-0731 (31 juillet, 167 Go FP8, décodage spéculatif DSpark) dépasse l'aperçu Pro d'avril sur les propres benchmarks de DeepSeek ; Pro-0813 est arrivé le 13 août — [guide](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md)
* **Chatterbox TTS** — Multilingual V3 est désormais le checkpoint recommandé — [guide](/guides/guides_v2-fr/audio-et-voix/chatterbox-tts.md)
* **Chaque guide** — les images de base sont passées à CUDA 12.8 / PyTorch 2.11 afin de fonctionner sur les cartes Blackwell, les prix ont été recalculés à partir de la place de marché en direct, et les charges de travail ne sont plus dimensionnées par rapport aux A100/H200/B200, qui ne sont pas listées sur la place de marché

#### Notes de l'industrie (mai–août 2026)

*Fermé, accessible uniquement via API, ou trop volumineux pour être auto-hébergé ici — avec ce qu'il faut exécuter à la place.*

* **GLM-5.3** (Z.ai, 14 août) — API et plan de codage uniquement ; Z.ai indique que les poids suivront par étapes après examen de sécurité. → À exécuter aujourd'hui : [GLM-5.2](/guides/guides_v2-fr/modeles-de-langage/glm-5-2.md)
* **Qwen3.8-Max** (Alibaba, août) — les poids 2,4T/95B actifs sont téléchargeables, mais sous une licence personnalisée avec une clause de chiffre d'affaires de 50 M$, et aucune configuration de la place de marché ne peut les contenir. → [Qwen3.8-27B](/guides/guides_v2-fr/modeles-de-langage/qwen38-27b.md) est sous Apache 2.0 et tient sur une seule carte
* **Qwen-Image-3.0** et **Qwen-Audio-3.0-TTS** (Alibaba, juillet) — API uniquement, aucun poids publié. → Auto-héberger : [FLUX.2 Klein](/guides/guides_v2-fr/generation-dimages/flux2-klein.md), [HunyuanImage 3.0](/guides/guides_v2-fr/generation-dimages/hunyuan-image3.md), [Qwen3-TTS](/guides/guides_v2-fr/audio-et-voix/qwen3-tts.md)
* **Kimi K3** — poids ouverts, mais 466 Go à la plus petite quantification. → Voir [guide](/guides/guides_v2-fr/modeles-de-langage/kimi-k3.md) pour les alternatives

## 🔥 Quoi de neuf (avril 2026)

### Semaine du 27 avril 2026 — 6 nouveaux guides

* 🤖 **DeepSeek V4** 🆕 — le MoE frontier a enfin été publié le 22 avril avec des poids entièrement ouverts sous licence MIT. Pro : 1,6T au total / 49B actifs, contexte 1 M. Flash : 284B / 13B actifs, fonctionne quantifié sur un seul GPU de 80 Go. Prise en charge vLLM et SGLang dès le premier jour — [guide](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md)
* 🤖 **MiMo-V2.5-Pro** 🆕 — premier niveau Pro à poids ouverts de Xiaomi (27 avril). MoE 1,02T / 42B actifs, contexte 1 M, MIT, natif FP8. Attention hybride 6:1 + MTP en 3 étapes — [guide](/guides/guides_v2-fr/modeles-de-langage/mimo-v25-pro.md)
* 🤖 **Hy3 Preview** 🆕 — Tencent Hunyuan 3 (23 avril). MoE 295B / 21B actifs, contexte 256 k, axé sur les agents et le raisonnement. Un seul nœud 4× A100 80 Go le sert en FP8 — [guide](/guides/guides_v2-fr/modeles-de-langage/hy3-preview.md)
* 🤖 **Ling-2.6-flash** 🆕 — Ant Group inclusionAI (28 avril). MoE 104B / 7,4B actifs, optimisé pour les agents. Tient sur une seule RTX 4090 en INT4 ou une seule H100 en FP8 — [guide](/guides/guides_v2-fr/modeles-de-langage/ling-26-flash.md)
* 🤖 **Qwen3.6-27B** 🆕 — le 27B dense d'Alibaba (21 avril). Apache 2.0, contexte 262 k (extensible à 1 M avec YaRN). Le LLM de codage « une seule carte qui fonctionne tout simplement » — [guide](/guides/guides_v2-fr/modeles-de-langage/qwen36-27b.md)
* 🤖 **MiniMax M2.7** 🆕 — modèle de codage MoE 229B (9 avril). Licence MiniMax personnalisée, natif FP8. Précédemment répertorié comme propriétaire — les poids ouverts sont désormais publics — [guide](/guides/guides_v2-fr/modeles-de-langage/minimax-m27.md)

#### Notes de l'industrie (21–29 avril 2026)

*Source fermée ou API uniquement pendant cette période — alternatives auto-hébergées liées.*

* **Claude Opus 4.7** (Anthropic, 16 avril) — poids fermés. → Alternatives auto-hébergées : [DeepSeek V4](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md), [MiMo-V2.5-Pro](/guides/guides_v2-fr/modeles-de-langage/mimo-v25-pro.md), [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md)
* **GPT-5.5 / GPT-5.5 Pro** (OpenAI, 23 avril) — fermé, API uniquement. → Alternatives auto-hébergées : [DeepSeek V4](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md), [MiMo-V2.5-Pro](/guides/guides_v2-fr/modeles-de-langage/mimo-v25-pro.md)
* **Wan 2.7** (Alibaba) — les poids ouverts sont toujours attendus au T2 2026. Wan 2.5 a rompu la tradition et est resté fermé ; considérez 2.7 avec scepticisme. → Auto-héberger aujourd'hui : [Wan 2.2 VBVR](/guides/guides_v2-fr/generation-video/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-fr/generation-video/wan-video.md), [LTX-2](/guides/guides_v2-fr/generation-video/ltx-video-2.md)
* **Qwen3.6-Plus** (Alibaba) — agent de codage à contexte 1 M, API uniquement sur OpenRouter. → Alternative auto-hébergée : [Qwen3.6-27B](/guides/guides_v2-fr/modeles-de-langage/qwen36-27b.md), [Qwen3.5-Omni](/guides/guides_v2-fr/modeles-de-langage/qwen35-omni.md)
* **Hugging Face ml-intern** (21 avril) — agent autonome open source de post-entraînement (recherche → jeu de données → entraînement). On surveille l'adoption avant d'ajouter un guide complet. → Utiliser aujourd'hui : [Unsloth](/guides/guides_v2-fr/entrainement/unsloth-finetune.md), [LLaMA-Factory](/guides/guides_v2-fr/entrainement/llama-factory.md), [Axolotl](/guides/guides_v2-fr/entrainement/axolotl-training.md)

### Semaine du 20 avril 2026 — 3 nouveaux guides

* 🧊 **Hunyuan World 2.0** 🆕 — premier modèle 3D du monde open source de Tencent. Texte/image/vidéo → maillage modifiable + Gaussian Splatting 3D pour Unity/Unreal/Blender. \~1,2B de paramètres BF16, 12–24 Go de VRAM — [guide](/guides/guides_v2-fr/generation-3d/hunyuan-world-2.md)
* 🤖 **GLM-5.1** 🆕 — le poids lourd du codage MoE 744B / 40B actifs de Zhipu AI. Contexte 200 k, licence MIT, n°1 sur SWE-Bench Pro (58,4 %) devant Claude Opus 4.6 et GPT-5.4 — [guide](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md)
* 🔊 **MOSS-TTS** 🆕 — TTS ultra-léger OpenMOSS à 100M de paramètres. Stéréo 48 kHz, 20 langues, inférence uniquement sur CPU (aucun GPU requis), clonage vocal zero-shot, Apache 2.0 — [guide](/guides/guides_v2-fr/audio-et-voix/moss-tts.md)

#### Notes de l'industrie (13–20 avril 2026)

*Lancements à source fermée ou API uniquement cette semaine — pas encore auto-hébergeables sur Clore. Pour chacun, nous avons lié l'alternative à poids ouverts la plus proche que vous pouvez exécuter sur Clore aujourd'hui.*

* **Alibaba Happy Oyster** — modèle 3D interactif en temps réel (modes Roaming + Directing). Liste d'attente / bêta fermée. → Alternative auto-hébergée : [Hunyuan World 2.0](/guides/guides_v2-fr/generation-3d/hunyuan-world-2.md)
* **ByteDance Seedance 2.0 API** — entièrement ouvert le 14 avril sur Volcano Engine, API uniquement. → Alternatives auto-hébergées : [Wan 2.2 VBVR](/guides/guides_v2-fr/generation-video/wan22-vbvr.md), [LTX-2](/guides/guides_v2-fr/generation-video/ltx-video-2.md)
* **Qwen 3.6-Plus** — agent de codage propriétaire d'Alibaba à contexte 1 M. API uniquement. → Alternatives auto-hébergées : [Qwen3.5-Omni](/guides/guides_v2-fr/modeles-de-langage/qwen35-omni.md), [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md)
* **Meta Muse Spark** — premier modèle propriétaire de Meta après Llama. → Alternative auto-hébergée : [Llama 4](/guides/guides_v2-fr/modeles-de-langage/llama4.md)
* **Wan 2.7** — les poids ouverts sont toujours attendus au T2 2026 (actuellement API uniquement via Together AI). → Auto-héberger aujourd'hui : [Wan 2.2 VBVR](/guides/guides_v2-fr/generation-video/wan22-vbvr.md)

### Semaine du 13 avril 2026 — 2 nouveaux guides

* 🤖 **Qwen3.5-Omni** 🆕 — le modèle multimodal unifié d'Alibaba : compréhension du texte, de l'audio, de l'image et de la vidéo + génération de texte et de parole dans un seul MoE 30B. L'INT4 tient dans 24 Go de VRAM. Apache 2.0 — [guide](/guides/guides_v2-fr/modeles-de-langage/qwen35-omni.md)
* 🎬 **Wan 2.2 VBVR** 🆕 — référence vidéo à partir de vidéo pour un contrôle cohérent du mouvement. Utilisez un clip de référence pour piloter l'animation dans une nouvelle génération vidéo. FP8 fonctionne sur RTX 3090 (16–24 Go). Workflow ComfyUI inclus — [guide](/guides/guides_v2-fr/generation-video/wan22-vbvr.md)

#### Notes de l'industrie (6–13 avril 2026)

*API uniquement ou poids ouverts en attente — alternatives auto-hébergées liées.*

* **Wan 2.7** (Alibaba) — génération de première et dernière image, édition vidéo-à-vidéo, référencement du sujet. Poids ouverts attendus à la mi-T2 2026. → Auto-héberger aujourd'hui : [Wan 2.2 VBVR](/guides/guides_v2-fr/generation-video/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-fr/generation-video/wan-video.md)
* **Qwen3.6-Plus** (Alibaba) — fenêtre de contexte de 1 M, codage agentique. Publication à poids ouverts en attente. → Alternatives auto-hébergées : [Qwen3.5](/guides/guides_v2-fr/modeles-de-langage/qwen35.md), [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md)
* **LTX 2.3** — nouveau modèle de génération vidéo LTX, 22B de paramètres, base de 32 Go de VRAM. → Utiliser la version ouverte actuelle : [LTX-2](/guides/guides_v2-fr/generation-video/ltx-video-2.md)

## 🔥 Quoi de neuf (mars 2026)

### Semaine du 30 mars 2026 — 1 nouveau guide

* 🔊 **Voxtral TTS** 🆕 — modèle TTS 4B à poids ouverts de Mistral, 9 langues, clonage vocal zero-shot à partir d'une référence de 3 s, seulement 3 Go de VRAM, Apache 2.0 — [guide](/guides/guides_v2-fr/audio-et-voix/voxtral-tts.md)

#### Notes de l'industrie (23–30 mars)

*API uniquement / arrêté — alternatives auto-hébergées liées.*

* **Seedance 2.0** (ByteDance) — génération vidéo de nouvelle génération lancée dans CapCut/Dreamina. API uniquement. → Alternatives auto-hébergées : [Wan2.1](/guides/guides_v2-fr/generation-video/wan-video.md), [LTX-2](/guides/guides_v2-fr/generation-video/ltx-video-2.md)
* **Google Lyria 3 Pro** — génération musicale via l'API Gemini/Vertex AI. API uniquement. → Alternative auto-hébergée : [ACE-Step](/guides/guides_v2-fr/generation-musicale/ace-step.md)
* **Gemini 3 Deep Think** — modèle de raisonnement frontier de Google, API uniquement. → Alternatives auto-hébergées : [DeepSeek-R1](/guides/guides_v2-fr/modeles-de-langage/deepseek-r1.md), [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md)
* **Fermeture de Sora** — OpenAI a officiellement arrêté l'application de génération vidéo Sora. → Alternative auto-hébergée : [OpenSora](/guides/guides_v2-fr/generation-video/opensora.md)
* **DeepSeek V4** ✅ — publié le 22 avril 2026 avec des poids entièrement ouverts (MIT). Voir [le guide mis à jour](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md).

### Semaine du 16 mars 2026 — 3 nouveaux guides

* 🤖 **NVIDIA Nemotron 3 Super** 🆕 — MoE 120B / 12B actifs, débit x5, contexte 1 M, Apache 2.0, conçu pour l'IA agentique — [guide](/guides/guides_v2-fr/modeles-de-langage/nvidia-nemotron-3-super.md)
* 🌐 **Gemini 3.1 Flash Lite** 🆕 — le modèle le moins cher/le plus rapide de Google (3 mars 2026), API + alternatives open source — [guide](/guides/guides_v2-fr/modeles-de-langage/gemini-3-1-flash-lite.md)
* 🎬 **CubeComposer 4K 360° Video** 🆕 — premier modèle à générer nativement une vidéo panoramique 4K à 360° à partir de séquences standard (CVPR 2026) — [guide](/guides/guides_v2-fr/generation-video/cubecomposer-360-video.md)

### Aussi cette semaine (9–16 mars 2026)

* **GPT-5.4** — publié le 5 mars 2026 ; utilisation native de l'ordinateur (75,0 % OSWorld), contexte 1 M. API uniquement, aucun déploiement local. → Alternatives auto-hébergées : [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md), [DeepSeek-R1](/guides/guides_v2-fr/modeles-de-langage/deepseek-r1.md)
* **DeepSeek V4** ✅ — publié le 22 avril 2026, MIT, 1,6T-Pro / 284B-Flash. [Guide](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md).
* **Wan 2.2** — nouvelle version du modèle de fondation de génération vidéo Wan. → Auto-héberger : [Wan 2.2 VBVR](/guides/guides_v2-fr/generation-video/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-fr/generation-video/wan-video.md)

### Nouveauté en mars 2026 — 6 nouvelles catégories, 57 nouveaux guides

* 🗄️ **RAG / bases de données vectorielles** — 6 guides : [LlamaIndex](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/llamaindex.md), [RAGFlow](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/ragflow.md), [ChromaDB](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/chromadb.md), [Qdrant](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/qdrant.md), [Milvus](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/milvus.md), [Weaviate](/guides/guides_v2-fr/rag-et-bases-de-donnees-vectorielles/weaviate.md)
* 🔄 **MLOps** — 4 guides : [MLflow](/guides/guides_v2-fr/mlops-et-deploiement/mlflow.md), [Triton Inference Server](/guides/guides_v2-fr/mlops-et-deploiement/triton-inference-server.md), [BentoML](/guides/guides_v2-fr/mlops-et-deploiement/bentoml.md), [ClearML](/guides/guides_v2-fr/mlops-et-deploiement/clearml.md)
* ⚡ **DevOps GPU** — 2 guides : [TensorRT-LLM](/guides/guides_v2-fr/devops-gpu/tensorrt-llm.md), [ONNX Runtime](/guides/guides_v2-fr/devops-gpu/onnx-runtime.md)
* 🔬 **Science** — 3 guides : [AlphaFold2](/guides/guides_v2-fr/science-et-recherche/alphafold2.md), [ESMFold](/guides/guides_v2-fr/science-et-recherche/esmfold.md), [GROMACS](/guides/guides_v2-fr/science-et-recherche/gromacs.md) dynamique moléculaire
* 🎮 **Jeux vidéo / streaming** — [Sunshine + Moonlight](/guides/guides_v2-fr/jeux-video-et-streaming/sunshine-moonlight.md) Jeu à distance accéléré par GPU
* ₿ **Minage de cryptomonnaies** — [XMRig](/guides/guides_v2-fr/crypto-et-minage/xmrig.md) Minage CPU/GPU sur Clore.ai

### Derniers modèles ajoutés (4 mars 2026)

* **DeepSeek V4** ✅ — MoE 1,6T-Pro / 284B-Flash, licence MIT, **publié le 22 avril 2026** — [guide](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md)
* **MiniMax Speech 2.6** 🆕 — TTS à latence ultra-faible pour agents vocaux, TTFB < 300 ms — [guide](/guides/guides_v2-fr/audio-et-voix/minimax-speech.md)
* **SGLang** 🆕 — RadixAttention pour le partage du cache KV, débit 2 à 5× supérieur à vLLM sur MoE — [guide](/guides/guides_v2-fr/modeles-de-langage/sglang.md)
* **TGI** 🆕 — service de LLM de production de Hugging Face avec Flash Attention 2 + PagedAttention — [guide](/guides/guides_v2-fr/modeles-de-langage/tgi.md)
* **LLaMA-Factory** 🆕 — affinez plus de 100 LLM avec WebUI, LoRA/QLoRA, RLHF — [guide](/guides/guides_v2-fr/entrainement/llama-factory.md)
* **Fish Speech** 🆕 — clonage vocal zero-shot dans plus de 8 langues à partir d'un audio de référence de 10 à 15 s — [guide](/guides/guides_v2-fr/audio-et-voix/fish-speech.md)
* **Mochi-1** 🆕 — diffusion vidéo de 10B de paramètres, 848×480 à 30 ips, 24 Go de VRAM — [guide](/guides/guides_v2-fr/generation-video/mochi-1.md)

### Ajouté précédemment (février 2026)

* **Qwen3.5** — MoE 397B d'Alibaba, a surpassé Claude 4.5 Opus en mathématiques
* **GLM-5** — MoE 744B de Zhipu AI, licence MIT, n°1 des classements open source
* **Ling-2.5-1T** — modèle d'un trillion de paramètres d'Ant Group avec attention linéaire
* **Kimi K2.5** — MoE 1T de Moonshot AI, licence MIT, agentique visuel
* **Mistral Large 3** — MoE 675B, Apache 2.0, codage et raisonnement de pointe
* **Llama 4 Scout/Maverick** — la révolution MoE de Meta, fenêtre de contexte 10 M
* **Gemma 3** — le 27B de Google qui bat des modèles 405B
* **FLUX.2 Klein** — génération d'images en moins d'une seconde (< 0,5 s sur RTX 4090)
* **HunyuanImage 3.0** — MoE 80B, le plus grand modèle d'images open source
* **ACE-Step 1.5** — génération complète de chansons avec moins de 4 Go de VRAM
* **FramePack** — vidéo IA avec seulement 6 Go de VRAM
* **Qwen3-TTS** — clonage vocal dans plus de 10 langues à partir de 3 secondes d'audio
* **Kani-TTS-2** — TTS ultra-léger, seulement 3 Go de VRAM
* **DeepSeek-R1** — modèle de raisonnement au niveau d'OpenAI o1

### Catégories ajoutées précédemment (février 2026)

* 🤖 **Plateformes d'IA et agents** — 18 guides : Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent
* 🎵 **Génération de musique** — chansons composées par IA avec voix (ACE-Step)
* 💻 **Outils de codage IA** — alternatives Copilot auto-hébergées (Aider, TabbyML)
* 🔧 **OpenClaw sur Clore** — faites fonctionner votre assistant IA 24h/24 et 7j/7 sur des GPU loués

## 💰 Tarifs des GPU (août 2026)

> Instantané en direct de la place de marché Clore.ai, **24 août 2026**: 2 202 serveurs / 6 791 GPU répertoriés, 1 198 serveurs libres. Les prix sont **par GPU et par heure**, à la demande, facturé à la minute. Les plages correspondent aux 10e–90e percentiles des serveurs qui étaient libres au moment de l’instantané. Détail complet : [Tarifs et disponibilité des GPU](/guides/guides_v2-fr/premiers-pas/pricing.md).

| GPU                    | VRAM      | $/GPU/hr                                  | Idéal pour                                                       | Page d’accueil                                                                                                                   |
| ---------------------- | --------- | ----------------------------------------- | ---------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------- |
| RTX 3060               | 12 Go     | $0.03–0.07                                | TTS, petits modèles, génération de musique                       | —                                                                                                                                |
| RTX 3070               | 8 Go      | $0.03–0.09                                | Modèles 7B, Whisper, inférence par lots                          | [Louer](https://clore.ai/rent-3070.html) / [Héberger](https://clore.ai/host-3070.html)                                           |
| RTX 3080               | 10GB      | $0.05–0.19                                | Modèles 7B–14B, génération d’images                              | [Louer](https://clore.ai/rent-3080.html) / [Héberger](https://clore.ai/host-3080.html)                                           |
| RTX 3090               | 24GB      | $0.07–0.21                                | SDXL, 27B Q4, meilleur rapport qualité-prix par Go               | [Louer](https://clore.ai/rent-3090.html) / [Héberger](https://clore.ai/host-3090.html)                                           |
| RTX 4070 Ti            | 12 Go     | $0.07–0.25                                | SDXL, ComfyUI, modèles 7B                                        | [Louer](https://clore.ai/rent-4070-ti.html)                                                                                      |
| RTX 4080               | 16 Go     | $0.09–0.17                                | FLUX, modèles 14B, fine-tuning                                   | [Louer](https://clore.ai/rent-4080.html)                                                                                         |
| RTX 4090               | 24GB      | $0.14–0.42                                | FLUX, Qwen3.8-27B Q4, Mistral Small 4 Q2                         | [Louer](https://clore.ai/rent-4090.html) / [Héberger](https://clore.ai/host-4090.html)                                           |
| RTX 5070 Ti            | 16 Go     | $0.10–0.25                                | Blackwell FP4, SDXL, modèles 14B                                 | —                                                                                                                                |
| RTX 5080               | 16 Go     | $0.12–0.62                                | FLUX rapide, 14B–30B quantifiés                                  | [Louer](https://clore.ai/rent-5080.html)                                                                                         |
| RTX 5090               | 32 Go     | $0.25–0.77                                | Qwen3.8-27B FP8, vidéo LTX-2.5, 70B Q4                           | [Louer](https://clore.ai/rent-5090.html) / [Héberger](https://clore.ai/host-5090.html)                                           |
| RTX PRO 6000 Blackwell | 96GB      | $0.92–1.38                                | 70B BF16 sur une seule carte, 4× rigs = 380 Go                   | —                                                                                                                                |
| Tesla V100 SXM2        | 32 Go     | $0.05–0.06                                | Rigs 8 GPU bon marché, 256 Go au total                           | —                                                                                                                                |
| H100 NVL               | 94GB      | \~$1.04                                   | Inférence de pointe — seulement 4 sur la place de marché         | [Louer](https://clore.ai/rent-h100.html)                                                                                         |
| A100 / H200 / B200     | 80–192 Go | [bare metal](https://clore.ai/bare-metal) | Non répertorié sur la place de marché ; nœuds dédiés sur demande | [A100](https://clore.ai/rent-a100-80gb.html) / [H200](https://clore.ai/rent-h200.html) / [B200](https://clore.ai/rent-b200.html) |

**Spot vs à la demande :** Le spot n’est pas automatiquement moins cher. Dans le même instantané, 63 % des serveurs affichaient un prix spot exactement égal au prix à la demande ; lorsqu’une remise existait, la médiane était d’environ 13 %.

**Location partielle de GPU :** 60 % des serveurs listés (1 331 sur 2 202) vous permettent de louer 1 à 2 GPU d’un rig plus grand et de ne payer que ceux-ci. Voir [Location partielle de GPU](/guides/guides_v2-fr/premiers-pas/partial-gpu-rental.md).

*Vous cherchez à monétiser des GPU inactifs ? Consultez les* [*pages d’hébergement*](https://clore.ai/llms.txt) *pour des estimations de revenus mensuels par type de carte.*

## 🚀 Démarrage rapide

Nouveau sur Clore.ai ? → [**Guide de démarrage rapide**](/guides/guides_v2-fr/quickstart.md)

Vous savez déjà ce qu’il vous faut ?

| Je veux...                                         | Commencez ici                                                                                                                                                                                                     |
| -------------------------------------------------- | ----------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| Discuter avec l’IA en local                        | [Guide Ollama](/guides/guides_v2-fr/modeles-de-langage/ollama.md)                                                                                                                                                 |
| Faire fonctionner un LLM de codage de pointe       | [DeepSeek V4](/guides/guides_v2-fr/modeles-de-langage/deepseek-v4.md), [GLM-5.1](/guides/guides_v2-fr/modeles-de-langage/glm-5-1.md), ou [MiMo-V2.5-Pro](/guides/guides_v2-fr/modeles-de-langage/mimo-v25-pro.md) |
| Faire fonctionner un LLM de codage sur un seul GPU | [Qwen3.6-27B](/guides/guides_v2-fr/modeles-de-langage/qwen36-27b.md) (RTX 4090 Q4) ou [Ling-2.6-flash](/guides/guides_v2-fr/modeles-de-langage/ling-26-flash.md)                                                  |
| Générer des images                                 | [FLUX.2 Klein](/guides/guides_v2-fr/generation-dimages/flux2-klein.md) ou [ComfyUI](/guides/guides_v2-fr/generation-dimages/comfyui.md)                                                                           |
| Générer des vidéos                                 | [FramePack](/guides/guides_v2-fr/generation-video/framepack.md) (6 Go !) ou [Wan2.1](/guides/guides_v2-fr/generation-video/wan-video.md)                                                                          |
| Cloner une voix                                    | [Voxtral TTS](/guides/guides_v2-fr/audio-et-voix/voxtral-tts.md), [Qwen3-TTS](/guides/guides_v2-fr/audio-et-voix/qwen3-tts.md), ou [Zonos](/guides/guides_v2-fr/audio-et-voix/zonos-tts.md)                       |
| Transcrire l’audio                                 | [WhisperX](/guides/guides_v2-fr/audio-et-voix/whisperx.md)                                                                                                                                                        |
| Affiner un modèle                                  | [Unsloth](/guides/guides_v2-fr/entrainement/unsloth-finetune.md) (2× plus rapide, 70 % de VRAM en moins)                                                                                                          |
| Générer de la musique                              | [ACE-Step](/guides/guides_v2-fr/generation-musicale/ace-step.md) (< 4 Go de VRAM !)                                                                                                                               |
| Héberger soi-même Copilot                          | [TabbyML](/guides/guides_v2-fr/outils-de-codage-ia/tabby.md) (4,50 $/mois)                                                                                                                                        |
| Faire fonctionner une plateforme d’agents IA       | [Dify](/guides/guides_v2-fr/plateformes-ia-et-agents/dify.md), [CrewAI](/guides/guides_v2-fr/plateformes-ia-et-agents/crewai.md), ou [OpenHands](/guides/guides_v2-fr/plateformes-ia-et-agents/openhands.md)      |
| Héberger soi-même une alternative à ChatGPT        | [LibreChat](/guides/guides_v2-fr/plateformes-ia-et-agents/librechat.md) ou [LobeChat](/guides/guides_v2-fr/plateformes-ia-et-agents/lobechat.md)                                                                  |
| Faire fonctionner un assistant IA 24h/24, 7j/7     | [OpenClaw sur Clore](/guides/guides_v2-fr/autres-charges-de-travail/openclaw-on-clore.md)                                                                                                                         |
| Choisir le bon GPU                                 | [Comparaison des GPU](/guides/guides_v2-fr/premiers-pas/gpu-comparison.md)                                                                                                                                        |

## 📖 Documentation et assistance

* **Documentation principale**: [docs.clore.ai](https://docs.clore.ai/)
* **Ces guides**: [docs.clore.ai/guides](https://docs.clore.ai/guides/)
* **Place de marché**: [clore.ai/marketplace](https://clore.ai/marketplace)
* **Assistance**: [clore.ai/support](https://clore.ai/support) / <support@clore.ai>
* **Discord**: [discord.com/invite/clore-ai](https://discord.com/invite/clore-ai)
* **Telegram**: [@clorechat](https://t.me/clorechat)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.clore.ai/guides/guides_v2-fr/readme.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
