> For the complete documentation index, see [llms.txt](https://docs.clore.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.clore.ai/guides/guides_v2-de/readme.md).

# Einführung

> **205 praktische Leitfäden** für das Bereitstellen von KI-Modellen, GPU-Workloads und KI-Plattformen auf [Clore.ai](https://clore.ai) — dem dezentralen GPU-Mietmarktplatz.

{% hint style="success" %}
Alle Beispiele können auf GPU-Servern ausgeführt werden, die über den [Clore.ai-Marktplatz](https://clore.ai/marketplace). Miete leistungsstarke GPUs von **0,03 $/Stunde**, minutengenau abgerechnet.
{% endhint %}

## Was ist Clore.ai?

[Clore.ai](https://clore.ai) ist ein Peer-to-Peer-GPU-Marktplatz, auf dem du GPUs direkt von anderen mietest — wie Airbnb für Rechenleistung. Tausende GPUs sind 24/7 verfügbar, von günstigen RTX 3060 bis zu Enterprise-H100s. Bezahle mit **CLORE**, **BTC**, **USDT**, oder **USDC**.

### Warum Clore.ai für KI?

* **Erschwinglich** — RTX 4090 ab 0,14 $/Stunde (statt 1,50–3 $/Stunde bei den großen Clouds)
* **Keine Verpflichtungen** — stundenweise mieten, keine Verträge
* **Vollständiger Root-Zugriff** — Docker-Container mit GPU-Passthrough
* **Große GPU-Auswahl** — 2.200+ Server, 6.700+ GPUs gelistet, \~1.200 jederzeit frei
* **Bezahlen Sie auf Ihre Weise** — Krypto-Zahlungen (CLORE, BTC, USDT/USDC)

## 📚 Leitfadenkategorien

| Kategorie                                                                                      | Leitfäden | Highlights                                                                                                                                                             |
| ---------------------------------------------------------------------------------------------- | --------- | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| 🤖 [Sprachmodelle](/guides/guides_v2-de/sprachmodelle/language-models.md)                      | **53**    | Qwen3.8-27B, GLM-5.2, MiniMax M3, Nemotron 3 Ultra, Mistral Small 4, Kimi K3, DeepSeek V4, MiMo-V2.5-Pro, Hy3 Preview, GLM-5.1, Llama 4, Gemma 3, Ollama, vLLM, SGLang |
| 🤖 [KI-Plattformen & Agenten](/guides/guides_v2-de/ki-plattformen-and-agenten/ai-platforms.md) | **18**    | Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent                                                                       |
| 🔊 [Audio & Stimme](/guides/guides_v2-de/audio-and-stimme/audio-voice.md)                      | **23**    | MOSS-TTS, Voxtral TTS, Whisper, Qwen3-TTS, MiniMax Speech 2.6, Dia, ChatTTS, Kokoro, Fish Speech, MeloTTS, StyleTTS2                                                   |
| 🎬 [Videogenerierung](/guides/guides_v2-de/videogenerierung/video-generation.md)               | **15**    | LTX-2.5, Wan2.1, Wan 2.2 VBVR, FramePack, CubeComposer 4K 360°, LTX-2, CogVideoX, SkyReels, HunyuanVideo, Mochi-1, AnimateDiff                                         |
| 🎨 [Bildgenerierung](/guides/guides_v2-de/bildgenerierung/image-generation.md)                 | **11**    | FLUX.2 Klein, HunyuanImage 3.0, SD 3.5, ComfyUI, InvokeAI, SD WebUI Forge                                                                                              |
| 🧠 [Training](/guides/guides_v2-de/training/training.md)                                       | **12**    | Unsloth, Axolotl, LoRA, DreamBooth, DeepSpeed, LLaMA-Factory, TRL, LitGPT, Mergekit                                                                                    |
| 🏁 [Erste Schritte](/guides/guides_v2-de/erste-schritte/getting-started.md)                    | **10**    | GPU-Vergleich, Live-Preise, teilweise GPU-Miete, CUDA-Kompatibilität, FAQ, Fehlerbehebung                                                                              |
| 👁️ [Visionsmodelle](/guides/guides_v2-de/computer-vision-modelle/vision-models.md)            | **6**     | Qwen2.5-VL, SAM2, LLaVA, Florence-2                                                                                                                                    |
| 🖼️ [Bildverarbeitung](/guides/guides_v2-de/bildverarbeitung/image-processing.md)              | **6**     | Real-ESRGAN, ControlNet, Depth Anything, ICLight                                                                                                                       |
| 🧊 [3D-Generierung](/guides/guides_v2-de/3d-generierung/3d-generation.md)                      | **6**     | Hunyuan World 2.0, TRELLIS, Hunyuan3D 2.1, TripoSR, Gaussian Splatting, Nerfstudio                                                                                     |
| 🎭 [Sprechende Köpfe](/guides/guides_v2-de/sprechende-kopfe/talking-heads.md)                  | **3**     | LivePortrait, SadTalker, Wav2Lip                                                                                                                                       |
| 👤 [Gesicht & Identität](/guides/guides_v2-de/gesicht-and-identitat/face-identity.md)          | **3**     | FaceFusion, InstantID, IP-Adapter                                                                                                                                      |
| ⚙️ [Fortgeschritten](/guides/guides_v2-de/fortgeschritten/advanced.md)                         | **5**     | Multi-GPU, API-Integration, Stapelverarbeitung                                                                                                                         |
| 🔧 [Andere Workloads](/guides/guides_v2-de/andere-workloads/other-workloads.md)                | **3**     | Blender, Kandinsky, OpenClaw                                                                                                                                           |
| 💻 [KI-Coding-Tools](/guides/guides_v2-de/ki-coding-tools/ai-coding.md)                        | **2**     | Aider, TabbyML (self-hosted Copilot)                                                                                                                                   |
| 📊 [Vergleiche](/guides/guides_v2-de/vergleiche/comparisons.md)                                | **7**     | LLM-Serving, Feinabstimmung, Videogenerierung, TTS, RAG-Frameworks, Vektor-DBs                                                                                         |
| 📹 [Videoverarbeitung](/guides/guides_v2-de/videoverarbeitung/video-processing.md)             | **2**     | FFmpeg NVENC, RIFE-Interpolation                                                                                                                                       |
| 🎵 [Musikgenerierung](/guides/guides_v2-de/musikgenerierung/music-generation.md)               | **1**     | ACE-Step (Open-Source-Suno-Alternative)                                                                                                                                |
| 🔍 [Computervision](/guides/guides_v2-de/computer-vision/computer-vision.md)                   | **2**     | YOLOv9/v10-Erkennung                                                                                                                                                   |
| 🗄️ [RAG / Vektor-DBs](/guides/guides_v2-de/rag-and-vektordatenbanken/rag-vectordb.md)         | **6**     | LlamaIndex, RAGFlow, ChromaDB, Qdrant, Milvus, Weaviate                                                                                                                |
| 🔄 [MLOps](/guides/guides_v2-de/mlops-and-bereitstellung/mlops.md)                             | **4**     | MLflow, Triton Inference Server, BentoML, ClearML                                                                                                                      |
| ⚡ [GPU-DevOps](/guides/guides_v2-de/gpu-devops/devops-gpu.md)                                  | **2**     | TensorRT-LLM, ONNX Runtime                                                                                                                                             |
| 🔬 [Wissenschaft](/guides/guides_v2-de/wissenschaft-and-forschung/science.md)                  | **3**     | AlphaFold2, ESMFold, GROMACS molekulare Dynamik                                                                                                                        |
| 🎮 [Gaming / Streaming](/guides/guides_v2-de/gaming-and-streaming/gaming-streaming.md)         | **1**     | Sunshine + Moonlight Remote-Gaming                                                                                                                                     |
| ₿ [Krypto-Mining](/guides/guides_v2-de/krypto-and-mining/crypto-mining.md)                     | **1**     | XMRig CPU/GPU-Mining                                                                                                                                                   |

## 🔥 Was ist neu (August 2026)

### Aufhol-Aktualisierung — 24. August 2026

Neun neue Leitfäden, die alles abdecken, was zwischen Mai und August mit offenen Gewichten erschienen ist, plus ein Korrekturlauf über die gesamte Sammlung: Die Basis-Images entsprechen jetzt der aktuellen GPU-Flotte, und jeder Preis stammt vom Live-Marktplatz statt von einem Monate alten Snapshot.

**Neue Modell-Leitfäden**

* 🤖 **Qwen3.8-27B** 🆕 — Alibabas dichtes 27B Vision-Language-Modell (14. August, **Apache 2.0**). 262K nativer Kontext, auf 1M erweiterbar, hybride Gated-DeltaNet-Attention, 15,4 GB bei Q4. Das einzige Frontier-Modell, das auf einer einzelnen RTX 4090 läuft — [Leitfaden](/guides/guides_v2-de/sprachmodelle/qwen38-27b.md)
* 🤖 **GLM-5.2** 🆕 — Z.ais \~750B/40B-aktives MoE (13. Juni, **MIT**). Terminal-Bench 2.1 81,0, SWE-bench Pro 62,1, solider 1M-Kontext via IndexShare Sparse Attention. Läuft in Q2 auf einem 10× RTX 5090-Rig — [Leitfaden](/guides/guides_v2-de/sprachmodelle/glm-5-2.md)
* 🤖 **MiniMax M3** 🆕 — 428B/23B-aktives nativ multimodales MoE (1. Juni). MiniMax Sparse Attention senkt den Rechenaufwand pro Token bei 1M Kontext auf etwa 1/20 von GQA — [Leitfaden](/guides/guides_v2-de/sprachmodelle/minimax-m3.md)
* 🤖 **NVIDIA Nemotron 3 Ultra** 🆕 — 550B/55B-aktives Mamba-2+MoE-Hybridmodell (4. Juni, **OpenMDW-1.1**: Gewichte, Daten, Rezept und RL-Umgebung). Der offizielle NVFP4-Build passt auf ein 4× RTX PRO 6000-Rig — [Leitfaden](/guides/guides_v2-de/sprachmodelle/nemotron-3-ultra.md)
* 🤖 **Mistral Small 4** 🆕 — 119B insgesamt, nur **6,5B aktiv**, Apache 2.0, 256K Kontext, Vision und ein Reasoning-Schalter. 40GB bei Q2, also laufen zwei RTX 4090s darauf — [Leitfaden](/guides/guides_v2-de/sprachmodelle/mistral-small4.md)
* 🤖 **Kimi K3** 🆕 — Moonshots 2,8T großes Frontier-Modell mit offenen Gewichten (Gewichte vom 27. Juli). Eine ehrliche Seite: Es passt bei keiner Quantisierung auf irgendeinen Marketplace-Rig, und hier ist, was man stattdessen ausführen sollte — [Leitfaden](/guides/guides_v2-de/sprachmodelle/kimi-k3.md)
* 🎬 **LTX-2.5** 🆕 — 22B großes Open-Weight-Videomodell mit synchronisiertem Audio (11. August), ComfyUI-Unterstützung ab Tag 1, 720p bis 4K. Die offizielle Empfehlung sind 32 GB VRAM, was genau einer RTX 5090 entspricht — [Leitfaden](/guides/guides_v2-de/videogenerierung/ltx-video-2-5.md)

**Neue Plattform-Leitfäden**

* 🏁 **Teilweise GPU-Miete** 🆕 — nimm 1 oder 2 GPUs aus einem 8-GPU-Rig heraus und zahle anteilig. Unterstützt auf 60 % der gelisteten Server, 2.153 einzelne GPU-Slots waren beim letzten Snapshot frei — [Leitfaden](/guides/guides_v2-de/erste-schritte/partial-gpu-rental.md)
* 🏁 **CUDA- & PyTorch-Kompatibilität** 🆕 — RTX-50-Serie benötigt CUDA 12.8+ und PyTorch 2.7+, Tesla V100 verlor cu128-Unterstützung in PyTorch 2.11, CUDA 13 beginnt bei Turing. Die Matrix, nach Kartengeneration — [Leitfaden](/guides/guides_v2-de/erste-schritte/cuda-pytorch-compatibility.md)

**Aktualisiert**

* **DeepSeek V4** — beide Stufen aktualisiert: Flash-0731 (31. Juli, 167GB FP8, DSpark spekulatives Decoding) schlägt die April-Pro-Vorschau bei DeepSeeks eigenen Benchmarks; Pro-0813 erschien am 13. August — [Leitfaden](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md)
* **Chatterbox TTS** — Multilingual V3 ist jetzt der empfohlene Checkpoint — [Leitfaden](/guides/guides_v2-de/audio-and-stimme/chatterbox-tts.md)
* **Jeder Leitfaden** — Basis-Images wurden auf CUDA 12.8 / PyTorch 2.11 umgestellt, damit sie auf Blackwell-Karten funktionieren, Preise neu aus dem Live-Marktplatz abgeleitet, und Workloads werden nicht mehr gegen A100/H200/B200 dimensioniert, die auf dem Marktplatz nicht gelistet sind

#### Branchenhinweise (Mai–August 2026)

*Geschlossen, nur per API oder zu groß, um hier selbst gehostet zu werden — mit dem, was stattdessen ausgeführt werden kann.*

* **GLM-5.3** (Z.ai, 14. August) — nur API- und Coding-Plan; Z.ai sagt, die Gewichte folgen in Phasen nach der Sicherheitsprüfung. → Heute ausführen: [GLM-5.2](/guides/guides_v2-de/sprachmodelle/glm-5-2.md)
* **Qwen3.8-Max** (Alibaba, August) — 2,4T/95B-aktive Gewichte sind herunterladbar, aber unter einer benutzerdefinierten Lizenz mit einer Umsatzklausel von 50 Mio. $, und kein Marketplace-Rig kann sie aufnehmen. → [Qwen3.8-27B](/guides/guides_v2-de/sprachmodelle/qwen38-27b.md) ist Apache 2.0 und passt auf eine Karte
* **Qwen-Image-3.0** und **Qwen-Audio-3.0-TTS** (Alibaba, Juli) — nur API, keine Gewichte veröffentlicht. → Selbst hosten: [FLUX.2 Klein](/guides/guides_v2-de/bildgenerierung/flux2-klein.md), [HunyuanImage 3.0](/guides/guides_v2-de/bildgenerierung/hunyuan-image3.md), [Qwen3-TTS](/guides/guides_v2-de/audio-and-stimme/qwen3-tts.md)
* **Kimi K3** — offene Gewichte, aber 466 GB schon bei der kleinsten Quantisierung. → Siehe die [Leitfaden](/guides/guides_v2-de/sprachmodelle/kimi-k3.md) für die Alternativen

## 🔥 Was ist neu (April 2026)

### Woche vom 27. April 2026 — 6 neue Leitfäden

* 🤖 **DeepSeek V4** 🆕 — Das Frontier-MoE wurde am 22. April endlich mit vollständigen offenen Gewichten unter MIT veröffentlicht. Pro: 1,6T gesamt / 49B aktiv, 1M Kontext. Flash: 284B / 13B aktiv, quantisiert auf einer einzelnen 80GB-GPU lauffähig. Unterstützung für vLLM und SGLang ab Tag 0 — [Leitfaden](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md)
* 🤖 **MiMo-V2.5-Pro** 🆕 — Xiaomis erste Open-Weight-Pro-Stufe (27. April). 1,02T MoE / 42B aktiv, 1M Kontext, MIT, FP8 nativ. Hybride Attention 6:1 + 3-stufiges MTP — [Leitfaden](/guides/guides_v2-de/sprachmodelle/mimo-v25-pro.md)
* 🤖 **Hy3 Preview** 🆕 — Tencent Hunyuan 3 (23. April). 295B MoE / 21B aktiv, 256K Kontext, Fokus auf Agenten und Reasoning. Ein einzelner Knoten mit 4× A100 80GB bedient es in FP8 — [Leitfaden](/guides/guides_v2-de/sprachmodelle/hy3-preview.md)
* 🤖 **Ling-2.6-flash** 🆕 — Ant Group inclusionAI (28. April). 104B MoE / 7,4B aktiv, auf Agenten abgestimmt. Passt auf eine einzelne RTX 4090 INT4 oder eine einzelne H100 FP8 — [Leitfaden](/guides/guides_v2-de/sprachmodelle/ling-26-flash.md)
* 🤖 **Qwen3.6-27B** 🆕 — Alibabas dichtes 27B (21. April). Apache 2.0, 262K Kontext (mit YaRN auf 1M erweiterbar). Das Coding-LLM, das „auf einer Karte einfach funktioniert“ — [Leitfaden](/guides/guides_v2-de/sprachmodelle/qwen36-27b.md)
* 🤖 **MiniMax M2.7** 🆕 — 229B MoE-Coding-Modell (9. April). Benutzerdefinierte MiniMax-Lizenz, FP8 nativ. Zuvor als proprietär gelistet — offene Gewichte sind jetzt öffentlich — [Leitfaden](/guides/guides_v2-de/sprachmodelle/minimax-m27.md)

#### Branchenhinweise (21.–29. April 2026)

*In diesem Zeitraum geschlossen oder nur per API — Selbsthost-Alternativen verlinkt.*

* **Claude Opus 4.7** (Anthropic, 16. April) — geschlossene Gewichte. → Selbsthost-Alternativen: [DeepSeek V4](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md), [MiMo-V2.5-Pro](/guides/guides_v2-de/sprachmodelle/mimo-v25-pro.md), [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md)
* **GPT-5.5 / GPT-5.5 Pro** (OpenAI, 23. April) — geschlossen, nur API. → Selbsthost-Alternativen: [DeepSeek V4](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md), [MiMo-V2.5-Pro](/guides/guides_v2-de/sprachmodelle/mimo-v25-pro.md)
* **Wan 2.7** (Alibaba) — offene Gewichte noch ausstehend für Q2 2026. Wan 2.5 hat mit der Tradition gebrochen und blieb geschlossen; 2.7 sollte mit Skepsis betrachtet werden. → Heute selbst hosten: [Wan 2.2 VBVR](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-de/videogenerierung/wan-video.md), [LTX-2](/guides/guides_v2-de/videogenerierung/ltx-video-2.md)
* **Qwen3.6-Plus** (Alibaba) — Coding-Agent mit 1M-Kontext, nur API auf OpenRouter. → Selbsthost-Alternative: [Qwen3.6-27B](/guides/guides_v2-de/sprachmodelle/qwen36-27b.md), [Qwen3.5-Omni](/guides/guides_v2-de/sprachmodelle/qwen35-omni.md)
* **Hugging Face ml-intern** (21. April) — Open-Source-autonomer Post-Training-Agent (Recherche → Datensatz → Training). Wir beobachten die Verbreitung, bevor wir einen vollständigen Leitfaden hinzufügen. → Heute verwenden: [Unsloth](/guides/guides_v2-de/training/unsloth-finetune.md), [LLaMA-Factory](/guides/guides_v2-de/training/llama-factory.md), [Axolotl](/guides/guides_v2-de/training/axolotl-training.md)

### Woche vom 20. April 2026 — 3 neue Leitfäden

* 🧊 **Hunyuan World 2.0** 🆕 — Tencents erstes Open-Source-3D-Weltmodell. Text/Bild/Video → bearbeitbares Mesh + 3D Gaussian Splatting für Unity/Unreal/Blender. \~1,2B Parameter BF16, 12–24 GB VRAM — [Leitfaden](/guides/guides_v2-de/3d-generierung/hunyuan-world-2.md)
* 🤖 **GLM-5.1** 🆕 — Zhipu AIs 744B MoE / 40B aktives Coding-Kraftpaket. 200K Kontext, MIT-Lizenz, #1 auf SWE-Bench Pro (58,4 %) und schlägt Claude Opus 4.6 und GPT-5.4 — [Leitfaden](/guides/guides_v2-de/sprachmodelle/glm-5-1.md)
* 🔊 **MOSS-TTS** 🆕 — ultraleichtes 100M-Param-TTS von OpenMOSS. 48 kHz Stereo, 20 Sprachen, Inferenz nur auf CPU (keine GPU erforderlich), Zero-Shot-Voice-Cloning, Apache 2.0 — [Leitfaden](/guides/guides_v2-de/audio-and-stimme/moss-tts.md)

#### Branchenhinweise (13.–20. April 2026)

*Diese Woche wurden nur Closed-Source- oder API-only-Starts veröffentlicht — noch nicht auf Clore selbst hostbar. Für jeden haben wir die nächstgelegene Open-Weight-Alternative verlinkt, die du heute auf Clore ausführen kannst.*

* **Alibaba Happy Oyster** — interaktives 3D-Weltmodell in Echtzeit (Modi „Roaming“ und „Directing“). Warteliste / geschlossene Beta. → Selbsthost-Alternative: [Hunyuan World 2.0](/guides/guides_v2-de/3d-generierung/hunyuan-world-2.md)
* **ByteDance Seedance 2.0 API** — am 14. April auf Volcano Engine vollständig freigeschaltet, nur API. → Selbsthost-Alternativen: [Wan 2.2 VBVR](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md), [LTX-2](/guides/guides_v2-de/videogenerierung/ltx-video-2.md)
* **Qwen 3.6-Plus** — Alibabas proprietärer Coding-Agent mit 1M Kontext. Nur API. → Selbsthost-Alternativen: [Qwen3.5-Omni](/guides/guides_v2-de/sprachmodelle/qwen35-omni.md), [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md)
* **Meta Muse Spark** — Metas erstes proprietäres Modell nach Llama. → Selbsthost-Alternative: [Llama 4](/guides/guides_v2-de/sprachmodelle/llama4.md)
* **Wan 2.7** — offene Gewichte noch ausstehend für Q2 2026 (derzeit nur API über Together AI). → Heute selbst hosten: [Wan 2.2 VBVR](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md)

### Woche vom 13. April 2026 — 2 neue Leitfäden

* 🤖 **Qwen3.5-Omni** 🆕 — Alibabas einheitliches multimodales Modell: Text-, Audio-, Bild- und Videoverständnis plus Text- und Sprachgenerierung in einem 30B MoE. INT4 passt in 24 GB VRAM. Apache 2.0 — [Leitfaden](/guides/guides_v2-de/sprachmodelle/qwen35-omni.md)
* 🎬 **Wan 2.2 VBVR** 🆕 — Video-Based Video Reference für konsistente Bewegungssteuerung. Verwenden Sie einen Referenzclip, um Animationen in der neuen Videogenerierung zu steuern. FP8 läuft auf einer RTX 3090 (16–24 GB). ComfyUI-Workflow enthalten — [Leitfaden](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md)

#### Branchenhinweise (6.–13. April 2026)

*Nur API oder ausstehende offene Gewichte — Selbsthost-Alternativen verlinkt.*

* **Wan 2.7** (Alibaba) — Generierung von erstem und letztem Frame, Video-zu-Video-Bearbeitung, Referenzierung von Motiven. Offene Gewichte werden Mitte Q2 2026 erwartet. → Heute selbst hosten: [Wan 2.2 VBVR](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-de/videogenerierung/wan-video.md)
* **Qwen3.6-Plus** (Alibaba) — 1M-Kontextfenster, agentisches Coding. Veröffentlichung offener Gewichte ausstehend. → Selbsthost-Alternativen: [Qwen3.5](/guides/guides_v2-de/sprachmodelle/qwen35.md), [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md)
* **LTX 2.3** — Neues LTX-Videogenerierungsmodell, 22B Parameter, 32 GB VRAM als Basis. → Aktuelle offene Version verwenden: [LTX-2](/guides/guides_v2-de/videogenerierung/ltx-video-2.md)

## 🔥 Was ist neu (März 2026)

### Woche vom 30. März 2026 — 1 neuer Leitfaden

* 🔊 **Voxtral TTS** 🆕 — Mistrals 4B Open-Weight-TTS-Modell, 9 Sprachen, Zero-Shot-Voice-Cloning aus 3 s Referenz, nur 3 GB VRAM, Apache 2.0 — [Leitfaden](/guides/guides_v2-de/audio-and-stimme/voxtral-tts.md)

#### Branchenhinweise (23.–30. März)

*Nur API / eingestellt — Selbsthost-Alternativen verlinkt.*

* **Seedance 2.0** (ByteDance) — Videogenerierung der nächsten Generation, gestartet in CapCut/Dreamina. Nur API. → Selbsthost-Alternativen: [Wan2.1](/guides/guides_v2-de/videogenerierung/wan-video.md), [LTX-2](/guides/guides_v2-de/videogenerierung/ltx-video-2.md)
* **Google Lyria 3 Pro** — Musikerzeugung über Gemini-API/Vertex AI. Nur API. → Selbsthost-Alternative: [ACE-Step](/guides/guides_v2-de/musikgenerierung/ace-step.md)
* **Gemini 3 Deep Think** — Googles Frontier-Reasoning-Modell, nur API. → Selbsthost-Alternativen: [DeepSeek-R1](/guides/guides_v2-de/sprachmodelle/deepseek-r1.md), [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md)
* **Sora-Abschaltung** — OpenAI hat die Sora-Videogenerierungs-App offiziell eingestellt. → Selbsthost-Alternative: [OpenSora](/guides/guides_v2-de/videogenerierung/opensora.md)
* **DeepSeek V4** ✅ — am 22. April 2026 mit vollständigen offenen Gewichten (MIT) ausgeliefert. Siehe [aktualisierten Leitfaden](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md).

### Woche vom 16. März 2026 — 3 neue Leitfäden

* 🤖 **NVIDIA Nemotron 3 Super** 🆕 — 120B MoE / 12B aktiv, 5× Durchsatz, 1M Kontext, Apache 2.0, gebaut für agentische KI — [Leitfaden](/guides/guides_v2-de/sprachmodelle/nvidia-nemotron-3-super.md)
* 🌐 **Gemini 3.1 Flash Lite** 🆕 — Googles günstigstes/schnellstes Modell (3. März 2026), API + Open-Source-Alternativen — [Leitfaden](/guides/guides_v2-de/sprachmodelle/gemini-3-1-flash-lite.md)
* 🎬 **CubeComposer 4K 360°-Video** 🆕 — erstes Modell, das nativ 4K-360°-Panoramavideo aus Standardmaterial erzeugt (CVPR 2026) — [Leitfaden](/guides/guides_v2-de/videogenerierung/cubecomposer-360-video.md)

### Auch diese Woche (9.–16. März 2026)

* **GPT-5.4** — am 5. März 2026 veröffentlicht; nativer Computer-Einsatz (75,0 % OSWorld), 1M Kontext. Nur API, keine lokale Bereitstellung. → Selbsthost-Alternativen: [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md), [DeepSeek-R1](/guides/guides_v2-de/sprachmodelle/deepseek-r1.md)
* **DeepSeek V4** ✅ — am 22. April 2026 veröffentlicht, MIT, 1,6T-Pro / 284B-Flash. [Leitfaden](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md).
* **Wan 2.2** — neue Version des Grundlagenmodells für Wan-Videogenerierung. → Selbst hosten: [Wan 2.2 VBVR](/guides/guides_v2-de/videogenerierung/wan22-vbvr.md), [Wan2.1](/guides/guides_v2-de/videogenerierung/wan-video.md)

### Neu im März 2026 — 6 neue Kategorien, 57 neue Leitfäden

* 🗄️ **RAG / Vektor-DBs** — 6 Leitfäden: [LlamaIndex](/guides/guides_v2-de/rag-and-vektordatenbanken/llamaindex.md), [RAGFlow](/guides/guides_v2-de/rag-and-vektordatenbanken/ragflow.md), [ChromaDB](/guides/guides_v2-de/rag-and-vektordatenbanken/chromadb.md), [Qdrant](/guides/guides_v2-de/rag-and-vektordatenbanken/qdrant.md), [Milvus](/guides/guides_v2-de/rag-and-vektordatenbanken/milvus.md), [Weaviate](/guides/guides_v2-de/rag-and-vektordatenbanken/weaviate.md)
* 🔄 **MLOps** — 4 Leitfäden: [MLflow](/guides/guides_v2-de/mlops-and-bereitstellung/mlflow.md), [Triton Inference Server](/guides/guides_v2-de/mlops-and-bereitstellung/triton-inference-server.md), [BentoML](/guides/guides_v2-de/mlops-and-bereitstellung/bentoml.md), [ClearML](/guides/guides_v2-de/mlops-and-bereitstellung/clearml.md)
* ⚡ **GPU-DevOps** — 2 Leitfäden: [TensorRT-LLM](/guides/guides_v2-de/gpu-devops/tensorrt-llm.md), [ONNX Runtime](/guides/guides_v2-de/gpu-devops/onnx-runtime.md)
* 🔬 **Wissenschaft** — 3 Leitfäden: [AlphaFold2](/guides/guides_v2-de/wissenschaft-and-forschung/alphafold2.md), [ESMFold](/guides/guides_v2-de/wissenschaft-and-forschung/esmfold.md), [GROMACS](/guides/guides_v2-de/wissenschaft-and-forschung/gromacs.md) molekulare Dynamik
* 🎮 **Gaming / Streaming** — [Sunshine + Moonlight](/guides/guides_v2-de/gaming-and-streaming/sunshine-moonlight.md) GPU-beschleunigtes Remote-Gaming
* ₿ **Krypto-Mining** — [XMRig](/guides/guides_v2-de/krypto-and-mining/xmrig.md) CPU/GPU-Mining auf Clore.ai

### Zuletzt hinzugefügte Modelle (4. März 2026)

* **DeepSeek V4** ✅ — 1,6T-Pro / 284B-Flash-MoE, MIT-Lizenz, **am 22. April 2026 ausgeliefert** — [Leitfaden](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md)
* **MiniMax Speech 2.6** 🆕 — ultraniedrige Latenz-TTS für Sprachagenten, < 300 ms TTFB — [Leitfaden](/guides/guides_v2-de/audio-and-stimme/minimax-speech.md)
* **SGLang** 🆕 — RadixAttention zum Teilen des KV-Caches, 2–5× Durchsatz gegenüber vLLM bei MoE — [Leitfaden](/guides/guides_v2-de/sprachmodelle/sglang.md)
* **TGI** 🆕 — HuggingFaces produktionsreifes LLM-Serving mit Flash Attention 2 + PagedAttention — [Leitfaden](/guides/guides_v2-de/sprachmodelle/tgi.md)
* **LLaMA-Factory** 🆕 — 100+ LLMs mit WebUI, LoRA/QLoRA, RLHF feinabstimmen — [Leitfaden](/guides/guides_v2-de/training/llama-factory.md)
* **Fish Speech** 🆕 — Zero-Shot-Voice-Cloning in 8+ Sprachen aus 10–15 s Referenz-Audio — [Leitfaden](/guides/guides_v2-de/audio-and-stimme/fish-speech.md)
* **Mochi-1** 🆕 — Videodiffusion mit 10B Parametern, 848×480 bei 30 fps, 24 GB VRAM — [Leitfaden](/guides/guides_v2-de/videogenerierung/mochi-1.md)

### Zuvor hinzugefügt (Februar 2026)

* **Qwen3.5** — Alibabas 397B MoE, schlug Claude 4.5 Opus in Mathematik
* **GLM-5** — 744B MoE von Zhipu AI, MIT-Lizenz, #1 in Open-Source-Rankings
* **Ling-2.5-1T** — Modell mit Billionen von Parametern von Ant Group mit linearer Attention
* **Kimi K2.5** — Moonshot AIs 1T MoE, MIT-Lizenz, visuell agentisch
* **Mistral Large 3** — 675B MoE, Apache 2.0, Frontier-Coding & Reasoning
* **Llama 4 Scout/Maverick** — Metas MoE-Revolution, 10M-Kontextfenster
* **Gemma 3** — Googles 27B, das 405B-Modelle schlägt
* **FLUX.2 Klein** — Bilderzeugung in unter einer Sekunde (< 0,5 s auf RTX 4090)
* **HunyuanImage 3.0** — 80B MoE, größtes Open-Source-Bildmodell
* **ACE-Step 1.5** — vollständige Song-Erzeugung mit < 4 GB VRAM
* **FramePack** — KI-Video mit nur 6 GB VRAM
* **Qwen3-TTS** — Voice-Cloning in 10+ Sprachen aus 3 Sekunden Audio
* **Kani-TTS-2** — ultraleichtes TTS, nur 3 GB VRAM
* **DeepSeek-R1** — Reasoning-Modell auf Augenhöhe mit OpenAI o1

### Zuvor hinzugefügte Kategorien (Februar 2026)

* 🤖 **KI-Plattformen & Agenten** — 18 Leitfäden: Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent
* 🎵 **Musikgenerierung** — KI-komponierte Songs mit Gesang (ACE-Step)
* 💻 **KI-Coding-Tools** — selbst gehostete Copilot-Alternativen (Aider, TabbyML)
* 🔧 **OpenClaw auf Clore** — führe deinen KI-Assistenten 24/7 auf gemieteten GPUs aus

## 💰 GPU-Preise (August 2026)

> Live-Snapshot des Clore.ai-Marktplatzes, **24. August 2026**: 2.202 Server / 6.791 GPUs gelistet, 1.198 Server frei. Preise sind **pro GPU und Stunde**, On-Demand, minutengenau abgerechnet. Spannen sind das 10.–90. Perzentil der Server, die zum Zeitpunkt des Snapshots frei waren. Vollständige Details: [GPU-Preise & Verfügbarkeit](/guides/guides_v2-de/erste-schritte/pricing.md).

| GPU                    | VRAM      | $/GPU/h                                   | Am besten geeignet für                                           | Landingpage                                                                                                                      |
| ---------------------- | --------- | ----------------------------------------- | ---------------------------------------------------------------- | -------------------------------------------------------------------------------------------------------------------------------- |
| RTX 3060               | 12 GB     | $0,03–0,07                                | TTS, kleine Modelle, Musikgenerierung                            | —                                                                                                                                |
| RTX 3070               | 8 GB      | $0,03–0,09                                | 7B-Modelle, Whisper, Batch-Inferenz                              | [Mieten](https://clore.ai/rent-3070.html) / [Hosten](https://clore.ai/host-3070.html)                                            |
| RTX 3080               | 10 GB     | $0,05–0,19                                | 7B–14B-Modelle, Bildgenerierung                                  | [Mieten](https://clore.ai/rent-3080.html) / [Hosten](https://clore.ai/host-3080.html)                                            |
| RTX 3090               | 24 GB     | $0,07–0,21                                | SDXL, 27B Q4, bestes Preis-Leistungs-Verhältnis pro GB           | [Mieten](https://clore.ai/rent-3090.html) / [Hosten](https://clore.ai/host-3090.html)                                            |
| RTX 4070 Ti            | 12 GB     | $0,07–0,25                                | SDXL, ComfyUI, 7B-Modelle                                        | [Mieten](https://clore.ai/rent-4070-ti.html)                                                                                     |
| RTX 4080               | 16 GB     | $0,09–0,17                                | FLUX, 14B-Modelle, Feintuning                                    | [Mieten](https://clore.ai/rent-4080.html)                                                                                        |
| RTX 4090               | 24 GB     | $0,14–0,42                                | FLUX, Qwen3.8-27B Q4, Mistral Small 4 Q2                         | [Mieten](https://clore.ai/rent-4090.html) / [Hosten](https://clore.ai/host-4090.html)                                            |
| RTX 5070 Ti            | 16 GB     | $0,10–0,25                                | Blackwell FP4, SDXL, 14B-Modelle                                 | —                                                                                                                                |
| RTX 5080               | 16 GB     | $0,12–0,62                                | Schnelles FLUX, 14B–30B quantisiert                              | [Mieten](https://clore.ai/rent-5080.html)                                                                                        |
| RTX 5090               | 32 GB     | $0,25–0,77                                | Qwen3.8-27B FP8, LTX-2.5-Video, 70B Q4                           | [Mieten](https://clore.ai/rent-5090.html) / [Hosten](https://clore.ai/host-5090.html)                                            |
| RTX PRO 6000 Blackwell | 96GB      | $0,92–1,38                                | 70B BF16 auf einer Karte, 4× Rigs = 380 GB                       | —                                                                                                                                |
| Tesla V100 SXM2        | 32 GB     | $0,05–0,06                                | Günstige 8-GPU-Rigs, insgesamt 256 GB                            | —                                                                                                                                |
| H100 NVL               | 94GB      | \~$1.04                                   | Frontier-Inferenz — nur 4 auf dem Marktplatz                     | [Mieten](https://clore.ai/rent-h100.html)                                                                                        |
| A100 / H200 / B200     | 80–192 GB | [Bare Metal](https://clore.ai/bare-metal) | Nicht auf dem Marktplatz gelistet; dedizierte Knoten auf Anfrage | [A100](https://clore.ai/rent-a100-80gb.html) / [H200](https://clore.ai/rent-h200.html) / [B200](https://clore.ai/rent-b200.html) |

**Spot vs. On-Demand:** Spot ist nicht automatisch günstiger. Im selben Snapshot boten 63 % der Server Spot genau zum On-Demand-Preis an; wo ein Rabatt vorhanden war, lag der Median bei \~13 %.

**Teilweise GPU-Miete:** 60 % der gelisteten Server (1.331 von 2.202) erlauben es, 1–2 GPUs aus einem größeren Rig zu mieten und nur für diese zu zahlen. Siehe [Teilweise GPU-Miete](/guides/guides_v2-de/erste-schritte/partial-gpu-rental.md).

*Möchten Sie ungenutzte GPUs monetarisieren? Siehe die* [*Host-Seiten*](https://clore.ai/llms.txt) *für monatliche Ertragsschätzungen pro Kartentyp.*

## 🚀 Schnellstart

Neu bei Clore.ai? → [**Schnellstartanleitung**](/guides/guides_v2-de/quickstart.md)

Wissen Sie schon, was Sie brauchen?

| Ich möchte ...                                   | Hier starten                                                                                                                                                                                                         |
| ------------------------------------------------ | -------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| Lokal mit KI chatten                             | [Ollama-Anleitung](/guides/guides_v2-de/sprachmodelle/ollama.md)                                                                                                                                                     |
| Ein Frontier-Coding-LLM ausführen                | [DeepSeek V4](/guides/guides_v2-de/sprachmodelle/deepseek-v4.md), [GLM-5.1](/guides/guides_v2-de/sprachmodelle/glm-5-1.md), oder [MiMo-V2.5-Pro](/guides/guides_v2-de/sprachmodelle/mimo-v25-pro.md)                 |
| Ein Coding-LLM auf einer einzelnen GPU ausführen | [Qwen3.6-27B](/guides/guides_v2-de/sprachmodelle/qwen36-27b.md) (RTX 4090 Q4) oder [Ling-2.6-flash](/guides/guides_v2-de/sprachmodelle/ling-26-flash.md)                                                             |
| Bilder generieren                                | [FLUX.2 Klein](/guides/guides_v2-de/bildgenerierung/flux2-klein.md) oder [ComfyUI](/guides/guides_v2-de/bildgenerierung/comfyui.md)                                                                                  |
| Videos generieren                                | [FramePack](/guides/guides_v2-de/videogenerierung/framepack.md) (6 GB!) oder [Wan2.1](/guides/guides_v2-de/videogenerierung/wan-video.md)                                                                            |
| Eine Stimme klonen                               | [Voxtral TTS](/guides/guides_v2-de/audio-and-stimme/voxtral-tts.md), [Qwen3-TTS](/guides/guides_v2-de/audio-and-stimme/qwen3-tts.md), oder [Zonos](/guides/guides_v2-de/audio-and-stimme/zonos-tts.md)               |
| Audio transkribieren                             | [WhisperX](/guides/guides_v2-de/audio-and-stimme/whisperx.md)                                                                                                                                                        |
| Ein Modell feinabstimmen                         | [Unsloth](/guides/guides_v2-de/training/unsloth-finetune.md) (2× schneller, 70 % weniger VRAM)                                                                                                                       |
| Musik generieren                                 | [ACE-Step](/guides/guides_v2-de/musikgenerierung/ace-step.md) (< 4 GB VRAM!)                                                                                                                                         |
| Copilot selbst hosten                            | [TabbyML](/guides/guides_v2-de/ki-coding-tools/tabby.md) (4,50 $/Monat)                                                                                                                                              |
| Eine KI-Agentenplattform ausführen               | [Dify](/guides/guides_v2-de/ki-plattformen-and-agenten/dify.md), [CrewAI](/guides/guides_v2-de/ki-plattformen-and-agenten/crewai.md), oder [OpenHands](/guides/guides_v2-de/ki-plattformen-and-agenten/openhands.md) |
| ChatGPT-Alternative selbst hosten                | [LibreChat](/guides/guides_v2-de/ki-plattformen-and-agenten/librechat.md) oder [LobeChat](/guides/guides_v2-de/ki-plattformen-and-agenten/lobechat.md)                                                               |
| KI-Assistenten 24/7 ausführen                    | [OpenClaw auf Clore](/guides/guides_v2-de/andere-workloads/openclaw-on-clore.md)                                                                                                                                     |
| Die richtige GPU wählen                          | [GPU-Vergleich](/guides/guides_v2-de/erste-schritte/gpu-comparison.md)                                                                                                                                               |

## 📖 Dokumentation & Support

* **Hauptdokumentation**: [docs.clore.ai](https://docs.clore.ai/)
* **Diese Anleitungen**: [docs.clore.ai/guides](https://docs.clore.ai/guides/)
* **Marktplatz**: [clore.ai/marketplace](https://clore.ai/marketplace)
* **Support**: [clore.ai/support](https://clore.ai/support) / <support@clore.ai>
* **Discord**: [discord.com/invite/clore-ai](https://discord.com/invite/clore-ai)
* **Telegram**: [@clorechat](https://t.me/clorechat)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.clore.ai/guides/guides_v2-de/readme.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
