For the complete documentation index, see llms.txt. This page is also available as Markdown.

Einführung

194 praktische Anleitungen für den Einsatz von KI-Modellen, GPU-Workloads und KI-Plattformen auf Clore.ai — dem dezentralen GPU-Mietmarktplatz.

Was ist Clore.ai?

Clore.ai ist ein Peer-to-Peer-GPU-Marktplatz, auf dem du GPUs direkt von anderen Menschen mietest — wie Airbnb für Rechenleistung. Tausende GPUs sind rund um die Uhr verfügbar, von günstigen RTX 3060 bis hin zu Enterprise-H100. Bezahle mit CLORE, BTC, USDToder USDC.

Warum Clore.ai für KI?

  • Erschwinglich — RTX 4090 ab 0,50 $/Tag (vs. 2–4 $ bei Cloud-Anbietern)

  • Keine Verpflichtungen — stundenweise mieten, keine Verträge

  • Voller Root-Zugriff — Docker-Container mit GPU-Passthrough

  • Große GPU-Auswahl — 3.400+ Maschinen, 12.800+ GPUs online

  • Zahle auf deine Weise — Kryptozahlungen (CLORE, BTC, USDT/USDC)

📚 Kategorien der Anleitungen

Kategorie
Anleitungen
Highlights

45

DeepSeek V4, MiMo-V2.5-Pro, Hy3 Preview, Qwen3.6-27B, MiniMax M2.7, Ling-2.6-flash, GLM-5.1, Llama 4, Gemma 3, Qwen3.5-Omni, GLM-5, DeepSeek-R1, Nemotron 3 Super, Ollama, vLLM, SGLang

18

Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent

23

MOSS-TTS, Voxtral TTS, Whisper, Qwen3-TTS, MiniMax Speech 2.6, Dia, ChatTTS, Kokoro, Fish Speech, MeloTTS, StyleTTS2

14

Wan2.1, Wan 2.2 VBVR, FramePack, CubeComposer 4K 360°, LTX-2, CogVideoX, SkyReels, HunyuanVideo, Mochi-1, AnimateDiff

11

FLUX.2 Klein, HunyuanImage 3.0, SD 3.5, ComfyUI, InvokeAI, SD WebUI Forge

12

Unsloth, Axolotl, LoRA, DreamBooth, DeepSpeed, LLaMA-Factory, TRL, LitGPT, Mergekit

8

GPU-Vergleich, Preise, FAQ, Fehlerbehebung

6

Qwen2.5-VL, SAM2, LLaVA, Florence-2

6

Real-ESRGAN, ControlNet, Depth Anything, ICLight

6

Hunyuan World 2.0, TRELLIS, Hunyuan3D 2.1, TripoSR, Gaussian Splatting, Nerfstudio

3

LivePortrait, SadTalker, Wav2Lip

3

FaceFusion, InstantID, IP-Adapter

5

Multi-GPU, API-Integration, Batch-Verarbeitung

3

Blender, Kandinsky, OpenClaw

2

Aider, TabbyML (selbst gehostetes Copilot)

7

LLM-Serving, Fine-Tuning, Video-Gen, TTS, RAG-Frameworks, Vektor-Datenbanken

2

FFmpeg NVENC, RIFE-Interpolation

1

ACE-Step (Open-Source-Suno-Alternative)

2

YOLOv9/v10-Erkennung

6

LlamaIndex, RAGFlow, ChromaDB, Qdrant, Milvus, Weaviate

🔄 MLOps

4

MLflow, Triton Inference Server, BentoML, ClearML

2

TensorRT-LLM, ONNX Runtime

3

AlphaFold2, ESMFold, GROMACS-Molekulardynamik

1

Sunshine + Moonlight Remote Gaming

1

XMRig CPU/GPU-Mining

🔥 Was ist neu (April 2026)

Woche vom 27. April 2026 — 6 neue Anleitungen

  • 🤖 DeepSeek V4 🆕 — Das Frontier-MoE wurde am 22. April endlich veröffentlicht, mit vollständigen offenen Gewichten unter MIT. Pro: 1,6T gesamt / 49B aktiv, 1M Kontext. Flash: 284B / 13B aktiv, läuft quantisiert auf einer einzelnen 80GB-GPU. Day-0-Unterstützung für vLLM und SGLang — Anleitung

  • 🤖 MiMo-V2.5-Pro 🆕 — Xiaomis erste offene Pro-Stufe (27. April). 1,02T MoE / 42B aktiv, 1M Kontext, MIT, FP8 nativ. Hybride Aufmerksamkeit 6:1 + 3-Schritt-MTP — Anleitung

  • 🤖 Hy3 Vorschau 🆕 — Tencent Hunyuan 3 (23. April). 295B MoE / 21B aktiv, 256K Kontext, Fokus auf Agenten + Reasoning. Ein einzelner Knoten mit 4× A100 80GB betreibt es in FP8 — Anleitung

  • 🤖 Ling-2.6-flash 🆕 — Ant Group inclusionAI (28. April). 104B MoE / 7,4B aktiv, auf Agenten getunt. Passt auf eine einzelne RTX 4090 INT4 oder eine einzelne H100 FP8 — Anleitung

  • 🤖 Qwen3.6-27B 🆕 — Alibabas dichtes 27B-Modell (21. April). Apache 2.0, 262K Kontext (mit YaRN auf 1M erweiterbar). Das Coding-LLM, das auf einer einzigen Karte einfach funktioniert — Anleitung

  • 🤖 MiniMax M2.7 🆕 — 229B MoE-Coding-Modell (9. April). Eigene MiniMax-Lizenz, FP8 nativ. Zuvor als proprietär gelistet — offene Gewichte sind jetzt öffentlich — Anleitung

Branchenhinweise (21.–29. April 2026)

In diesem Zeitraum nur Closed Source oder API-only — selbst hostbare Alternativen sind verlinkt.

  • Claude Opus 4.7 (Anthropic, 16. April) — geschlossene Gewichte. → Selbst hostbare Alternativen: DeepSeek V4, MiMo-V2.5-Pro, GLM-5.1

  • GPT-5.5 / GPT-5.5 Pro (OpenAI, 23. April) — geschlossen, nur API. → Selbst hostbare Alternativen: DeepSeek V4, MiMo-V2.5-Pro

  • Wan 2.7 (Alibaba) — offene Gewichte noch ausstehend für Q2 2026. Wan 2.5 brach mit der Tradition und blieb geschlossen; 2.7 mit Skepsis behandeln. → Heute selbst hosten: Wan 2.2 VBVR, Wan2.1, LTX-2

  • Qwen3.6-Plus (Alibaba) — 1M-Kontext-Coding-Agent, nur API auf OpenRouter. → Selbst hostbare Alternative: Qwen3.6-27B, Qwen3.5-Omni

  • Hugging Face ml-intern (21. April) — Open-Source-autonomer Post-Training-Agent (Research → Datensatz → Training). Wir beobachten die Verbreitung, bevor wir eine vollständige Anleitung hinzufügen. → Heute verwenden: Unsloth, LLaMA-Factory, Axolotl

Woche vom 20. April 2026 — 3 neue Anleitungen

  • 🧊 Hunyuan World 2.0 🆕 — Tencents erstes Open-Source-3D-Weltmodell. Text/Bild/Video → bearbeitbares Mesh + 3D Gaussian Splatting für Unity/Unreal/Blender. ~1,2B Parameter BF16, 12–24 GB VRAM — Anleitung

  • 🤖 GLM-5.1 🆕 — Zhipu AIs 744B MoE / 40B aktives Coding-Kraftpaket. 200K Kontext, MIT-Lizenz, Platz 1 auf SWE-Bench Pro (58,4 %) vor Claude Opus 4.6 und GPT-5.4 — Anleitung

  • 🔊 MOSS-TTS 🆕 — ultraleichtes 100M-Parameter-TTS von OpenMOSS. 48kHz Stereo, 20 Sprachen, CPU-only-Inferenz (keine GPU erforderlich), Zero-Shot-Stimmenklonen, Apache 2.0 — Anleitung

Branchenhinweise (13.–20. April 2026)

Diese Woche gestartete Closed-Source- oder API-only-Modelle — noch nicht auf Clore selbst hostbar. Zu jedem haben wir die nächstliegende offene Alternative verlinkt, die du heute auf Clore ausführen kannst.

  • Alibaba Happy Oyster — interaktives Echtzeit-3D-Weltmodell (Roaming- und Directing-Modi). Warteliste / geschlossene Beta. → Selbst hostbare Alternative: Hunyuan World 2.0

  • ByteDance Seedance 2.0 API — am 14. April auf Volcano Engine vollständig geöffnet, nur API. → Selbst hostbare Alternativen: Wan 2.2 VBVR, LTX-2

  • Qwen 3.6-Plus — Alibabas proprietärer 1M-Kontext-Coding-Agent. Nur API. → Selbst hostbare Alternativen: Qwen3.5-Omni, GLM-5.1

  • Meta Muse Spark — Metas erstes proprietäres Modell nach Llama. → Selbst hostbare Alternative: Llama 4

  • Wan 2.7 — offene Gewichte noch ausstehend für Q2 2026 (derzeit nur API über Together AI). → Heute selbst hosten: Wan 2.2 VBVR

Woche vom 13. April 2026 — 2 neue Anleitungen

  • 🤖 Qwen3.5-Omni 🆕 — Alibabas einheitliches multimodales Modell: Text-, Audio-, Bild- und Video-Verständnis + Text- und Sprachgenerierung in einem 30B MoE. INT4 passt in 24GB VRAM. Apache 2.0 — Anleitung

  • 🎬 Wan 2.2 VBVR 🆕 — Video-Based Video Reference für konsistente Bewegungssteuerung. Verwende einen Referenzclip, um Animationen in neuer Videogenerierung zu steuern. FP8 läuft auf der RTX 3090 (16–24GB). ComfyUI-Workflow enthalten — Anleitung

Branchenhinweise (6.–13. April 2026)

Nur API oder offene Gewichte noch ausstehend — selbst hostbare Alternativen sind verlinkt.

  • Wan 2.7 (Alibaba) — Generierung von Erst- und Letztbild, Video-zu-Video-Bearbeitung, Referenzierung von Motiven. Offene Gewichte werden Mitte Q2 2026 erwartet. → Heute selbst hosten: Wan 2.2 VBVR, Wan2.1

  • Qwen3.6-Plus (Alibaba) — 1M-Kontextfenster, agentisches Coding. Veröffentlichung offener Gewichte ausstehend. → Selbst hostbare Alternativen: Qwen3.5, GLM-5.1

  • LTX 2.3 — neues LTX-Videoerzeugungsmodell, 22B Parameter, 32GB VRAM als Basis. → Aktuelle offene Version verwenden: LTX-2

🔥 Was ist neu (März 2026)

Woche vom 30. März 2026 — 1 neue Anleitung

  • 🔊 Voxtral TTS 🆕 — Mistrals offenes 4B-TTS-Modell, 9 Sprachen, Zero-Shot-Stimmenklonen aus 3s Referenz, nur 3 GB VRAM, Apache 2.0 — Anleitung

Branchenhinweise (23.–30. März)

Nur API / eingestellt — selbst hostbare Alternativen sind verlinkt.

  • Seedance 2.0 (ByteDance) — Video-Gen der nächsten Generation, gestartet in CapCut/Dreamina. Nur API. → Selbst hostbare Alternativen: Wan2.1, LTX-2

  • Google Lyria 3 Pro — Musikgenerierung über Gemini API/Vertex AI. Nur API. → Selbst hostbare Alternative: ACE-Step

  • Gemini 3 Deep Think — Googles Frontier-Reasoning-Modell, nur API. → Selbst hostbare Alternativen: DeepSeek-R1, GLM-5.1

  • Sora-Abschaltung — OpenAI hat die Sora-Videoerzeugungs-App offiziell eingestellt. → Selbst hostbare Alternative: OpenSora

  • DeepSeek V4 ✅ — am 22. April 2026 mit vollständigen offenen Gewichten ausgeliefert (MIT). Siehe aktualisierte Anleitung.

Woche vom 16. März 2026 — 3 neue Anleitungen

  • 🤖 NVIDIA Nemotron 3 Super 🆕 — 120B MoE / 12B aktiv, 5× Durchsatz, 1M Kontext, Apache 2.0, gebaut für agentische KI — Anleitung

  • 🌐 Gemini 3.1 Flash Lite 🆕 — Googles günstigstes/schnellstes Modell (3. März 2026), API + Open-Source-Alternativen — Anleitung

  • 🎬 CubeComposer 4K 360° Video 🆕 — erstes Modell, das nativ 4K-360°-Panoramavideo aus Standardmaterial erzeugt (CVPR 2026) — Anleitung

Auch diese Woche (9.–16. März 2026)

  • GPT-5.4 — veröffentlicht am 5. März 2026; native Computer-Nutzung (75,0 % OSWorld), 1M Kontext. Nur API, keine lokale Bereitstellung. → Selbst hostbare Alternativen: GLM-5.1, DeepSeek-R1

  • DeepSeek V4 ✅ — veröffentlicht am 22. April 2026, MIT, 1,6T-Pro / 284B-Flash. Anleitung.

  • Wan 2.2 — neue Version des Wan-Basismodells für Videoerzeugung. → Selbst hosten: Wan 2.2 VBVR, Wan2.1

Neu im März 2026 — 6 neue Kategorien, 57 neue Anleitungen

Neu hinzugefügte Modelle (4. März 2026)

  • DeepSeek V4 ✅ — 1,6T-Pro / 284B-Flash MoE, MIT-Lizenz, am 22. April 2026 ausgeliefertAnleitung

  • MiniMax Speech 2.6 🆕 — TTS mit extrem geringer Latenz für Sprachagenten, < 300 ms TTFB — Anleitung

  • SGLang 🆕 — RadixAttention für KV-Cache-Sharing, 2–5× Durchsatz gegenüber vLLM bei MoE — Anleitung

  • TGI 🆕 — HuggingFaces produktionsreifes LLM-Serving mit Flash Attention 2 + PagedAttention — Anleitung

  • LLaMA-Factory 🆕 — über 100 LLMs mit WebUI, LoRA/QLoRA, RLHF feinabstimmen — Anleitung

  • Fish Speech 🆕 — Zero-Shot-Stimmenklonen in 8+ Sprachen aus 10–15 s Referenz-Audio — Anleitung

  • Mochi-1 🆕 — Video-Diffusion mit 10B Parametern, 848×480 bei 30 fps, 24GB VRAM — Anleitung

Zuvor hinzugefügt (Februar 2026)

  • Qwen3.5 — Alibabas 397B MoE, schlug Claude 4.5 Opus bei Mathematik

  • GLM-5 — 744B MoE von Zhipu AI, MIT-Lizenz, Platz 1 in Open-Source-Rankings

  • Ling-2.5-1T — das Billionen-Parameter-Modell von Ant Group mit linearer Aufmerksamkeit

  • Kimi K2.5 — Moonshot AIs 1T MoE, MIT-Lizenz, visuell-agentisch

  • Mistral Large 3 — 675B MoE, Apache 2.0, Frontier-Coding & Reasoning

  • Llama 4 Scout/Maverick — Metas MoE-Revolution, 10M-Kontextfenster

  • Gemma 3 — Googles 27B, das 405B-Modelle schlägt

  • FLUX.2 Klein — Bildgenerierung in unter einer Sekunde (< 0,5 s auf RTX 4090)

  • HunyuanImage 3.0 — 80B MoE, größtes Open-Source-Bildmodell

  • ACE-Step 1.5 — vollständige Songgenerierung mit < 4GB VRAM

  • FramePack — KI-Video mit nur 6GB VRAM

  • Qwen3-TTS — Stimmenklonen in 10+ Sprachen aus 3 Sekunden Audio

  • Kani-TTS-2 — ultraleichtes TTS, nur 3GB VRAM

  • DeepSeek-R1 — Reasoning-Modell, das OpenAI o1 entspricht

Zuvor hinzugefügte Kategorien (Februar 2026)

  • 🤖 KI-Plattformen & Agenten — 18 Anleitungen: Dify, CrewAI, AutoGPT, OpenHands, MetaGPT, n8n, LibreChat, Open Interpreter, SuperAGI, SWE-agent

  • 🎵 Musikgenerierung — KI-komponierte Songs mit Gesang (ACE-Step)

  • 💻 KI-Coding-Tools — selbst gehostete Copilot-Alternativen (Aider, TabbyML)

  • 🔧 OpenClaw auf Clore — betreibe deinen KI-Assistenten rund um die Uhr auf gemieteten GPUs

💰 GPU-Preise (April 2026)

Momentaufnahme typischer Clore.ai-Marktplatz-Spannen, Ende April 2026. Siehe clore.ai/marketplace für Live-Daten — Spot-Bestellungen sind typischerweise 20–40 % günstiger als On-Demand.

GPU
VRAM
Typisch /h
Am besten geeignet für
Landingpage

RTX 3060

12GB

0,16–1,00 $

TTS, kleine Modelle, Musikgenerierung

RTX 3070

8GB

0,17–3,33 $

7B-Modelle, Whisper, Batch-Inferenz

RTX 3080

10GB

0,20–3,50 $

7B–14B-Modelle, Bildgenerierung

RTX 3090

24GB

0,33–4,00 $

SDXL, 32B Q4, Ling-2.6-flash INT4

RTX 4070 Ti

12GB

0,30–2,00 $

SDXL, ComfyUI, 7B-Modelle

RTX 4080

16GB

0,45–3,50 $

FLUX, 14B-Modelle, Feinabstimmung

RTX 4090

24GB

0,70–4,50 $

FLUX, Llama 4, Qwen3.6-27B Q4, Ling-2.6-flash

RTX 5080

16GB

0,90–9,00 $

Schnelles FLUX, 30B-LLMs, Blackwell FP4

RTX 5090

32GB

1,72–10,00 $

70B quantisiert, Qwen3.6-27B Q8, Nemotron 3 Super

RTX A6000

48GB

1,50–4,00 $

70B BF16, Qwen3.6-27B BF16

L40S

48GB

2,00–9,00 $

FP8-Rechenzentrums-Inferenz, 27B auf einer einzigen GPU

A100 80GB

80GB

2,00–6,00 $

Hy3 Preview FP8, MiniMax M2.7, Training

H100 80GB

80GB

4,00–9,00 $

DeepSeek V4 Pro, MiMo-V2.5-Pro, Frontier-Inferenz

H200 141GB

141GB

6,00–14,00 $

DeepSeek V4 auf einem einzelnen Knoten, vollständiges BF16

B200 192GB

192GB

8,00–18,00 $

Frontier-Training, MiMo-V2.5-Pro 8×-Cluster

Du möchtest ungenutzte GPUs monetarisieren? Siehe die Host-Seiten für monatliche Verdienstschätzungen pro Kartentyp.

🚀 Schnellstart

Neu bei Clore.ai? → Schnellstart-Anleitung

Weißt du schon, was du brauchst?

Ich möchte ...
Hier beginnen

Lokal mit KI chatten

Ein Frontier-Coding-LLM ausführen

Ein Coding-LLM mit einer einzelnen GPU ausführen

Qwen3.6-27B (RTX 4090 Q4) oder Ling-2.6-flash

Bilder generieren

Videos generieren

FramePack (6 GB!) oder Wan2.1

Eine Stimme klonen

Audio transkribieren

Ein Modell feinabstimmen

Unsloth (2× schneller, 70 % weniger VRAM)

Musik generieren

ACE-Step (< 4GB VRAM!)

Copilot selbst hosten

TabbyML (4,50 $/Monat)

Eine KI-Agentenplattform ausführen

ChatGPT-Alternative selbst hosten

KI-Assistenten 24/7 betreiben

Die richtige GPU auswählen

📖 Dokumentation & Support

Zuletzt aktualisiert

War das hilfreich?