> For the complete documentation index, see [llms.txt](https://docs.clore.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.clore.ai/guides/guides_v2-hi/language-models.md).

# भाषा मॉडल

- [अवलोकन](https://docs.clore.ai/guides/guides_v2-hi/language-models/language-models.md)
- [Ollama](https://docs.clore.ai/guides/guides_v2-hi/language-models/ollama.md): Clore.ai GPUs पर Ollama के साथ LLMs को लोकली चलाएँ
- [Open WebUI](https://docs.clore.ai/guides/guides_v2-hi/language-models/open-webui.md): Clore.ai GPUs पर LLM चलाने के लिए ChatGPT-जैसा इंटरफ़ेस
- [vLLM](https://docs.clore.ai/guides/guides_v2-hi/language-models/vllm.md): Clore.ai GPUs पर vLLM के साथ उच्च-थ्रूपुट LLM इन्फ़रेंस
- [Llama.cpp सर्वर](https://docs.clore.ai/guides/guides_v2-hi/language-models/llamacpp-server.md): Clore.ai GPUs पर llama.cpp सर्वर के साथ कुशल LLM इन्फ़रेंस
- [Text Generation WebUI](https://docs.clore.ai/guides/guides_v2-hi/language-models/text-generation-webui.md): Clore.ai GPUs पर LLM इन्फ़रेंस के लिए text-generation-webui चलाएँ
- [ExLlamaV2](https://docs.clore.ai/guides/guides_v2-hi/language-models/exllamav2-fast.md): Clore.ai GPUs पर ExLlamaV2 के साथ अधिकतम गति वाला LLM इन्फ़रेंस
- [LocalAI](https://docs.clore.ai/guides/guides_v2-hi/language-models/localai-openai-compatible.md): Clore.ai पर LocalAI के साथ स्व-होस्टेड, OpenAI-संगत API
- [Llama 3.3 70B](https://docs.clore.ai/guides/guides_v2-hi/language-models/llama33.md): Clore.ai GPUs पर Meta का Llama 3.3 70B मॉडल चलाएँ
- [Mistral & Mixtral](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-mixtral.md): Clore.ai GPUs पर Mistral और Mixtral मॉडल चलाएँ
- [DeepSeek Coder](https://docs.clore.ai/guides/guides_v2-hi/language-models/deepseek-coder.md): Clore.ai पर DeepSeek Coder के साथ सर्वोत्तम-श्रेणी का कोड जनरेशन
- [DeepSeek-V3](https://docs.clore.ai/guides/guides_v2-hi/language-models/deepseek-v3.md): Clore.ai GPUs पर असाधारण रीजनिंग के साथ DeepSeek-V3 चलाएँ
- [DeepSeek-R1 रीजनिंग मॉडल](https://docs.clore.ai/guides/guides_v2-hi/language-models/deepseek-r1.md): Clore.ai GPUs पर DeepSeek-R1 ओपन-सोर्स रीजनिंग मॉडल चलाएँ
- [Qwen2.5](https://docs.clore.ai/guides/guides_v2-hi/language-models/qwen25.md): Clore.ai GPUs पर Alibaba के Qwen2.5 मल्टीलिंगुअल LLMs चलाएँ
- [CodeLlama](https://docs.clore.ai/guides/guides_v2-hi/language-models/codellama.md): Clore.ai पर CodeLlama के साथ कोड जनरेट, पूरा, और समझाएँ
- [Gemma 2](https://docs.clore.ai/guides/guides_v2-hi/language-models/gemma2.md): Clore.ai GPUs पर Google के Gemma 2 मॉडल कुशलतापूर्वक चलाएँ
- [Phi-4](https://docs.clore.ai/guides/guides_v2-hi/language-models/phi4.md): Clore.ai GPUs पर Microsoft का Phi-4 छोटा भाषा मॉडल चलाएँ
- [Llama 4 (Scout & Maverick)](https://docs.clore.ai/guides/guides_v2-hi/language-models/llama4.md): Clore.ai GPUs पर Meta Llama 4 Scout & Maverick MoE मॉडल चलाएँ
- [Gemma 3](https://docs.clore.ai/guides/guides_v2-hi/language-models/gemma3.md): Clore.ai पर Google Gemma 3 मल्टिमोडल मॉडल चलाएँ — 15x छोटे आकार पर Llama-405B से बेहतर
- [Gemma 4 (26B MoE, 4B active)](https://docs.clore.ai/guides/guides_v2-hi/language-models/gemma4.md): Clore.ai पर Google द्वारा Gemma 4 (26B MoE, 4B active) डिप्लॉय करें — अप्रैल 2026 में जारी ओपन-वेट मॉडल, जो चढ़ा
- [Mistral Small 3.1](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-small.md): Clore.ai पर Mistral Small 3.1 (24B) डिप्लॉय करें — आदर्श सिंगल-GPU प्रोडक्शन मॉडल
- [Qwen3.5](https://docs.clore.ai/guides/guides_v2-hi/language-models/qwen35.md): Clore.ai पर Alibaba Qwen3.5 चलाएँ — सबसे नया फ्रंटियर मॉडल (फ़रवरी 2026)
- [Qwen3.5-Omni (मल्टिमोडल)](https://docs.clore.ai/guides/guides_v2-hi/language-models/qwen35-omni.md)
- [GLM-5](https://docs.clore.ai/guides/guides_v2-hi/language-models/glm5.md): Clore.ai पर Zhipu AI द्वारा GLM-5 (744B MoE) डिप्लॉय करें — vLLM के साथ API एक्सेस और स्व-होस्टिंग
- [GLM-4.7-Flash](https://docs.clore.ai/guides/guides_v2-hi/language-models/glm-47-flash.md): Clore.ai पर Zhipu AI द्वारा GLM-4.7-Flash (30B MoE) डिप्लॉय करें — 59.2% SWE-bench प्रदर्शन वाला कुशल भाषा मॉडल
- [Kimi K2.5](https://docs.clore.ai/guides/guides_v2-hi/language-models/kimi-k2.md): Clore.ai GPUs पर Moonshot AI द्वारा Kimi K2.5 (1T MoE मल्टिमोडल) डिप्लॉय करें
- [Mistral Large 3 (675B MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-large3.md): Clore.ai GPUs पर Mistral Large 3 चलाएँ — 41B सक्रिय पैरामीटर वाला 675B MoE फ्रंटियर मॉडल
- [Mistral Medium 3.5 (128B Dense, 256K)](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-medium35.md): Clore.ai पर Mistral Medium 3.5 डिप्लॉय करें — 128B डेंस, 256K संदर्भ, दोहरे-मोड रीजनिंग के साथ अप्रैल 2026 में जारी। 4× H100 या 2× H200 पर प्रोडक्शन vLLM/SGLang सेटअप।
- [MiMo-V2-Flash](https://docs.clore.ai/guides/guides_v2-hi/language-models/mimo-v2-flash.md): Clore.ai पर speculative decoding के साथ MiMo-V2-Flash (309B MoE) डिप्लॉय करें — 150+ tok/s के साथ अल्ट्रा-फ़ास्ट इन्फ़रेंस
- [Ling-2.5-1T (1 ट्रिलियन पैरामीटर)](https://docs.clore.ai/guides/guides_v2-hi/language-models/ling25.md): Clore.ai GPUs पर Ling-2.5-1T चलाएँ — Ant Group का 1 ट्रिलियन पैरामीटर ओपन-सोर्स LLM, हाइब्रिड लिनियर अटेंशन के साथ
- [LFM2-24B-A2B](https://docs.clore.ai/guides/guides_v2-hi/language-models/lfm2-24b.md): Clore.ai पर Liquid AI द्वारा LFM2-24B-A2B डिप्लॉय करें — हाइब्रिड SSM+Attention आर्किटेक्चर, 24B कुल / 2B सक्रिय पैरामीटर के साथ
- [DeepSeek V4 (1.6T MoE, मल्टिमोडल)](https://docs.clore.ai/guides/guides_v2-hi/language-models/deepseek-v4.md): Clore.ai पर DeepSeek V4 डिप्लॉय करें — MIT-लाइसेंस वाला फ्रंटियर MoE, Flash-0731 और Pro-0813 के रूप में रिफ़्रेश किया गया
- [GLM-5.1 (744B MoE, #1 SWE-Bench Pro)](https://docs.clore.ai/guides/guides_v2-hi/language-models/glm-5-1.md): Clore.ai पर Z.ai द्वारा GLM-5.1 (744B MoE, 40B active) डिप्लॉय करें — अप्रैल 2026 में SWE-Bench Pro में शीर्ष पर रहने वाला ओपन-वेट मॉडल
- [NVIDIA Nemotron 3 Super (120B MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/nvidia-nemotron-3-super.md)
- [जेमिनी 3.1 फ्लैश लाइट](https://docs.clore.ai/guides/guides_v2-hi/language-models/gemini-3-1-flash-lite.md)
- [Hy3 Preview (Tencent Hunyuan 3, 295B MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/hy3-preview.md): Clore.ai पर Tencent का Hy3 Preview (295B MoE, 21B active, 256K ctx) डिप्लॉय करें — Tencent Hunyuan के पुनर्निर्मित ट्रेनिंग स्टैक का पहला मॉडल, लंबी-क्षितिज रीजनिंग और एजेंटिक कोडिंग के लिए ट्यून किया गया
- [MiMo-V2.5-Pro (Xiaomi 1T MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/mimo-v25-pro.md): Clore.ai पर Xiaomi द्वारा MiMo-V2.5-Pro (1.02T MoE, 42B active, 1M संदर्भ) डिप्लॉय करें — MiMo टीम का पहला ओपन-वेट Pro tier, FP8 नेटिव, हाइब्रिड अटेंशन
- [MiniMax M2.7 (229B MoE Coding)](https://docs.clore.ai/guides/guides_v2-hi/language-models/minimax-m27.md): Clore.ai पर MiniMax M2.7 (229B MoE) डिप्लॉय करें — MiniMax के कोडिंग एजेंट अभियान के पीछे का ओपन-वेट स्व-होस्टेड रिलीज़, H100/H200 पर FP8 सिंगल-नोड डिप्लॉयमेंट के साथ
- [Ling-2.6-flash (Ant Group 104B MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/ling-26-flash.md): Clore.ai पर Ant Group द्वारा Ling-2.6-flash (104B MoE, 7.4B active) डिप्लॉय करें — एजेंट-ट्यून किया गया flash सिबलिंग जो एक RTX 4090 पर फिट हो जाता है
- [Qwen3.6-27B (डेंस, सिंगल-GPU)](https://docs.clore.ai/guides/guides_v2-hi/language-models/qwen36-27b.md): Clore.ai पर Alibaba द्वारा Qwen3.6-27B डिप्लॉय करें — 27B डेंस मॉडल जो एक RTX 4090 पर फिट हो जाता है और 262K नेटिव संदर्भ के साथ आता है
- [Qwen3.8-27B (डेंस VLM, एक कार्ड)](https://docs.clore.ai/guides/guides_v2-hi/language-models/qwen38-27b.md): Clore.ai पर Qwen3.8-27B डिप्लॉय करें — Alibaba का डेंस 27B विज़न-लैंग्वेज मॉडल, जो Q4 पर एक RTX 4090 और FP8 पर एक RTX 5090 पर चलता है
- [GLM-5.2 (MIT, 1M संदर्भ)](https://docs.clore.ai/guides/guides_v2-hi/language-models/glm-5-2.md): Clore.ai मार्केटप्लेस से एक बड़े मल्टी-GPU रिग पर GLM-5.2 चलाएँ, जो Z.ai का MIT-लाइसेंस वाला 1M-कॉन्टेक्स्ट कोडिंग फ्लैगशिप है
- [MiniMax M3 (428B मल्टीमोडल)](https://docs.clore.ai/guides/guides_v2-hi/language-models/minimax-m3.md): Clore.ai के मल्टी-GPU रिग्स पर MiniMax M3 डिप्लॉय करें, जो 1M-टोकन संदर्भ वाला 428B नेटिव मल्टीमोडल MoE है
- [NVIDIA Nemotron 3 Ultra (550B Mamba-MoE)](https://docs.clore.ai/guides/guides_v2-hi/language-models/nemotron-3-ultra.md): Clore.ai मार्केटप्लेस के Blackwell रिग्स पर NVIDIA Nemotron 3 Ultra, 550B ओपन Mamba-MoE हाइब्रिड, चलाएँ
- [Mistral Small 4 (119B MoE, 6.5B Active)](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-small4.md): Clore.ai मार्केटप्लेस से दो कंज़्यूमर GPU पर Mistral Small 4 (119B MoE, 6.5B active) डिप्लॉय करें — Apache 2.0, 256K संदर्भ, और एक ही मॉडल में विज़न तथा रीजनिंग
- [Kimi K3 (2.8T — इसके लिए क्या चाहिए)](https://docs.clore.ai/guides/guides_v2-hi/language-models/kimi-k3.md): Kimi K3 क्या है, 2.8 ट्रिलियन पैरामीटर को स्वयं होस्ट करने के लिए वास्तव में क्या चाहिए, और इसके बजाय Clore.ai पर क्या चलाना चाहिए
- [TGI (Text Generation Inference)](https://docs.clore.ai/guides/guides_v2-hi/language-models/tgi.md): Clore.ai GPUs पर प्रोडक्शन LLM सर्विंग के लिए HuggingFace Text Generation Inference (TGI) चलाएँ
- [SGLang](https://docs.clore.ai/guides/guides_v2-hi/language-models/sglang.md): Clore.ai GPUs पर RadixAttention के साथ उच्च-प्रदर्शन LLM सर्विंग के लिए SGLang डिप्लॉय करें
- [Aphrodite Engine](https://docs.clore.ai/guides/guides_v2-hi/language-models/aphrodite-engine.md): Clore.ai पर पुराने और आधुनिक GPU पर LLM इन्फ़रेंस के लिए Aphrodite Engine चलाएँ
- [LiteLLM AI Gateway](https://docs.clore.ai/guides/guides_v2-hi/language-models/litellm.md): Clore.ai GPUs पर 100+ LLMs के लिए AI Gateway प्रॉक्सी के रूप में LiteLLM डिप्लॉय करें
- [MLC-LLM](https://docs.clore.ai/guides/guides_v2-hi/language-models/mlc-llm.md)
- [PowerInfer](https://docs.clore.ai/guides/guides_v2-hi/language-models/powerinfer.md)
- [LMDeploy](https://docs.clore.ai/guides/guides_v2-hi/language-models/lmdeploy.md)
- [Mistral.rs](https://docs.clore.ai/guides/guides_v2-hi/language-models/mistral-rs.md)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.clore.ai/guides/guides_v2-hi/language-models.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
