> For the complete documentation index, see [llms.txt](https://docs.clore.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.clore.ai/guides/guides_v2-ru/yazykovye-modeli/kimi-k3.md).

# Kimi K3 (2.8T — что для этого нужно)

Что такое Kimi K3, что на самом деле нужно, чтобы самостоятельно хостить 2.8 триллиона параметров, и что вместо этого запускать на Clore.ai

{% hint style="danger" %}
**Короткий ответ: Kimi K3 не помещается ни на одном сервере, указанном на маркетплейсе Clore.ai, ни при какой квантизации.** Самая маленькая сборка сообщества — это 1-битный GGUF размером **466 ГБ**; самый большой сервер на маркетплейсе — 380 ГБ. На этой странице объясняется, что такое K3, что на самом деле нужно для его хостинга, и какие модели дают вам максимум возможностей на оборудовании, которое можно арендовать уже сегодня.
{% endhint %}

Moonshot AI опубликовала **Kimi K3** веса **27 июля 2026** — первую открытую модель в классе с 3 триллионами параметров. Это настоящий рубеж, а также полезная точка отсчёта для того, насколько далеко друг от друга разошлись «открытые веса» и «возможность самостоятельного хостинга».

### Ключевые характеристики

| Параметр    | Значение                                                                                                                              |
| ----------- | ------------------------------------------------------------------------------------------------------------------------------------- |
| Параметры   | 2,8 трлн всего, активны 16 из 896 экспертов на токен                                                                                  |
| Архитектура | Kimi Delta Attention (KDA) + остаточные состояния внимания, Stable LatentMoE, 69 слоёв KDA + 24 слоя Gated MLA                        |
| Модальность | Текст, изображение, видео на вход → текст на выход                                                                                    |
| Контекст    | 1 000 000 токенов                                                                                                                     |
| Лицензия    | Лицензия Kimi K3 (индивидуальная — для коммерческого инференса при годовой выручке выше примерно $20 млн требуются отдельные условия) |
| Выпуск      | Развёрнута 16 июля 2026, веса — 27 июля 2026                                                                                          |
| Веса        | Q8 1 561 ГБ · Q4\_K\_XL 1 509 ГБ · Q2\_K\_XL 861 ГБ · IQ1\_S 594 ГБ · Q1\_0 466 ГБ                                                    |

Moonshot утверждает примерно **в 2,5 раза лучшую эффективность масштабирования, чем у Kimi K2** за счёт более разреженной MoE и стека внимания KDA, а также нативного мультимодального обучения, а не прикрученной впоследствии визуальной башни.

## Что на самом деле требуется для хостинга

| Сборка                   | Размер   | Необходимое оборудование      |
| ------------------------ | -------- | ----------------------------- |
| `UD-Q8_K_XL`             | 1 561 ГБ | \~20× H100 80 ГБ              |
| `UD-Q4_K_XL`             | 1 509 ГБ | \~20× H100 80 ГБ              |
| `UD-Q2_K_XL`             | 861 ГБ   | \~11× H100 80 ГБ, или 8× H200 |
| `UD-IQ1_S`               | 594 ГБ   | \~8× H100 80 ГБ               |
| `UD-Q1_0`                | 466 ГБ   | \~6× H100 80 ГБ               |
| `mgoin/Kimi-K3-pruned75` | 475 ГБ   | \~6× H100 80 ГБ               |

Для справки: самые крупные серверы на маркетплейсе Clore.ai — это 4× RTX PRO 6000 Blackwell (380 ГБ) и 11× RTX 5090 (341 ГБ). Даже 1-битная сборка их превосходит, и в любом случае 1-битная квантизация передовой модели — не серьёзная цель для продакшена.

{% hint style="info" %}
**Если вам действительно нужно обслуживать K3**, это [голое железо](https://clore.ai/bare-metal) разговор — нужны выделенные узлы H200 или B200, предоставляемые по запросу, а не арендуемые поминутно. Сначала проверьте лицензию: условия ограничивают коммерческий инференс при годовой выручке выше примерно $20 млн.
{% endhint %}

## Что запускать на Clore.ai вместо этого

| Если вам нужен был K3 для…                | Запускайте это                                                                                                              | Помещается на                    |
| ----------------------------------------- | --------------------------------------------------------------------------------------------------------------------------- | -------------------------------- |
| Передовое кодирование и агенты            | [GLM-5.2](/guides/guides_v2-ru/yazykovye-modeli/glm-5-2.md) — MIT, контекст 1 млн, лучшие открытые результаты в кодировании | сервер с 10× RTX 5090, \~$5.00/ч |
| Мультимодальность с длинным контекстом    | [MiniMax M3](/guides/guides_v2-ru/yazykovye-modeli/minimax-m3.md) — контекст 1 млн, нативное видео                          | 8× RTX 5090, \~$2.00–3.50/ч      |
| Открытое рассуждение в масштабе           | [Nemotron 3 Ultra](/guides/guides_v2-ru/yazykovye-modeli/nemotron-3-ultra.md) — 550B, лицензия OpenMDW                      | 4× RTX PRO 6000, \~$5.00/ч       |
| Одна модель на одной карте                | [Qwen3.8-27B](/guides/guides_v2-ru/yazykovye-modeli/qwen38-27b.md) — Apache 2.0, vision, контекст 262K                      | 1× RTX 4090, $0.14–0.42/ч        |
| Лучшее качество на каждый арендованный ГБ | [Mistral Small 4](/guides/guides_v2-ru/yazykovye-modeli/mistral-small4.md) — 119B / 6,5B активных                           | 2× RTX 4090, \~$0.28–0.84/ч      |

Честное резюме: с июня 2026 года открытый фронтир разделился. Модели вроде GLM-5.2 и Nemotron 3 Ultra находятся на грани того, что может вместить большой потребительский сервер; K3 уже за этой гранью. Большая часть практического разрыва между ними сглаживается хорошей оболочкой и длинным контекстом — и то и другое дают модели выше.

## Использование K3 без его хостинга

Moonshot предоставляет K3 через приложение Kimi, Kimi Code и свой API. Если вы строите решение на Clore.ai, распространённый подход — оставить дорогие запросы к передовой модели на API, а массовый поток запускать локально на арендованном GPU — см. сравнение стоимости в [Gemini 3.1 Flash Lite](/guides/guides_v2-ru/yazykovye-modeli/gemini-3-1-flash-lite.md), где разбирается, когда самостоятельный хостинг действительно выигрывает.

## Дальнейшие шаги

* [GLM-5.2](/guides/guides_v2-ru/yazykovye-modeli/glm-5-2.md) — крупнейшая модель, которую здесь реально можно арендовать
* [Цены и доступность GPU](/guides/guides_v2-ru/nachalo-raboty/pricing.md) — каков текущий потолок
* [Qwen3.8-27B](/guides/guides_v2-ru/yazykovye-modeli/qwen38-27b.md) — рабочая лошадка на одной карте
* [Kimi K2.5](/guides/guides_v2-ru/yazykovye-modeli/kimi-k2.md) — предыдущее поколение, куда более практичное

### Ссылки

* [Kimi K3 на Hugging Face](https://huggingface.co/moonshotai/Kimi-K3) · [Сборки GGUF](https://huggingface.co/unsloth/Kimi-K3-GGUF)
* [Лицензия Kimi K3](https://huggingface.co/moonshotai/Kimi-K3/blob/main/LICENSE)
* **Арендовать GPU:** [Маркетплейс](https://clore.ai/marketplace) · [Выделенное железо](https://clore.ai/bare-metal)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.clore.ai/guides/guides_v2-ru/yazykovye-modeli/kimi-k3.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
