> For the complete documentation index, see [llms.txt](https://docs.clore.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.clore.ai/guides/guides_v2-fr/premiers-pas/pricing.md).

# Tarifs et disponibilité des GPU

Ce qui est réellement listé sur le marketplace Clore.ai actuellement, et le coût par heure GPU

{% hint style="info" %}
**Instantané : 24 août 2026.** Les chiffres ci-dessous proviennent de l'annonce en direct de la place de marché : **2,202 serveurs / 6,791 GPU**, dont **1,198 serveurs étaient disponibles à la location** au moment de l'instantané. Les prix sont **par GPU et par heure**, à la demande, en USD. La place de marché elle-même fait foi — vérifiez [clore.ai/marketplace](https://clore.ai/marketplace) avant d'établir votre budget.
{% endhint %}

Clore.ai facture à la minute. Un prix affiché ici comme `$0.20/hr` signifie que vous payez environ `$0.0033` par minute de disponibilité, et rien lorsque la commande est clôturée. L'interface de la place de marché peut afficher soit **par heure** ou **par jour** — cette page, et chaque guide de cette collection, cite **par GPU et par heure**.

## Combien ça coûte

Les fourchettes correspondent aux 10e au 90e percentiles des serveurs qui étaient libres à la location dans l'instantané, donc le bas de la fourchette est ce qu'un locataire patient paie et le haut de la fourchette est une annonce premium.

| GPU                    | VRAM      | $/GPU/hr       | Médiane   | Serveurs disponibles |
| ---------------------- | --------- | -------------- | --------- | -------------------- |
| RTX 3060               | 12 Go     | $0.03–0.07     | $0.04     | 32                   |
| RTX 3060 Ti            | 8 Go      | $0.03–0.10     | $0.05     | 15                   |
| RTX 3070               | 8 Go      | $0.03–0.09     | $0.05     | 54                   |
| RTX 3080               | 10GB      | $0.05–0.19     | $0.08     | 68                   |
| RTX 3080 Ti            | 12 Go     | $0.06–0.19     | $0.10     | 48                   |
| **RTX 3090**           | **24GB**  | **$0.07–0.21** | **$0.09** | **90**               |
| RTX 4060 Ti            | 8 Go      | $0.04–0.12     | $0.06     | 16                   |
| RTX 4070               | 12 Go     | $0.04–0.20     | $0.07     | 24                   |
| RTX 4070 Ti            | 12 Go     | $0.07–0.25     | $0.12     | 24                   |
| RTX 4070 Ti SUPER      | 16 Go     | $0.08–0.19     | $0.12     | 28                   |
| RTX 4080 SUPER         | 16 Go     | $0.09–0.17     | $0.12     | 22                   |
| **RTX 4090**           | **24GB**  | **$0.14–0.42** | **$0.20** | **98**               |
| RTX 5060 Ti            | 16 Go     | $0.04–0.10     | $0.06     | 29                   |
| RTX 5070               | 12 Go     | $0.07–0.29     | $0.11     | 40                   |
| RTX 5070 Ti            | 16 Go     | $0.10–0.25     | $0.13     | 103                  |
| RTX 5080               | 16 Go     | $0.12–0.62     | $0.17     | 56                   |
| **RTX 5090**           | **32 Go** | **$0.25–0.77** | **$0.29** | **121**              |
| RTX PRO 6000 Blackwell | 96GB      | $0.92–1.38     | $1.21     | 4                    |
| Tesla V100 SXM2        | 32 Go     | $0.05–0.06     | $0.05     | rare                 |
| RTX A6000              | 48GB      | \~$0.36        | $0.36     | 2 GPU au total       |
| H100 NVL               | 94GB      | \~$1.04        | $1.04     | 4 GPU au total       |
| L40S                   | 48GB      | \~$0.50        | $0.50     | 1 GPU au total       |

La flotte est très majoritairement composée de puces grand public. **La série RTX 50 représente déjà 19.5% de tous les GPU listés** (1,321 cartes), la série 30 est le segment de volume, et la série 40 se situe entre les deux.

## Ce qui n'est pas sur la place de marché

{% hint style="warning" %}
**A100, H200 et B200 ne sont pas listés sur la place de marché aujourd'hui.** Pas « rare » — zéro. Il y a 4 GPU H100 NVL répartis sur 2 serveurs, 2 A6000 et 1 L40S. Si un guide dimensionne une charge en « 8× H100 », cette configuration ne peut pas être louée à la demande ici.
{% endhint %}

La capacité de centre de données est vendue séparément sous la forme de [bare metal](https://clore.ai/bare-metal) — des nœuds H100/H200/B200 dédiés sur demande, sous contrat plutôt qu'à la minute. Pour tout le reste, le plafond pratique est une machine grand public multi-GPU.

**Les plus grosses configurations listées aujourd'hui :**

| Configuration                  | VRAM totale | Configuration $/h |
| ------------------------------ | ----------- | ----------------- |
| 4× RTX PRO 6000 Blackwell 96GB | 380GB       | \~$5.00           |
| 11× RTX 5090 32GB              | 341GB       | \~$5.42           |
| 10× RTX 5090 32GB              | 310GB       | \~$5.00           |
| 8× Tesla V100 SXM2 32GB        | 256GB       | \~$0.40           |
| 8× RTX 4090 24GB               | 192GB       | \~$1.60           |

Disponibilité par taille, d'après l'instantané :

| Vous avez besoin de                    | Serveurs listés | Disponibles au moment de l'instantané |
| -------------------------------------- | --------------- | ------------------------------------- |
| ≥ 24GB (une carte de classe 3090/4090) | 1,299           | 677                                   |
| ≥ 48GB                                 | 653             | 322                                   |
| ≥ 80GB                                 | 328             | 153                                   |
| ≥ 96GB                                 | 182             | 81                                    |
| ≥ 192GB                                | 54              | 14                                    |
| ≥ 242GB                                | 47              | 9                                     |
| ≥ 352GB                                | 2               | 2                                     |

## Ce qui convient

Correspondance approximative entre la taille des poids du modèle et ce que vous devriez louer. En pratique, ce sont les tailles GGUF quantifiées qui comptent.

| Poids sur disque | Louer ceci                          | Exemple                                                                               |
| ---------------- | ----------------------------------- | ------------------------------------------------------------------------------------- |
| ≤ 16GB           | 1× RTX 3090 / 4090                  | Qwen3.8-27B Q4, Mistral Small 3.1, SDXL, la plupart des TTS                           |
| 16–30GB          | 1× RTX 5090                         | Qwen3.8-27B FP8, 32B Q4/Q6, FLUX en haute résolution                                  |
| 30–60GB          | 2× RTX 4090 / 5090, ou RTX PRO 6000 | Mistral Small 4 Q3–Q4, 70B Q4                                                         |
| 60–192GB         | 4–8× RTX 5090                       | DeepSeek V4-Flash FP8, MiniMax M3 Q2                                                  |
| 192–380GB        | 8–11× RTX 5090, 4× RTX PRO 6000     | Nemotron 3 Ultra Q2, GLM-5.2 Q2                                                       |
| > 380GB          | Pas sur la place de marché          | Kimi K3 à n'importe quelle quantification → [bare metal](https://clore.ai/bare-metal) |

## Spot contre à la demande

Clore.ai propose deux types d'ordres : **à la demande** au prix fixe de l'hôte, et **spot**, où vous enchérissez et pouvez être surenchéri par une offre supérieure.

{% hint style="info" %}
**Le spot n'est pas automatiquement moins cher.** Dans l'instantané, **63% des serveurs affichaient un spot exactement au prix à la demande**. Parmi les 34% qui étaient moins chers, la remise médiane était **13.4%**. Quelques-uns étaient tarifés au-dessus du prix à la demande. Vérifiez la paire réelle sur la carte du serveur plutôt que de supposer une remise.
{% endhint %}

Le spot reste pertinent pour les tâches interrompables — rendu par lots, prétraitement de jeux de données, longs affinages avec checkpoints — car vous pouvez aussi enchérir *au-dessus de* du prix spot indiqué pour conserver une machine que d'autres enchérisseurs veulent.

## Location partielle de GPU

Environ **60% des serveurs listés (1,331 sur 2,202) autorisent la location partielle**: vous retirez 1 ou 2 GPU d'une machine à 8 GPU et ne payez que ceux-là, au lieu de louer la machine entière. Pour les charges à GPU unique, c'est généralement le moyen le moins cher d'obtenir une bonne carte, car les grosses machines sont souvent moins chères par GPU que les petites. Voir [Location partielle de GPU](/guides/guides_v2-fr/premiers-pas/partial-gpu-rental.md).

## Exemples de coûts réels

Calculés à partir des prix médians ci-dessus, avec une facturation à la minute.

| Tâche                                                            | GPU                 | Temps    | Coût        |
| ---------------------------------------------------------------- | ------------------- | -------- | ----------- |
| 1,000 images SDXL                                                | RTX 3090 @ $0.09/hr | \~2 h    | **\~$0.18** |
| 1M tokens via un modèle 27B Q4                                   | RTX 4090 @ $0.20/hr | \~20 min | **\~$0.07** |
| 10 clips vidéo de 6 secondes                                     | RTX 4090 @ $0.20/hr | \~20 min | **\~$0.07** |
| Affinage LoRA, 7B, 1 epoch                                       | RTX 4090 @ $0.20/hr | \~3 h    | **\~$0.60** |
| Transcription Whisper, 10 h d'audio                              | RTX 3060 @ $0.04/hr | \~40 min | **\~$0.03** |
| API TTS en continu 24/7 pendant un mois                          | RTX 3060 @ $0.04/hr | 730 h    | **\~$29**   |
| Point de terminaison de chat 27B toujours actif, pendant un mois | RTX 5090 @ $0.29/hr | 730 h    | **\~$212**  |

## Vérifier les prix vous-même

L'annonce de la place de marché est publique. Les prix du flux sont **par serveur et par jour** en USD — divisez par 24 pour obtenir le tarif horaire, et par le nombre de GPU pour le tarif par GPU :

```bash
curl -s https://clore.ai/webapi/marketplace/servers \
  | python3 -c '
import json,sys,re
for s in json.load(sys.stdin)["all_servers"]:
    gpu = s["specs"]["gpu"]
    n = int(re.match(r"^(\d+)x", gpu).group(1)) if re.match(r"^(\d+)x", gpu) else 1
    usd = (s["price"]["usd"] or {}).get("on_demand_usd") or 0
    if usd and "4090" in gpu and not s["rented"]:
        print(f"{gpu:32} ${usd/n/24:.3f}/GPU/hr")
'
```

## Prochaines étapes

* [Comparaison des GPU](/guides/guides_v2-fr/premiers-pas/gpu-comparison.md) — quelle carte pour quelle charge
* [Location partielle de GPU](/guides/guides_v2-fr/premiers-pas/partial-gpu-rental.md) — louer 1 GPU d'une configuration
* [Calculateur de coût](/guides/guides_v2-fr/premiers-pas/cost-calculator.md) — budgéter une tâche précise
* [Compatibilité CUDA et PyTorch](/guides/guides_v2-fr/premiers-pas/cuda-pytorch-compatibility.md) — choisissez une image qui fonctionne sur la carte que vous avez louée

### Liens

* [Place de marché](https://clore.ai/marketplace) · [Serveur nu](https://clore.ai/bare-metal)
* [Louer une RTX 4090](https://clore.ai/rent-4090.html) · [Louer une RTX 5090](https://clore.ai/rent-5090.html)
* [Comparaison des prix du cloud GPU — Clore.ai face aux principaux fournisseurs](https://blog.clore.ai/gpu-cloud-pricing-comparison/)


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.clore.ai/guides/guides_v2-fr/premiers-pas/pricing.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
