Descripción general
Ejecuta modelos de lenguaje grandes (LLM) en GPU de CLORE.AI para inferencia y aplicaciones de chat.
Herramientas populares
Guías de modelos
Últimos y mejores modelos
Modelos especializados
Modelos eficientes
Recomendaciones de GPU
Los equipos multinodo de clase 80GB no aparecen listados en el marketplace de Clore.ai. Los equipos más grandes listados hoy son 4× RTX PRO 6000 Blackwell (96GB cada una, 380GB en total) y 8–11× RTX 5090 (32GB cada una). La capacidad A100 / H200 / B200 se vende como bare metal bajo pedido. Consulta Precios y disponibilidad de GPU antes de dimensionar un despliegue.
7B (Q4)
RTX 3060 12GB
RTX 3090
$0.03–0.21/hr
13B (Q4)
RTX 3090 24GB
RTX 4090
$0.07–0.42/hr
27B (Q4)
RTX 3090 24GB
RTX 4090 / 5090
$0.07–0.77/hr
34B (Q4)
2× RTX 3090
1× RTX 5090
$0.14–0.77/hr
70B (Q4)
2× RTX 5090
1× RTX PRO 6000 96GB
$0.50–1.54/h
120B+ (Q2)
2× RTX 4090
2× RTX 5090
$0.28–1.54/hr
400B+ (Q2)
8× RTX 5090
4× RTX PRO 6000
~$2.00–5.00/hr
Guía de cuantización
Q2_K
Más bajo
Deficiente
Más rápido
Q4_K_M
Baja
Bueno
Rápido
Q5_K_M
Medio
Excelente
Medio
Q8_0
Alta
Excelente
Más lento
FP16
Máxima
Mejor
El más lento
Ver también
Última actualización
¿Te fue útil?