अवलोकन
अंतिम अपडेट
क्या यह उपयोगी था?
इन्फरेंस और चैट एप्लिकेशन के लिए CLORE.AI GPUs पर बड़े भाषा मॉडल (LLMs) चलाएं।
7B (Q4)
RTX 3060 12GB
RTX 3090
13B (Q4)
RTX 3090 24GB
RTX 4090
34B (Q4)
2x RTX 3090
A100 40GB
70B (Q4)
A100 80GB
2x A100
Q2_K
सबसे कम
कमज़ोर
सबसे तेज़
Q4_K_M
निम्न
अच्छा
तेज़
Q5_K_M
मध्यम
महान
मध्यम
Q8_0
उच्च
उत्कृष्ट
धीमा
FP16
अत्यधिक
सबसे अच्छा
सबसे धीमा
अंतिम अपडेट
क्या यह उपयोगी था?
क्या यह उपयोगी था?