For the complete documentation index, see llms.txt. This page is also available as Markdown.

DeepSeek Coder

Generación de código de primer nivel con DeepSeek Coder en Clore.ai

¡Hay versiones más nuevas disponibles! DeepSeek-R1 (razonamiento + codificación) y DeepSeek-V3 (de propósito general) son significativamente más capaces. Véase también Qwen2.5-Coder para una sólida alternativa de programación.

Generación de código de primera clase con los modelos DeepSeek Coder.

Alquilar en CLORE.AI

  1. Filtra por tipo de GPU, VRAM y precio

  2. Elige Bajo demanda (tarifa fija) o Spot (precio ofertado)

  3. Configura tu pedido:

    • Selecciona la imagen de Docker

    • Configura los puertos (TCP para SSH, HTTP para interfaces web)

    • Añade variables de entorno si es necesario

    • Introduce el comando de inicio

  4. Selecciona el método de pago: CLORE, BTC, o USDT/USDC

  5. Crea el pedido y espera al despliegue

Accede a tu servidor

  • Encuentra los detalles de conexión en Mis pedidos

  • Interfaces web: Usa la URL del puerto HTTP

  • SSH: ssh -p <port> root@<proxy-address>

¿Qué es DeepSeek Coder?

DeepSeek Coder ofrece:

  • Generación de código de última generación

  • 338 lenguajes de programación

  • Compatibilidad con rellenado en el medio

  • Comprensión a nivel de repositorio

Variantes del modelo

Modelo
Parámetros
VRAM
Contexto

DeepSeek-Coder-1.3B

1.3B

3GB

16K

DeepSeek-Coder-6.7B

6.7B

8GB

16K

DeepSeek-Coder-33B

33B

40 GB

16K

DeepSeek-Coder-V2

16B/236B

20GB+

128K

Despliegue rápido

Imagen de Docker:

Puertos:

Comando:

Accediendo a tu servicio

Después del despliegue, encuentra tu http_pub URL en Mis pedidos:

  1. Ve a Mis pedidos página

  2. Haz clic en tu pedido

  3. Encuentra la http_pub URL (p. ej., abc123.clorecloud.net)

Usa https://YOUR_HTTP_PUB_URL en lugar de localhost en los ejemplos a continuación.

Usando Ollama

Instalación

Generación de código

Rellenado en el medio (FIM)

DeepSeek-Coder-V2

Las más recientes y potentes:

Servidor vLLM

Uso de la API

Revisión de código

Céntrate en:

  1. Rendimiento

  2. Legibilidad

  3. Mejores prácticas """} ]

"""} ]

Rendimiento

Modelo
GPU
Tokens/seg

DeepSeek-1.3B

RTX 3060

~120

DeepSeek-6.7B

RTX 3090

~70

DeepSeek-6.7B

RTX 4090

~100

DeepSeek-33B

A100

~40

DeepSeek-V2-Lite

RTX 4090

~50

Comparación

Modelo
HumanEval
Calidad del código

DeepSeek-Coder-33B

79.3%

Excelente

CodeLlama-34B

53.7%

Bueno

GPT-3.5-Turbo

72.6%

Bueno

Solución de problemas

La finalización de código no funciona

  • Asegúrate de usar el formato correcto del prompt con <|fim_prefix|>, <|fim_suffix|>, <|fim_middle|>

  • Establece un valor adecuado de max_new_tokens para la generación de código

El modelo genera basura

  • Comprueba que el modelo se haya descargado por completo

  • Verifica que se esté usando CUDA: model.device

  • Prueba una temperatura más baja (0.2-0.5 para código)

Inferencia lenta

  • Usa vLLM para acelerar entre 5 y 10 veces

  • Habilita torch.compile() para transformers

  • Usa un modelo cuantizado para variantes grandes

Errores de importación

  • Instala las dependencias: pip install transformers accelerate

  • Actualiza PyTorch a 2.0+

Estimación de costos

Tarifas típicas del marketplace de CLORE.AI (a partir de 2024):

GPU
Tarifa por hora
Tarifa diaria
Sesión de 4 horas

RTX 3060

~$0.03

~$0.70

~$0.12

RTX 3090

~$0.06

~$1.50

~$0.25

RTX 4090

~$0.10

~$2.30

~$0.40

A100 40GB

~$0.17

~$4.00

~$0.70

A100 80GB

~$0.25

~$6.00

~$1.00

Los precios varían según el proveedor y la demanda. Consulta Marketplace de CLORE.AI las tarifas actuales.

Ahorra dinero:

  • Usa el Spot mercado para trabajo interrumpible — alrededor de un tercio de los servidores fija el precio spot por debajo del precio bajo demanda (mediana de ~13% de descuento), el resto lo iguala

  • Paga con CLORE tokens

  • Compara precios entre distintos proveedores

Siguientes pasos

Última actualización

¿Te fue útil?