DeepSeek-V3
Modelo publicado en Hugging Face con tarea pipeline 'text-generation' declarada en su ficha.
también conocido como deepseek-ai/DeepSeek-V3
Para qué sirve
El creador no declara usos concretos en su model card. Esta ficha tiene lo demás —categoría, licencia, despliegue y datos técnicos—; lo que falta es la declaración de para qué sirve, y no se rellena a ojo.
Para qué NO sirve
Sin restricciones declaradas por el creador. La ausencia de una advertencia no es una garantía.
Ficha técnica
| Entrada | text |
|---|---|
| Salida | text |
| Arquitectura | DeepseekV3ForCausalLM |
| Parámetros | 684.53B |
| Parámetros activos | desconocido |
| Ventana de contexto | desconocido |
| Idiomas | desconocido |
Acceso y despliegue
| Despliegue | Pesos descargables |
|---|---|
| IDs de API | desconocido |
| Proveedores | desconocido |
Que un modelo sea descargable no implica que su licencia permita usarlo comercialmente.
Licencia
verificada el 11 oct 2026| Identificador | DEEPSEEK LICENSE AGREEMENT |
|---|---|
| Pesos descargables | Sí |
| Código fuente | desconocido |
| Uso comercial | desconocido |
| Redistribución | desconocido |
| Modificación | desconocido |
Fuente de la licencia: https://huggingface.co/deepseek-ai/DeepSeek-V3/raw/main/LICENSE-MODEL
Precios
Los precios de API cambian sin aviso: se revisan cada 30 díasNo hay precios verificados para este registro. Puede ser un modelo sin servicio de pago propio, o simplemente no haber fuente primaria publicada con tarifa: no inventamos una cifra.
Evaluación
Dos resultados solo son comparables si comparten protocolo y conjunto de datos. Cuando no es el caso, el Atlas lo dice en lugar de calcular una media.
| Prueba | Resultado | Conjunto | Protocolo | Fecha | Confianza |
|---|---|---|---|---|---|
| AIME 2024 | 39.2 Pass@1 (%) | AIME 2024 | Modelo chat (DeepSeek-V3); Pass@1; salida limitada a 8K tokens; benchmarks con <1000 muestras repetidos con varias temperaturas; tabla 'Standard Benchmarks — Chat Model' de la model card oficial | desconocido | B |
| GSM8K | 89.3 EM (%) | GSM8K | Modelo base (DeepSeek-V3-Base); 8-shot; EM; tabla 'Standard Benchmarks — Base Model' de la model card oficial en HF | desconocido | B |
| HumanEval | 65.2 Pass@1 (%) | HumanEval | Modelo base (DeepSeek-V3-Base); 0-shot; Pass@1; tabla 'Standard Benchmarks — Base Model' de la model card oficial en HF | desconocido | B |
| MATH-500 | 90.2 EM (%) | MATH-500 | Modelo chat (DeepSeek-V3); EM; salida limitada a 8K tokens; benchmarks con <1000 muestras repetidos con varias temperaturas; tabla 'Standard Benchmarks — Chat Model' de la model card oficial | desconocido | B |
| MMLU | 87.1 accuracy (%) | MMLU | Modelo base (DeepSeek-V3-Base); 5-shot; métrica Acc.; tabla 'Standard Benchmarks — Base Model' de la model card oficial en HF (deepseek-ai/DeepSeek-V3), evaluación propia del creador | desconocido | B |
| MMLU-Redux | 89.1 EM (%) | MMLU-Redux | Modelo chat (DeepSeek-V3); métrica EM; salida limitada a 8K tokens; benchmarks con <1000 muestras repetidos con varias temperaturas; tabla 'Standard Benchmarks (Models larger than 67B) — Chat Model' de la model card oficial | desconocido | B |
Ejecución local
Estimación y medición se muestran por separado: una estimación no es una medida.
| Precisión | Backend | RAM | VRAM | Método | Tokens/s |
|---|---|---|---|---|---|
| fp8 | SGLang / vLLM (GPU, pesos FP8 oficiales) | desconocido | 700 GB | estimado | desconocido |
Fuentes de esta ficha
- model_card Hugging Face model card: deepseek-ai/DeepSeek-V3 recuperada el 11 oct 2026
Fundamentos de IA aplicada
Saber qué es DeepSeek-V3 no es saber usarlo
Elegir el modelo es el 10 % del trabajo. El resto es integrarlo, medirlo, controlar el coste y gobernar los datos. Eso es lo que se aprende en IAcademy.
¿Por qué se usa aquí? Antes de elegir un modelo generalista hay que saber qué es una ventana de contexto, qué cuesta una llamada y cuándo conviene un modelo pequeño. Es la base de todo lo demás.
Lo que cambia
- De saber qué existe a saber cómo usarlo en tu trabajo.
- Del catálogo general a una decisión con coste, licencia y privacidad justificados.
- Prácticas y laboratorios, no solo lectura.