RTX PRO 6000 Server Edition
GPU profesional de servidor para velocidad, concurrencia e imagen cuando la carga cabe en 96 GB.
Compra enietres informática
DeepSeek-R1 no es un único modelo. Existen variantes destiladas que ocupan desde pocos gigabytes y una variante completa que exige infraestructura avanzada. Esta guía te lleva a una prueba útil sin descargar el modelo equivocado.
Prueba razonamiento y código con ejemplos reales. Sube a 32B o 70B solo si la calidad mejora lo suficiente para justificar más memoria.
| Variante en Ollama | Descarga aproximada | Punto de partida |
|---|---|---|
| DeepSeek-R1 8B | 5,2 GB | GPU de 8–16 GB o memoria del sistema para una prueba. |
| DeepSeek-R1 14B | 9 GB | GPU de 16 GB con contexto moderado. |
| DeepSeek-R1 32B | 20 GB | GPU de 24/32 GB y margen controlado. |
| DeepSeek-R1 70B | 43 GB | GPU profesional de gran memoria o sistema GB10. |
| DeepSeek-R1 671B | 404 GB | Infraestructura distribuida avanzada; no es la primera opción para una pyme. |
Tamaños consultados en la biblioteca oficial de Ollama. Comprueba la etiqueta antes de descargar porque las versiones pueden cambiar.
ollama run deepseek-r1:8bPrueba tres tareas que puedas verificar: explicar un cálculo, revisar una función y comparar dos alternativas con criterios definidos. Si falla por calidad, prueba 14B; si el problema es velocidad, mide la GPU antes de cambiar de modelo.
ollama run deepseek-r1:14b
ollama run deepseek-r1:32bDeepSeek-R1 70B ocupa 43 GB en la etiqueta habitual de Ollama. A eso se suman contexto y buffers. Si haces offload a RAM, puede ejecutarse, pero una parte deja de estar en la GPU y la velocidad cambia.
No compres para 671B si la tarea se resuelve con una variante destilada. La compra debe seguir a una prueba de calidad.
GPU profesional de servidor para velocidad, concurrencia e imagen cuando la carga cabe en 96 GB.
Compra enietres informática
Entrada a GB10 con 128 GB unificados y varias capacidades de SSD.
Compra enietres informática
128 GB de memoria unificada para modelos que superan la VRAM habitual.
Compra entienda ietres
Dos unidades en una ficha comercial para cargas distribuidas compatibles.
Compra entienda ietres
Empieza con una GPU de 16 GB si la carga y el contexto caben. No necesitas un superordenador para validar el proceso.
Una GPU de 24 o 32 GB puede ser suficiente. Revisa el contexto y evita trabajar al límite.
Compara RTX PRO 6000 de 96 GB con GB10 de 128 GB. La GPU prioriza velocidad; GB10 prioriza capacidad.
Las especificaciones, funciones y límites descritos se contrastan con documentación primaria de Ollama y modelos. Las recomendaciones de compra, el orden de los pasos y los márgenes de planificación son criterios editoriales de AI Supercomputers: deben confirmarse con la versión instalada y una prueba real.
Documentación oficial de Ollama · Biblioteca oficial de modelos · Contexto y comprobación de offload
No para una primera implantación. La descarga completa ocupa cientos de gigabytes. Las variantes destiladas de 8B, 14B, 32B y 70B son mucho más prácticas para probar razonamiento y código.
La descarga habitual de 70B ocupa 43 GB y la RTX 5090 tiene 32 GB. Puede funcionar con offload parcial, pero no cabe completamente en VRAM con margen.
La variante 8B ocupa alrededor de 5,2 GB y la 14B alrededor de 9 GB. Son las primeras candidatas para una GPU de 16 GB, dejando margen para contexto.
Puede razonar sobre texto, pero la respuesta debe recuperar primero los documentos autorizados. El modelo no conoce automáticamente tus manuales, tarifas ni expedientes.
Compara capacidad, velocidad y formato. La cifra de memoria es un filtro inicial; la carga real termina de decidir.
Entrada a GB10 con 128 GB unificados y varias capacidades de SSD.
Compra enietres informática
128 GB de memoria unificada para modelos que superan la VRAM habitual.
Compra entienda ietres
GPU profesional de servidor para velocidad, concurrencia e imagen cuando la carga cabe en 96 GB.
Compra enietres informática
Dos unidades en una ficha comercial para cargas distribuidas compatibles.
Compra entienda ietres