DeepSeek local para pymes

Qué PC necesitas para ejecutar DeepSeek localmente

DeepSeek-R1 no es un único modelo. Existen variantes destiladas que ocupan desde pocos gigabytes y una variante completa que exige infraestructura avanzada. Esta guía te lleva a una prueba útil sin descargar el modelo equivocado.

8B, 14B, 32B y 70BInstalación con OllamaHardware según memoria
R1elige la variante antes del PC
Decisión rápida

Empieza por DeepSeek-R1 8B o 14B

Prueba razonamiento y código con ejemplos reales. Sube a 32B o 70B solo si la calidad mejora lo suficiente para justificar más memoria.

Paso 1

La diferencia decisiva está en la variante

Variante en OllamaDescarga aproximadaPunto de partida
DeepSeek-R1 8B5,2 GBGPU de 8–16 GB o memoria del sistema para una prueba.
DeepSeek-R1 14B9 GBGPU de 16 GB con contexto moderado.
DeepSeek-R1 32B20 GBGPU de 24/32 GB y margen controlado.
DeepSeek-R1 70B43 GBGPU profesional de gran memoria o sistema GB10.
DeepSeek-R1 671B404 GBInfraestructura distribuida avanzada; no es la primera opción para una pyme.

Tamaños consultados en la biblioteca oficial de Ollama. Comprueba la etiqueta antes de descargar porque las versiones pueden cambiar.

Paso 2

Instala primero la variante de 8B

ollama run deepseek-r1:8b

Prueba tres tareas que puedas verificar: explicar un cálculo, revisar una función y comparar dos alternativas con criterios definidos. Si falla por calidad, prueba 14B; si el problema es velocidad, mide la GPU antes de cambiar de modelo.

ollama run deepseek-r1:14b
ollama run deepseek-r1:32b
Pasos 3 a 5

Evalúa razonamiento sin confiar en una respuesta convincente

  1. Prepara diez preguntas con respuesta conocida y distintos niveles de dificultad.
  2. Pide un formato fijo para comparar: respuesta, supuestos, cálculo y conclusión.
  3. Registra errores de lógica, datos inventados y pasos omitidos.
  4. Repite con otra variante manteniendo la misma configuración.
  5. Introduce documentos mediante RAG si la tarea depende de información interna.
  6. No automatices acciones hasta que el modelo pase las pruebas y exista aprobación.
Paso 4

Una RTX de 32 GB no convierte automáticamente 70B en una carga de 32 GB

DeepSeek-R1 70B ocupa 43 GB en la etiqueta habitual de Ollama. A eso se suman contexto y buffers. Si haces offload a RAM, puede ejecutarse, pero una parte deja de estar en la GPU y la velocidad cambia.

Hardware relacionado

Hardware para pasar de DeepSeek 14B a 70B

No compres para 671B si la tarea se resuelve con una variante destilada. La compra debe seguir a una prueba de calidad.

Decisión de compra

Elige por el modelo que ha superado la prueba

8B y 14B

Empieza con una GPU de 16 GB si la carga y el contexto caben. No necesitas un superordenador para validar el proceso.

32B

Una GPU de 24 o 32 GB puede ser suficiente. Revisa el contexto y evita trabajar al límite.

70B y 120B

Compara RTX PRO 6000 de 96 GB con GB10 de 128 GB. La GPU prioriza velocidad; GB10 prioriza capacidad.

Fuentes técnicas y criterio editorial

Las especificaciones, funciones y límites descritos se contrastan con documentación primaria de Ollama y modelos. Las recomendaciones de compra, el orden de los pasos y los márgenes de planificación son criterios editoriales de AI Supercomputers: deben confirmarse con la versión instalada y una prueba real.

Documentación oficial de Ollama · Biblioteca oficial de modelos · Contexto y comprobación de offload

Preguntas frecuentes

Respuestas directas antes de elegir hardware

¿DeepSeek-R1 671B es el modelo que debo instalar?

No para una primera implantación. La descarga completa ocupa cientos de gigabytes. Las variantes destiladas de 8B, 14B, 32B y 70B son mucho más prácticas para probar razonamiento y código.

¿DeepSeek-R1 70B cabe en una RTX 5090?

La descarga habitual de 70B ocupa 43 GB y la RTX 5090 tiene 32 GB. Puede funcionar con offload parcial, pero no cabe completamente en VRAM con margen.

¿Qué DeepSeek puedo ejecutar con 16 GB?

La variante 8B ocupa alrededor de 5,2 GB y la 14B alrededor de 9 GB. Son las primeras candidatas para una GPU de 16 GB, dejando margen para contexto.

¿DeepSeek sirve para documentos de empresa?

Puede razonar sobre texto, pero la respuesta debe recuperar primero los documentos autorizados. El modelo no conoce automáticamente tus manuales, tarifas ni expedientes.

Hardware relacionado

Pasa de la estimación a una ficha real

Compara capacidad, velocidad y formato. La cifra de memoria es un filtro inicial; la carga real termina de decidir.