AI Supercomputers es el portal de IA local del grupo ietres.La compra se realiza en nuestras tiendas oficiales. Si una referencia no aparece con stock, consulta la posibilidad de reserva y la siguiente entrada prevista.

Superchip Grace Blackwell · guía de compra

NVIDIA GB10: qué es y qué superordenador de IA comprar

GB10 es la base de NVIDIA DGX Spark, ASUS Ascent GX10 y Lenovo ThinkStation PGX. Esta guía explica la memoria unificada de 128 GB, cuándo aporta una ventaja real, qué limita el rendimiento y cómo elegir una referencia sin confundir SSD, memoria y velocidad.

Capacidad frente a velocidadCompatibilidad Arm64Compra por referencia exacta
Ruta para pymes

Para una pyme, GB10 se elige por memoria; el SSD se elige por espacio

ASUS, Lenovo y DGX Spark comparten una clase de memoria de 128 GB. Una variante de 1 TB puede ser una entrada suficiente si guardarás pocos modelos. Más SSD no permite ejecutar un modelo mayor.

Empieza por esto

ASUS o Lenovo de 1 TB para una biblioteca controlada y un primer equipo dedicado.

Compra cuando

2 o 4 TB si vas a conservar más modelos, datasets, contenedores y resultados.

Deja para después

Parejas y clústeres de varios nodos.

La explicación avanzada continúa debajo. Puedes consultarla cuando el uso, los datos o el número de personas lo justifiquen.

Compra en nuestras tiendas oficiales

AI Supercomputers te ayuda a elegir; el pedido se completa en una tienda del grupo ietres

Esta web publica las guías, comparativas y recomendadores. La ficha comercial, la disponibilidad, la reserva y la compra se gestionan en una de nuestras dos tiendas oficiales.

Disponibilidad y reservas. La disponibilidad cambia por referencia. Si una ficha aparece sin stock, consulta la tienda: algunas unidades pueden reservarse o pedirse sobre una próxima entrada. El plazo y las condiciones se confirman antes de comprar.

En lenguaje claro

GB10 resuelve un límite de memoria, no sustituye a cualquier GPU

En palabras sencillas

El GB10 es "el motor" que comparten DGX Spark, ASUS GX10 y Lenovo PGX: dos cerebros (CPU y GPU) fabricados juntos y trabajando sobre la misma memoria de 128 GB — como una cocina donde cocinero y ayudante comparten la encimera en lugar de pasarse platos por una ventanilla. Por eso equipos de marcas distintas rinden igual: llevan el mismo corazón.

Qué contiene

Una CPU Grace basada en Arm, una GPU Blackwell y memoria unificada. CPU y GPU trabajan sobre el mismo gran espacio de memoria, evitando el límite rígido de una tarjeta gráfica con poca VRAM.

Qué ventaja ofrece

Puede cargar modelos, contextos y servicios que no caben con margen en muchas GPU convencionales. Es especialmente útil cuando la capacidad impide siquiera iniciar la carga.

Qué no garantiza

No garantiza más tokens por segundo. Cuando la carga cabe en la VRAM de una GPU profesional, esa GPU puede ser claramente más rápida. La elección correcta depende de una medición, no del nombre comercial.

No compares el petaFLOP FP4 de IA con FLOPS científicos FP64. Son precisiones y cargas distintas. Para comprar, mide el modelo real, su cuantización, el contexto y la concurrencia.

Tres formas de comprar GB10

La plataforma central coincide; la referencia comercial no

EquipoMemoriaSSD incluido en esta selecciónCuándo mirarlo primeroQué confirmar
NVIDIA DGX Spark128 GB unificados4 TBQuieres la plataforma de referencia NVIDIA y una ficha directa en tienda.ietres.comPrograma que ejecuta el modelo, compatibilidad Arm64, soporte y rendimiento de tu modelo
ASUS Ascent GX10128 GB unificados1, 2 o 4 TBQuieres elegir capacidad local dentro de la familia ASUSP/N, almacenamiento, imagen del sistema y condiciones de la ficha
Lenovo ThinkStation PGX128 GB unificados1, 2 o 4 TBQuieres una referencia ThinkStation del canal profesional LenovoP/N, EAN, servicio y cobertura; hay referencias que comparten SSD
Compra guiada

Compara la plataforma antes de abrir una ficha

Desplázate por las alternativas. Cada tarjeta separa la guía técnica de la ficha comercial para que puedas validar el encaje antes de comprar.

Arquitectura

La memoria unificada es una mesa de trabajo grande

En una estación con GPU convencional, los pesos y la caché deben caber en la VRAM. Si una parte cae en memoria del sistema, el rendimiento puede descender de forma pronunciada. En GB10, CPU y GPU comparten un espacio coherente de 128 GB. La mesa es mayor, pero la velocidad con la que se mueve cada elemento sigue dependiendo del hardware y del software.

  1. Calcula el tamaño de los pesos después de cuantizar.
  2. Añade la caché KV del contexto máximo y las sesiones simultáneas.
  3. Reserva margen para el programa que ejecuta el modelo, buffers, sistema y fragmentación.
  4. Comprueba que el backend y las extensiones funcionan en Arm64.
  5. Ejecuta la misma prueba en la alternativa GPU antes de decidir.
Esquema interno del sistema GB10
Dimensionamiento paso a paso

Cómo decidir sin comprar por intuición

  1. Define una tarea. Elige un prompt, documento o flujo de trabajo que represente el trabajo real.
  2. Fija modelo y cuantización. No dimensionas una familia abstracta; dimensionas un artefacto concreto.
  3. Mide memoria. Registra memoria al cargar, durante el prefill y con el contexto máximo.
  4. Mide servicio. Anota primer token, latencia total, tokens por segundo, errores y usuarios simultáneos.
  5. Comprueba software. Valida contenedores, librerías, nodos y herramientas en la arquitectura Arm64.
  6. Elige SSD. Cuenta modelos, datasets, imágenes de contenedor, cachés, resultados y margen de actualización.
  7. Compara referencias. Abre P/N y EAN exactos; el mismo SSD no implica el mismo paquete comercial.
Resultado correcto

Debes terminar con una ficha que diga «este modelo necesita esta memoria, alcanza esta latencia y requiere este software», no únicamente «quiero un equipo potente».

Dos unidades

Una pareja amplía capacidad; una flota resuelve otra clase de problema

ConnectX-7 permite enlazar varios equipos compatibles. Dos nodos mantienen la referencia de hasta 405B; NVIDIA Sync valida tres nodos en anillo y hasta cuatro mediante switch. El programa que ejecuta el modelo debe soportar el reparto y la memoria no se convierte en un espacio único automático.

  • Un solo modelo grande: valida la receta oficial de dos unidades y el cable correcto.
  • Más usuarios: usa réplicas, balanceo, colas y límites de concurrencia.
  • Procesos por lotes: reparte trabajos independientes y conserva trazabilidad.
  • Alta disponibilidad: separa capacidad de servicio y recuperación; una pareja de cómputo no sustituye las copias.
Cable QSFP para enlazar dos sistemas GB10
Siguiente paso de compra

Elige arquitectura, SSD y referencia en ese orden

Primero confirma que necesitas 128 GB unificados. Después escoge el espacio local. Por último abre el SKU exacto y comprueba soporte, servicio y condiciones comerciales.

Qué puedes ejecutar

Modelos, software y límites que conviene validar

Carga o softwareEncajeComprobación
Ollama y LM StudioDisponibles en Linux Arm64 en versiones actuales.Confirma programa que ejecuta el modelo, formato del modelo y aceleración en la imagen del fabricante.
Llama 3.3 70B / DeepSeek-R1 70BLas etiquetas citadas por Ollama ocupan 43 GB. Ese tamaño está por debajo de 128 GB, pero no demuestra que pesos, contexto, caché y buffers quepan juntos.Añade contexto, buffers y prueba la velocidad del backend.
gpt-oss 120BLa etiqueta citada por Ollama ocupa 65 GB. El archivo está por debajo de 128 GB, pero el encaje completo debe comprobarse con el backend y el contexto reales.Compara rendimiento con RTX PRO 6000 si la velocidad es prioritaria.
Qwen3 235BLa etiqueta citada por Ollama ocupa 142 GB, por encima de la capacidad nominal de una unidad de 128 GB antes de sumar programa que ejecuta el modelo y contexto.Necesita reparto compatible o una variante menor.
ComfyUI, SDXL y FluxPosibles con una pila Arm64 compatible.Una GPU discreta puede ser más rápida cuando el flujo de trabajo cabe en VRAM.
Docker y contenedoresLa plataforma admite Docker y stack NVIDIA.Comprueba que la imagen tenga variante Arm64/GB10.
WindowsNo es la ruta nativa de GB10.La plataforma utiliza Linux Arm64.
Preguntas frecuentes

Respuestas antes de elegir hardware

¿Qué es NVIDIA GB10?

Es un superchip que combina una CPU Grace basada en Arm y una GPU Blackwell con una memoria unificada accesible por ambos procesadores. En estos sistemas la capacidad anunciada es de 128 GB.

¿DGX Spark, ASUS Ascent GX10 y Lenovo ThinkStation PGX rinden exactamente igual?

Comparten la clase de plataforma GB10, pero el rendimiento práctico también depende de la refrigeración, la imagen del sistema, los controladores, el almacenamiento, el programa que ejecuta el modelo, el modelo y la configuración. Deben medirse con la misma carga.

¿Por qué una GPU puede ser más rápida aunque tenga menos memoria?

La memoria dedicada y el ancho de banda de una GPU profesional pueden reducir la latencia cuando toda la carga cabe en VRAM. GB10 adquiere valor cuando la capacidad necesaria supera ese límite o se busca una plataforma compacta con memoria unificada.

¿El SSD de 4 TB permite ejecutar modelos más grandes que el de 1 TB?

No. El SSD determina cuántos modelos, contenedores y datos puedes guardar localmente. La memoria que limita la ejecución del modelo continúa siendo la memoria unificada de 128 GB.

¿Puedo unir varios equipos GB10?

Sí. Dos nodos mantienen la referencia de hasta 405B. NVIDIA Sync valida tres nodos en anillo y hasta cuatro mediante switch; el reparto de un modelo depende del programa que ejecuta el modelo y no crea una memoria transparente.

¿Qué debo comprobar antes de comprar?

Modelo y cuantización, contexto máximo, usuarios simultáneos, memoria medida, latencia objetivo, compatibilidad Arm64, espacio local, soporte de la referencia y procedimiento de recuperación.

Fuentes técnicas y criterio editorial

Las especificaciones, funciones y límites descritos se contrastan con documentación primaria de NVIDIA GB10 y sistemas OEM. Las recomendaciones de compra, el orden de los pasos y los márgenes de planificación son criterios editoriales de AI Supercomputers: deben confirmarse con la versión instalada y una prueba real.

NVIDIA DGX Spark · ASUS Ascent GX10: especificaciones · Lenovo ThinkStation PGX · Llama 3.3 en Ollama · DeepSeek-R1 en Ollama · gpt-oss en Ollama · Qwen3 en Ollama