Descripción
GB200 NVL72 cambia la unidad de compra: no se adquiere un servidor sino un rack diseñado como una sola máquina. Setenta y dos GPU Blackwell y treinta y seis CPU Grace se conectan por NVLink de 5ª generación a 130 TB/s dentro del rack, de modo que el sistema se comporta como una GPU única con 13,4 TB de memoria HBM3e. Es la plataforma para inferencia en tiempo real de modelos de billones de parámetros, y también un proyecto de infraestructura: refrigeración líquida, energía y estructura de sala son parte del alcance desde el primer día.
Casos de uso
- Inferencia en tiempo real de modelos de billones de parámetros
- Entrenamiento de modelos de lenguaje a gran escala
- Arquitecturas mixture-of-experts
- Aceleración de consultas sobre bases de datos masivas
- HPC e IA para investigación científica
Especificaciones principales
| GPU | 72× NVIDIA Blackwell |
|---|---|
| Memoria GPU | 13,4 TB HBM3e, 576 TB/s agregados |
| CPU | 36× NVIDIA Grace (2.592 núcleos Arm Neoverse V2) |
| Memoria del sistema | 17 TB LPDDR5X, 14 TB/s agregados; NVLink-C2C a 3,6 TB/s por superchip |
| NVLink | 5ª generación, 130 TB/s de ancho de banda GPU a GPU dentro del rack |
| Escalado externo | NVIDIA Quantum-X800 InfiniBand o Spectrum-X Ethernet |
| Rendimiento IA | 1.440 PFLOPS NVFP4 con sparsity / 720 PFLOPS densos · 720 PFLOPS FP8/FP6 · 2.880 TFLOPS FP64 |
| Formato | Rack completo con refrigeración líquida |
| Software | NVIDIA Mission Control, Magnum IO, CUDA-X |
Beneficios para tu organización
- El rack se comporta como una sola GPU: desaparece la penalización de comunicación entre nodos
- Inferencia de modelos que ningún servidor individual puede sostener
- Densidad de cómputo por metro cuadrado que ninguna otra arquitectura alcanza hoy
- Base para ofrecer servicios de IA propios en lugar de reventa de nube
Recomendación de dimensionamiento
Es un proyecto de infraestructura, no una compra de equipo. Requiere refrigeración líquida con CDU, capacidad eléctrica dedicada, refuerzo estructural de piso y red de backend de 800 Gb/s. NVIDIA no publica el consumo total del rack: se define con el integrador según configuración. TECDEX conduce el estudio de factibilidad de sala antes de cualquier cotización.
Servicios TECDEX asociados
- Evaluación de sala: energía, refrigeración, rack y peso
- Diseño de red de cómputo y almacenamiento
- Instalación, cableado estructurado y puesta en marcha
- Operación asistida, monitoreo y soporte
- Marco de seguridad y cumplimiento (TECDEX ISO 27001)
Solicitar cotización
Cada implementación se dimensiona caso a caso. Cuéntanos tu carga de trabajo y te preparamos una propuesta técnica y comercial para NVIDIA GB200 NVL72.
Especificaciones según documentación oficial del fabricante (fuente), consultada en septiembre de 2026. Las configuraciones disponibles pueden variar. TECDEX no publica precios ni disponibilidad en línea: se confirman por escrito en la cotización.





