NVIDIA Vera Rubin: rendimiento récord y coste de token reducido
La nueva plataforma promete 10x más tokens por megavatio que Blackwell, según pruebas de CoreWeave
24 de julio de 2026 · 4 min de lectura
¿Qué ha ocurrido?
NVIDIA ha anunciado la plataforma Vera Rubin, un sistema completo de IA desde el chip hasta la red eléctrica, diseñado para maximizar el rendimiento por vatio y minimizar el coste por token. La producción de Vera Rubin NVL72 ya está en marcha en más de 350 fábricas en 30 países, con partners como CoreWeave, Google Cloud, Microsoft Azure y Oracle Cloud Infrastructure. Según el blog oficial de NVIDIA, la plataforma integra siete chips y cinco bandejas — Vera Rubin NVL72, Vera CPU rack, Groq 3 LPX, Spectrum-6 SPX y Vera BlueField-4 STX — todos diseñados como un sistema único, no como componentes ensamblados de productos estándar. Esta integración vertical extrema permite optimizar el rendimiento por vatio y el coste por token, dos métricas críticas en la era de la IA a gran escala.
¿Por qué es importante?
El dato clave proviene de un benchmark de CoreWeave sobre DeepSeek-R1: Vera Rubin ofrece 10x más tokens por megavatio que Grace Blackwell NVL72. Esto es crítico porque el consumo energético es el principal cuello de botella para la expansión de centros de datos de IA. Además, la plataforma incorpora la sexta generación de NVLink, que duplica el rendimiento en cargas de trabajo complejas, reduce la latencia en 3x y multiplica por 10 las tasas de paquetes frente a Ethernet estándar. Para la escala out, Spectrum-X combina switches de 102.4T y SuperNICs de 1.6T, ofreciendo 1.6x más ancho de banda RDMA. La integración de fotónica con óptica co-empaquetada reduce el consumo en 5x y aumenta la fiabilidad (MTBI) en 10x frente a transceptores enchufables, lo que abarata el mantenimiento. Este salto en eficiencia energética es vital: según la Agencia Internacional de la Energía, los centros de datos de IA podrían consumir hasta 100 TWh en 2026, equivalente al consumo de un país como Suecia.
Consecuencias para el mercado
Vera Rubin redefine la eficiencia en IA a gran escala. Para empresas como CoreWeave, Microsoft y Tesla, que ya están adoptando los switches Spectrum-6, esto significa poder escalar sus fábricas de IA sin disparar los costes energéticos. La reducción del coste por token permitirá a los proveedores de nube ofrecer precios más competitivos, acelerando la adopción de IA en sectores como sanidad, finanzas y automoción. En términos de competencia, NVIDIA refuerza su liderazgo frente a alternativas como AMD o las soluciones personalizadas de Google y Amazon. Sin embargo, el mercado de aceleradores de IA está valorado en más de 100 mil millones de dólares para 2027, según Gartner, por lo que la presión sobre NVIDIA para mantener su ventaja es enorme. La plataforma Vera Rubin podría forzar a competidores como AMD a acelerar sus propios diseños integrados o arriesgarse a perder cuota de mercado.
Lo que deben saber los lectores
Vera Rubin no es solo un chip, es una plataforma completa que incluye la CPU Vera, con núcleos Olympus que ofrecen 2x rendimiento monohilo, 3x ancho de banda entre núcleos y 40% menos latencia de memoria que diseños competidores. Esto la hace ideal para cargas de trabajo de agentes de IA, que requieren baja latencia y alta eficiencia. Para los partners, el menor coste por token se traduce en precios más competitivos para los usuarios finales de servicios de IA en la nube. Además, la integración de fotónica reduce la complejidad del cableado y mejora la fiabilidad, lo que es crucial para centros de datos que operan 24/7. La sexta generación de NVLink también permite escalar a miles de GPUs con baja latencia, facilitando el entrenamiento de modelos masivos como los de lenguaje grande.
"La plataforma Vera Rubin está construida desde el chip hasta la red para ofrecer el mayor rendimiento por vatio y el menor coste por token", afirma NVIDIA en su blog oficial.
Contexto histórico
Comparado con Blackwell, Vera Rubin representa un salto generacional en eficiencia. Mientras Blackwell se centraba en rendimiento bruto, Vera Rubin optimiza el rendimiento por vatio, algo crucial en un momento donde la capacidad eléctrica es el recurso más escaso para los centros de datos. La adopción de fotónica y NVLink de sexta generación muestra la apuesta de NVIDIA por la integración vertical y el co-diseño extremo. Históricamente, NVIDIA ha pasado de ser un fabricante de GPUs para juegos a dominar el mercado de IA con arquitecturas como Volta (2017), Turing (2018), Ampere (2020), Hopper (2022) y Blackwell (2024). Cada generación ha duplicado aproximadamente el rendimiento por vatio, pero Vera Rubin acelera esta tendencia con un factor de 10x en eficiencia de tokens por megavatio. Este enfoque en la eficiencia energética recuerda al cambio que supuso la arquitectura Arm en móviles, donde el rendimiento por vatio se convirtió en la métrica clave. Si NVIDIA mantiene este ritmo, podría establecer un estándar que obligue a toda la industria a repensar el diseño de centros de datos de IA.
Puntos clave
- Vera Rubin ofrece 10x más tokens por megavatio que Grace Blackwell NVL72.
- Integra siete chips y cinco bandejas diseñados como un sistema único.
- Incluye NVLink de sexta generación y fotónica co-empaquetada.
- Partners iniciales: CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud.
- CPU Vera con núcleos Olympus duplica rendimiento monohilo.
Preguntas frecuentes
¿Qué es Vera Rubin?
Es la nueva plataforma de IA de NVIDIA diseñada para ofrecer el mayor rendimiento por vatio y el menor coste por token, integrando chips, redes y software en un sistema completo.
¿Qué mejora respecto a Blackwell?
Según CoreWeave, Vera Rubin ofrece 10x más tokens por megavatio que Grace Blackwell NVL72, gracias a un co-diseño extremo y redes avanzadas.
¿Quiénes son los primeros partners?
CoreWeave, Google Cloud, Microsoft Azure y Oracle Cloud Infrastructure están entre los primeros en desplegar Vera Rubin.
Fuentes utilizadas
Sigue leyendo
Comentarios
Sé el primero en comentar.