Chips y hardware
Nvidia lleva la arquitectura de IA Rubin a producción
Nvidia ha lanzado su arquitectura de computación Rubin, la cual ya está en producción y se espera que aumente su fabricación en la segunda mitad del año.
Hoy, el CEO de Nvidia, Jensen Huang, lanzó oficialmente la arquitectura de computación Rubin de la empresa, anunciando que el sistema se encuentra actualmente en producción. Anunciada por primera vez en 2024, la arquitectura está diseñada para reemplazar la arquitectura Blackwell de Nvidia, que anteriormente sucedió a las arquitecturas Hopper y Lovelace. Según Huang, el lanzamiento tiene como objetivo abordar las crecientes demandas computacionales de la inteligencia artificial. «Vera Rubin está diseñada para abordar este desafío fundamental que tenemos: la cantidad de computación necesaria para la IA se está disparando», dijo Huang, CEO de Nvidia. También confirmó que la arquitectura ya está en plena producción, y se espera que la fabricación aumente en la segunda mitad del año.
Llamada así en honor a la astrónoma Vera Florence Cooper Rubin, la arquitectura consta de seis chips separados diseñados para trabajar en conjunto. En su núcleo se encuentra la GPU Rubin, junto con una CPU Vera diseñada para el razonamiento agéntico (la capacidad de la IA para realizar tareas de forma autónoma). Para abordar los cuellos de botella de memoria, la arquitectura introduce nuevas mejoras de almacenamiento e interconexión a través de los sistemas Bluefield y NVLink de Nvidia. Dion Harris, director sénior de soluciones de infraestructura de IA de Nvidia, señaló que los flujos de trabajo como la IA agéntica o las tareas a largo plazo ejercen una gran presión sobre el KV cache, un sistema de memoria utilizado por los modelos de IA para condensar las entradas. Para resolver esto, Harris explicó que Nvidia ha introducido un nuevo nivel de almacenamiento que se conecta externamente al dispositivo de cómputo, lo que permite a los usuarios escalar sus grupos de almacenamiento de manera más eficiente.
Según las pruebas de Nvidia, la arquitectura Rubin ofrece ganancias sustanciales de rendimiento y eficiencia sobre la arquitectura Blackwell anterior:
- Las tareas de entrenamiento de modelos se ejecutan tres veces y media más rápido.
- Las tareas de inferencia se ejecutan cinco veces más rápido, alcanzando hasta 50 petaflops.
- La plataforma admite ocho veces más cómputo de inferencia por vatio.
Los chips Rubin están programados para ser utilizados por casi todos los principales proveedores de nube, incluso a través de las asociaciones de Nvidia con Anthropic, OpenAI y Amazon Web Services. Los sistemas también se utilizarán en la supercomputadora Blue Lion de HPE y en la próxima supercomputadora Doudna en el Lawrence Berkeley National Lab. Este lanzamiento se produce en medio de la competencia por el hardware de IA. Durante una llamada de resultados en octubre de 2025, Huang estimó que se gastarán entre USD 3 billones y USD 4 billones en infraestructura de IA durante los próximos cinco años.
Por qué importa
Rubin reemplaza la arquitectura Blackwell, introduciendo nuevas mejoras de almacenamiento e interconexión para manejar las demandas de memoria de los flujos de trabajo de IA agéntica.