Nvidia ofreció el lunes por la noche, en Hot Chips, la primera divulgación arquitectónica de la GPU Rubin: dos matrices del tamaño de una retícula en TSMC 3nm, 336.000 millones de transistores, unas 1,6 veces Blackwell, con hasta 288 GB de HBM4 a 22 TB/s — alrededor de 2,8 veces el ancho de banda de HBM3e de Blackwell.

El rack, y el edificio

A nivel de rack, NVLink 6 mueve 3,6 TB/s all-to-all por GPU con 130 TFLOPS de computación en red, sobre una distribución de 800 VDC y una entrada líquida de 45°C. Nvidia afirma un 40% más de GPUs por vatio provisionado mediante suavizado de la potencia. Luego hay un segundo nivel de cifras — 2 ZFLOPS de inferencia NVFP4, 1,4 ZFLOPS de entrenamiento, 11 PB de HBM4, 800 PB/s — y todas se sitúan a escala de fábrica de IA de 100 MW.

Lo que falla en el encuadre convencional

Tres errores, y se acumulan. Primero, 11 PB de HBM4 es un edificio, no un rack ni un sistema; es la memoria instalada en una instalación de 100 megavatios. Los 2 ZFLOPS tienen el mismo denominador. Ambos se volverán a reproducir como cifras de rack a lo largo de la semana. Segundo — y este es el que invierte la historia — 288 GB no es más memoria de la que puede comprarse hoy. Es la misma capacidad que Blackwell Ultra. Quien lea "HBM4" como "ahora caben modelos más grandes en una sola GPU" lo está entendiendo al revés; lo que ha mejorado es la velocidad a la que se mueven los pesos, no cuántos caben allí. Tercero, la cifra de "hasta 30x" no es una aceleración. Son tokens por megavatio con alta interactividad, medidos en una carga de trabajo agéntica elegida por el proveedor — DeepSeek-v4-PRO con un contexto de más de 140K — y 10x es la misma curva en otro punto.

La métrica lo delata

Nvidia ha dejado de abrir con FLOPS y ha pasado a hacerlo con tokens por vatio a una latencia determinada. Eso no es un desvío de marketing. Es una lectura precisa de lo que ahora limita a sus clientes: no el precio del silicio, sino cuánta energía puede conectar un emplazamiento y cuántos tokens pueden extraerse de cada megavatio una vez conectado. Un proveedor que cita rendimiento por vatio te está diciendo contra qué restricción cree que estás comprando realmente.

Lo que esto no es

Vera Rubin ya fue declarada en producción en Computex a principios de este año. Se trata de una divulgación técnica sobre un producto que ya se está enviando, no de un adelanto de uno que aún no se ha lanzado, lo que convierte el encuadre de las cifras a escala de fábrica en una elección y no en una necesidad.