Microsoft ofreció a Maia 200 su primera divulgación arquitectónica completa en Hot Chips el martes por la tarde: un dado de 820 mm² con 140.000 millones de transistores en TSMC 3nm, con un consumo de 750 W, una capacidad nominal de 10.000 TFLOPS de FP4 y mostrado en una configuración de 128 racks y aproximadamente 6.000 chips.

Una pieza de silicio genuinamente enorme

820 mm² es tamaño retícula, cercano al máximo que puede tener un solo dado. La conectividad es inusual y deliberada: una NIC personalizada y Ethernet unificado, con ningún tejido de scale-out separado, ocho líneas Ethernet por SoC repartidas en cuatro planos de red. Microsoft apuesta por que una sola red basada en Ethernet pueda transportar tanto el tráfico de scale-up como el de scale-out.

Lo que el encuadre habitual interpreta mal

Dos cosas. La cifra de computación es FP4: 10 PFLOPS de matemática de cuatro bits es aproximadamente comparable a los 13,4 PFLOP/s de MXFP4 de OpenAI, y no es comparable con ninguna cifra de FP8 o BF16. No se dio una cifra densa. Pero el titular enterrado es la memoria, y apunta en la dirección equivocada para Microsoft. Maia 200 usa HBM3e mientras que las piezas con las que se le comparó esa misma tarde usan HBM4. Microsoft reveló el ancho de banda —7 TB/s—, pero no la capacidad, solo el número de pilas. Citar 7 TB/s junto a los 15,4 TB/s de OpenAI sin señalar la generación de memoria es el error que hay que evitar: seis pilas de HBM3e son un subsistema de memoria de generación 2024 en un acelerador de 2026, y la capacidad es el dato que decide qué modelos caben.

«Preparándose para desplegarlo» no es lo mismo que desplegado

Microsoft describió el chip como en vías de preparación para Azure. Esa es una afirmación distinta de la de OpenAI, hecha horas más tarde, de que Codex ya está funcionando en Jalapeño. La cifra de 128 racks y 6.000 chips es una configuración demostrada, no una flota instalada.

Y puede que ya haya un sucesor en camino

Informaciones anteriores de agosto sitúan a Microsoft avanzando hacia Maia 300 con un horizonte temporal de septiembre. Si eso se confirma, Maia 200 será una generación de vida breve que llega con una memoria más antigua que la de sus pares, aún sin desplegar, mientras el cliente para el que fue construido en parte ejecuta su propio silicio.