Huawei는 7월 28일 UTC 08:17에 자사 Ascend 스택이 Kimi K3에 대해 "0day" 적응을 달성했다고 발표했습니다. Moonshot이 가중치를 올린 지 대략 19시간 만입니다. Huawei의 주장에 따르면 중국 최대 오픈 모델이 NVIDIA 하드웨어 없이, 언급된 경로 전반에서 중국산 가속기 위에서 구동됩니다.

Huawei가 밝힌 스택

MindSpeed MM을 통한 훈련은 Atlas 800 A3Atlas 900 A3 SuperPoD 시스템에서 이뤄졌으며, 연산자 수준의 병렬 가속과 메모리 최적화가 적용됐습니다. 추론은 vLLM AscendSGLang을 통해 수행됩니다. Huawei는 자사의 Ascend 950 슈퍼 노드가 필요한 전체 수치 범위인 FP8, MXFP8 및 MXFP4를 지원한다고 밝혔습니다. 마지막 형식이 핵심입니다. 모델 카드에 따르면 MXFP4는 바로 Kimi K3가 배포되는 가중치 형식이기 때문입니다.

'0day'가 의미하는 것과 의미하지 않는 것

이는 Huawei의 자체 마케팅 용어로, 적응 가능성을 뜻합니다. 즉 소프트웨어 경로가 존재하고 실행된다는 의미입니다. 성능 주장은 아닙니다. 벤치마크도, 토큰 처리량도, 지연 시간도, 토큰당 비용 수치도 공개되지 않았습니다. Ascend 950의 MXFP4 지원 역시 입증이 아니라 주장입니다. 여기에는 2.8조 개 매개변수 모델을 이 하드웨어에서 실행하는 것이 경제적으로 경쟁력이 있다는 점은 전혀 입증되지 않습니다. 가능하다는 점만 보여줍니다.

왜 이 조합이 핵심인가

이번 주의 다른 소식들과 함께 보면 더 분명해집니다. 중국 연구소가 최전선 규모의 오픈 가중치를 공개했고, 중국 제조업체는 국내 가속기를 만드는 리소그래피 장비를 만들기 시작했으며, 중국 벤더는 하루 안에 자사 실리콘에서 해당 모델이 구동되는 모습을 보여줬습니다. 각각은 따로 보면 별것 아닐 수 있습니다. 그러나 이 연결 고리 전체가 중국이 3년간 주장해 온 논지이며, 약 36시간에 걸쳐 공개적으로 조립된 것입니다. 그리고 그 논지는 같은 아침 SK Hynix의 주가를 14.65% 끌어내린 것과 같은 논리입니다.

출처상 유의점

이번 발표는 공개적으로 가져올 수 없는 Huawei의 WeChat 공식 계정을 통해 나갔고, 작성 시점에는 중국 기술 매체 한 곳이 보도했습니다. 하드웨어 명칭은 Huawei의 자체 개발자 사이트와 일치합니다. 이 기능 주장은 자가 보고로 간주해야 하며, 독립적인 확인은 헤드라인보다 늦게 나올 가능성이 큽니다.