개발자 AI 수요를 보여주는 가장 주목받는 공개 순위표가 뒤집혔습니다. Xiaomi, Alibaba, DeepSeek, MiniMax and Moonshot 등 중국 출신 모델이 이제 모델 라우팅 마켓플레이스인 OpenRouter 전체 트래픽의 45% 이상을 차지하고 있으며, 이는 1년 전 2%에도 못 미치던 수준에서 급증한 것입니다. 토큰 حجم 기준 플랫폼 상위 5개 모델 중 4개가 중국계이며, OpenAI의 점유율은 약 7.5%에 머뭅니다.

The leader

최상위는 Xiaomi의 MiMo-V2-Pro입니다. 총 파라미터 1조 개 이상(활성 420억 개)의 mixture-of-experts 모델로, 100만 토큰 컨텍스트 윈도우와 agentic 작업에 대한 강한 최적화를 갖췄습니다. 이 모델은 OpenRouter에서 주당 4조 토큰 이상을 처리하며, 이는 플랫폼의 약 21%에 해당하고 Claude Sonnet 4.6의 두 배가 넘습니다. 가격은 입력 토큰 100만 개당 1달러, 출력 100만 개당 3달러로, 서구 최첨단 모델 가격의 일부에 불과합니다.

The 'quiet ambush'

MiMo-V2-Pro는 스텔스 방식으로 등장했습니다. March 11, 익명의 Hunter Alpha라는 모델이 OpenRouter에 나타나 순위표를 너무 빠르게 올라 커뮤니티는 공개되지 않은 DeepSeek V4라고 추정했습니다. Xiaomi가 March 18 이를 공개하자 주가는 5.8% 뛰었습니다. Xiaomi의 MiMo 책임자이자 전 DeepSeek 연구원인 Luo Fuli는 "나는 이것을 조용한 기습이라고 부릅니다. 우리가 계획해서가 아니라 Chat에서 Agent 패러다임으로의 전환이 너무 빨랐기 때문입니다"라고 말했습니다.

Price, not benchmarks

서구 모델들이 여전히 벤치마크에서는 우위를 보입니다. MiMo-V2-Pro는 SWE-bench Verified에서 78%를 기록해 Claude Opus 4.6의 80.8%에 못 미치며, Artificial Analysis의 지능 지수에서는 8위에 올랐습니다. 하지만 가격 격차가 실제로 작동하고 있습니다. GLM-5.2는 100만 토큰당 1.40달러/4.40달러이고, DeepSeek V4-Pro는 0.44달러/0.87달러를 받습니다. 토큰이 수십억 단위로 소모되는 대규모 agentic 워크로드에서는 "가격의 5분의 1 수준으로 충분히 좋다"는 모델이 이기고 있습니다.

The caveats

OpenRouter는 엔터프라이즈 조달이 아니라 개발자와 취미 개발자의 라우팅을 측정합니다. 엔터프라이즈 부문에서는 여전히 데이터 관할권과 컴플라이언스 우려가 구매자를 서구 쪽으로 이끕니다. 리뷰어들은 중국 모델의 정치 관련 주제 제한과 불안정한 구조화 도구 호출도 지적합니다. 또한 MiMo-V2-Pro 자체는 closed-weight입니다. 이는 "Chinese"와 "open"이 겹치지만 동일하지는 않다는 점을 상기시킵니다. 그럼에도 Qwen만으로도 Hugging Face에서 10만 개가 넘는 파생 모델이 만들어졌습니다.