Alibaba одновременно наращивает мощность по трём направлениям: моделям, собственным процессорам и дата-центрам. Компания уже обучает Qwen 4, а будущие версии 4.5 и 5 вырастут до 5–10 трлн параметров против нынешних 2,4 трлн в Qwen 3.8 Max. Большие модели нужны для работы с долгосрочным планированием и постепенного перехода к более автономным системам. Архитектуру следующего поколения компания тестирует на экспериментальных вариантах Qwen 3.8.

Сам размер в параметрах не гарантирует качество. Сравнение особенно условно для архитектур типа Mixture of Experts, где каждый токен обрабатывает только часть сети. Но рост с 2,4 до 10 трлн существенно повышает требования к памяти, коммуникациям и вычислительной мощности.

Для такой нагрузки Alibaba представила ускоритель Zhenwu V900 от подразделения T-Head. Чип работает втрое быстрее предшественника M890 и объединяется в кластеры до 500 тысяч ускорителей для обучения и запуска крупных моделей. M890 Alibaba анонсировала в мае вместе с серверной системой Panjiu AL128.

Zhenwu V900 поступит в массовое производство в I квартале 2027 года. Цифра в 500 тысяч процессоров пока обозначает архитектурный потолок, а не уже собранную систему. Но масштаб отражает курс китайской индустрии: Huawei раскрыла свои суперкластеры на сотни тысяч ускорителей и планирует системы на миллион процессоров.

Alibaba расширяет энергетическую базу для этого оборудования. Глава компании Эдди Ву поставил задачу — довести мощность глобальных дата-центров Alibaba Cloud до 20 ГВт к 2032 году. Спрос на ИИ-вычисления уже превосходит имеющиеся мощности, поэтому развёртывание новых суперузлов начнётся уже в текущем квартале. Китайские производители ускорителей всё сильнее упираются в дефицит HBM-памяти — она стала главным узким местом отрасли.

Alibaba пытается контролировать цепочку целиком: от архитектуры Qwen и проектирования чипов до серверов, сетей и облачных ЦОДов. Это снижает зависимость от Nvidia при американских экспортных ограничениях и позволяет оптимизировать модели под собственное оборудование. T-Head в мае сообщила, что клиентам уже поставлено свыше 560 тысяч процессоров Zhenwu предыдущих поколений.

Alibaba анонсировала планы 22 сентября на конференции Apsara в Ханчжоу. Акции компании в Гонконге выросли на 5,1% и достигли максимума примерно за месяц. Масштаб будущей инфраструктуры показывает, что конкуренция в ИИ переходит от отдельных моделей и чипов к способности связать сотни тысяч ускорителей в единую систему.

Модели Qwen уже оказались в необычной политико-технологической истории. В сентябре маленькую модель Alibaba ненадолго нашли в американском Federal Register, затем её убрали оттуда.

Параллельно Alibaba получает доступ к потребительскому рынку через партнёрства. Apple готовит для китайских пользователей отдельную версию Apple Intelligence, где Qwen станет одной из основ локальной ИИ-инфраструктуры.

Гонка китайских компаний уже не похожа на конкуренцию за один самый быстрый чип. Производители компенсируют ограничения на западные ускорители собственными процессорами, сложными коммуникациями и гигантскими кластерами. Если Alibaba приблизится к обещанной границе в 500 тысяч Zhenwu V900, инфраструктура сравнится по масштабу с наиболее амбициозными вычислительными проектами Китая.