Huawei атакует Nvidia масштабом вычислительной системы. Китай готовит новые ИИ-чипы и суперкластеры на миллион процессоров
Huawei решила атаковать преимущество Nvidia не одним рекордным кристаллом, а масштабом всей вычислительной системы. На Huawei Connect 2026 компания перенесла выпуск двух ускорителей Ascend 960 на более ранний срок и раскрыла архитектуру, которая должна объединять до миллиона ИИ-процессоров в единый кластер.
Ascend 960DT теперь должен появиться в первом квартале 2027 года, на три квартала раньше прежнего плана, а Ascend 960PR в третьем квартале, на один квартал раньше. Huawei рассчитывает обновлять линейку ежегодно: за 960 последуют Ascend 970 в 2028 году и Ascend 980 в 2029-м. Для серии 960 компания ранее обещала удвоить вычислительную мощность и пропускную способность памяти относительно Ascend 950.
Главная ставка Huawei лежит не только в характеристиках отдельных ускорителей. Компания пытается компенсировать ограничения китайского производства соединением огромного числа процессоров с высокой скоростью обмена. По оценке Huawei, в обычных серверных кластерах коммуникации между узлами могут забирать более 40% времени обучения, поэтому скорость межсоединений напрямую влияет на полезную загрузку вычислителей.
Для такой схемы Huawei разработала архитектуру Peerium и шину UnifiedBus, которая объединяет процессоры, память, накопители, сетевые адаптеры и коммутаторы. Peerium использует единое адресное пространство памяти и равноправное соединение узлов, чтобы крупная группа оборудования работала как одна вычислительная машина. Максимальный заявленный масштаб архитектуры достигает одного миллиона процессоров.
Параллельно Huawei представила Ascend 960 SuperPoD. Один такой суперузел должен объединять до 4096 ускорителей и выдавать 8 EFLOPS при вычислениях FP8 или 16 EFLOPS при FP4. Huawei использовала единое адресное пространство памяти, жидкостное охлаждение и оптические соединения нового поколения, чтобы сократить задержки внутри огромной системы.
В Ascend 960 SuperPoD компания применяет NPO, где оптические компоненты размещают ближе к сетевым микросхемам. Huawei уже показывала модуль Hi-ONE с пропускной способностью 7,2 Тбит/с. В новом суперузле 5500 таких устройств заменяют 48 тыс. модулей 800G, что, по расчётам производителя, снижает энергопотребление более чем на 550 кВт.
Несколько Ascend 960 SuperPoD можно соединять через UnifiedBus или RoCE. В базовой топологии Huawei обещает масштаб до 512 тыс. ускорителей, а многоуровневая схема должна довести конфигурацию до миллиона. Миллионный суперкластер пока остаётся целевой архитектурой, а не введённой в эксплуатацию системой. Huawei отдельно сообщила, что Atlas 960 с новой оптикой сейчас проходит испытания.
Более близкий к эксплуатации Atlas 950 показывает, как Huawei движется к такому масштабу. Компания уже разворачивает SuperCluster на 256 тыс. ускорителей, а ранее объявляла конфигурации свыше 500 тыс. NPU. Более 1000 систем на Ascend 910C уже развёрнуты, системы Ascend 950 вошли в коммерческую эксплуатацию, а программной экосистемой Ascend ежемесячно пользуются более 5200 разработчиков.
Рост Huawei подпитывают американские ограничения на поставки передовых ускорителей и оборудования для их производства в Китай. Одновременно собственная цепочка поставок остаётся узким местом: дефицит HBM уже поднял цены на китайские ИИ-чипы. Эрик Сюй признал, что Huawei пока не может удовлетворить весь внутренний спрос и поэтому не планирует полномасштабную международную экспансию.
Сюй также заявил, что доля Ascend на китайском рынке ИИ-чипов, по его оценке, уже может превышать долю Nvidia, однако Huawei не привела подтверждающих данных. За пределами аппаратной части преимущество Nvidia сохраняет CUDA: зрелая программная платформа облегчает разработку и перенос моделей, тогда как Huawei продолжает расширять CANN и собственный набор инструментов.
Huawei в итоге строит конкурента Nvidia на системном уровне. Новые Ascend должны сократить разрыв в производительности отдельных чипов, а SuperPoD, UnifiedBus, NPO и Peerium превратить большое число ускорителей в единый вычислительный ресурс. Ключевые показатели Ascend 960 и миллионного кластера пока остаются заявленными характеристиками будущих систем, хотя часть инфраструктуры уже дошла до коммерческого развёртывания и испытаний.