Далеко ли Huawei до NVIDIA? Epoch AI выпустили большой разбор дорожной карты Huawei до 2031 года. Главная метрика в нем H100-эквиваленты. По этой метрике Huawei в этом году выпустит в 25 раз меньше компьюта, чем NVIDIA. Флагман Ascend 950 выдает около 1 PFLOPS в 8-битных вычислениях (FP8), вдвое меньше H100, чипа, которому уже четыре года. Самих чипов в этом году Huawei сделает 1,5 млн против 5,9 млн у NVIDIA. ИИ-ускорителям нужна HBM, сверхбыстрая память, которую ставят вплотную к чипу, а Китай делать ее только начинает. На китайской HBM в этом году собрано всего около 240 тыс. ускорителей Huawei. Половина выпуска идет на более медленной памяти DRAM, остальное держится на корейской HBM, которую накопили до экспортных ограничений или ввезли контрабандой. Этот запас заканчивается в этом году. Если бы Huawei собирала чипы только на китайской HBM, ее выпуск в ближайшие годы составил бы около 1% от вычислительной мощности, которую выпускает NVIDIA. При этом даже если китайские заводы нарастят выпуск HBM, на каждый ее гигабайт памяти Ascend будет давать все меньше произвоидтельности на один ускоритель по сравнению с NVIDIA. Поэтому со временем Huawei будет упираться уже не в память, а в собственные чипы. Даже если ввезти в 10 раз больше HBM, чем Huawei получает от китайских производителей, через пару лет она выпустит лишь 11% от вычислительной мощности NVIDIA. При этом важно понимать, H100-эквиваленты сравнивают ускорители по отдельности, а у Huawei есть ещё и системы. Ее CloudMatrix связывает 384 ускорителя против 72 в стойке NVIDIA и, по оценкам аналитиков, догоняет систему NVIDIA грубой силой, цена которой — вчетверо большее энергопотребление. Проверить, как это работает на реальных задачах, нельзя: Huawei не публикует данных о пропускной способности своей сети. Epoch сама признает, что ее метрика не учитывает ни память, ни такие системы, ни софт. Из-за санкций фабрика SMIC, которая производит чипы Huawei, застряла на техпроцессе 5–7 нм. Обойти это Huawei хочет с помощью своей разработки LogicFolding, укладывая кристаллы слоями друг на друга. До Ascend она дойдет только к 2028-2030, а NVIDIA сделает то же самое на два года раньше и на куда более тонком техпроцессе. В итоге, по оценке Epoch, отставание в три-четыре года сохранится минимум до 2030 года. @anti_agi