Ці три нові чіпи Nvidia AI є не «покращеними версіями», а «зменшеними версіями», з яких HGX H20 обмежений за пропускною здатністю та швидкістю обчислень, і очікується, що ціна H20 знизиться, але вона все одно буде вищою, ніж вітчизняний ШІ-чіп 910B.
Першоджерело: Titanium Media
Автор: Лінь Чжицзя
Джерело зображення: Створено Unbounded AI
10 листопада нещодавно повідомлялося, що чіп-гігант NVIDIA (NVIDIA) випустить три чіпи штучного інтелекту для китайського ринку на базі H100 у відповідь на останні заходи контролю за експортом мікросхем у Сполучених Штатах.
Згідно зі специфікацією, Nvidia незабаром випустить китайським клієнтам нові продукти під назвами HGX H20, L20 PCle і L2 PCle, які засновані на архітектурах Nvidia Hopper і Ada Lovelace. Судячи зі специфікацій та назви, три продукти націлені на навчання, висновки та периферійні сценарії, і будуть оголошені не раніше 16 листопада, час доставки зразків продукту – з листопада по грудень цього року, а час масового виробництва – з грудня цього року по січень наступного року.
**Titanium Media App дізнався від ряду галузевих мережевих компаній NVIDIA, що вищезазначена новина відповідає дійсності. **
Titanium Media App також ексклюзивно дізнався, що три чіпи NVIDIA зі штучним інтелектом є не «покращеними версіями», а «зменшеними версіями». Теоретично загальна обчислювальна потужність приблизно на 80% нижча, ніж у чіпа графічного процесора NVIDIA H100, тобто H20 дорівнює 20% від комплексної обчислювальної потужності H100, а додавання відеопам'яті HBM та модулів взаємозв'язку NVLink підвищує вартість обчислювальних потужностей. Тому, хоча ціна HGX H20 знизиться в порівнянні з H100, очікується, що ціна цього продукту все одно буде вищою, ніж у вітчизняного AI-чіпа 910B.
«Це еквівалентно розширенню смуг для автомагістралей, але в'їзд на платні ворота не розширюється, що обмежує рух транспорту. Також технічно, завдяки блокуванню апаратного та програмного забезпечення, продуктивність чіпа можна точно контролювати, і немає необхідності замінювати виробничу лінію у великих масштабах, навіть якщо апаратне забезпечення буде модернізовано, продуктивність все одно можна регулювати за потреби. В даний час новий H20 «застряг» у продуктивності з самого початку. Джерело в галузі пояснило новий чіп H20 так: «Наприклад, раніше для виконання завдання з H100 потрібно було 20 днів, але тепер може знадобитися 100 днів, щоб H20 знову запустився». "
Незважаючи на випуск нового раунду обмежень на чіпи в Сполучених Штатах, Nvidia, схоже, не відмовилася від величезного китайського ринку обчислювальних потужностей зі штучним інтелектом.
Отже, чи можна замінити вітчизняні чіпи?Titanium Media App дізнався, що після тестування, ** в даний час, з точки зору висновків про велику модель, вітчизняний чіп штучного інтелекту 910B може досягти лише близько 60%-70% від A100, а навчання моделі кластера є нестійким;У той же час 910B набагато перевершує продукти серії Nvidia A100/H100 з точки зору обчислювальної потужності та нагрівання, і не сумісний з CUDA, що важко повністю задовольнити потреби в навчанні моделей довгострокових інтелектуальних обчислювальних центрів. **
**Поки що Nvidia офіційно не коментувала це. **
Повідомляється, що 17 жовтня цього року Бюро промисловості та безпеки (BIS) Міністерства торгівлі США опублікувало нові правила експортного контролю для мікросхем, запровадивши новий експортний контроль на напівпровідникову продукцію, включаючи високопродуктивні чіпи штучного інтелекту Nvidia, а обмеження набули чинності 23 жовтня. Подання Nvidia до SEC США показує, що заборонені продукти, які набувають негайного ефекту, включають A800, H800 і L40S, найпотужніші чіпи штучного інтелекту.
Крім того, чипові процесори L40 і RTX 4090 зберігають оригінальне 30-денне вікно.
31 жовтня з'явилася новина про те, що Nvidia може бути змушена скасувати замовлення на передові чіпи вартістю $5 млрд, а ціна акцій Nvidia різко впала через цю новину. Раніше A800 і H800 від Nvidia, що поставляються ексклюзивно для Китаю, не могли нормально продаватися на китайському ринку через нові правила в США, і ці два чіпи називалися «кастрованими версіями» A100 і H100, а Nvidia знижувала продуктивність чіпа, щоб відповідати колишнім нормам в США.
31 жовтня речник Китайської ради сприяння міжнародній торгівлі Чжан Сінь заявив, що нещодавно видані правила контролю за експортом напівпровідників, видані Сполученими Штатами Китаю, ще більше посилили обмеження на експорт до Китаю чіпів і обладнання для виробництва напівпровідників, пов'язаних зі штучним інтелектом, і включили низку китайських організацій до «списку суб'єктів» експортного контролю. Ці заходи Сполучених Штатів серйозно порушили принципи ринкової економіки та міжнародні економічні та торговельні правила, а також посилили ризик розриву та фрагментації глобального ланцюжка поставок напівпровідників. Заборона на експорт мікросхем до Китаю, запроваджена Сполученими Штатами з другої половини 2022 року, глибоко змінює глобальний попит і пропозицію, спричиняючи дисбаланс пропозиції мікросхем у 2023 році, впливаючи на структуру світової індустрії мікросхем і завдаючи шкоди інтересам підприємств різних країн, включаючи китайські компанії.
Порівняння параметрів продуктивності NVIDIA HGX H20, L20, L2 та інших продуктів
**Titanium Media App дізнався,**Нові чипи HGX H20, L20 і L2 AI засновані на архітектурах NVIDIA Hopper і Ada відповідно, які підходять для хмарного навчання, хмарного висновків і периферійного висновку.
Серед них продукти логічного висновку ШІ двох останніх L20 і L2 мають схожу «вітчизняну заміну» та CUDA-сумісні рішення, тоді як HGX H20 базується на H100 та навчальних чипах штучного інтелекту шляхом кастрації прошивки, в основному замінюючи A100/H800.
Згідно з документами, новий H20 має передову технологію упаковки CoWoS, і додав HBM3 (високопродуктивна пам'ять) до 96 ГБ, але вартість також зросла на $240; Щільна обчислювальна потужність FP16 H20 досягає 148TFLOPS (трильйон операцій з плаваючою комою в секунду), що становить близько 15% обчислювальної потужності H100, тому необхідно додати додаткові алгоритми та витрати на персонал. NVLink буде оновлено з 400 ГБ/с до 900 ГБ/с, тому швидкість взаємоз'єднання буде значно збільшена.
Згідно з оцінкою, H100/H800 є основною практичною схемою обчислювальних кластерів потужності. Серед них теоретичний ліміт H100 становить 50 000 карт, а максимальна обчислювальна потужність - 100 000 P, максимальний практичний кластер H800 - 20 000-30 000 карт, із загальною обчислювальною потужністю 40 000 P, а максимальний практичний кластер A100 - 16 000 карт і максимальна обчислювальна потужність - 9600P.
Однак теоретичний ліміт нового чіпа H20 становить 50 000 карт, але обчислювальна потужність кожної карти становить 0,148P, а загальна обчислювальна потужність становить майже 7400P, що нижче, ніж у H100/H800 і A100. Таким чином, масштаб кластера H20 далекий від теоретичного масштабу H100, і, виходячи з оцінки обчислювальної потужності та балансу зв'язку, розумна медіана загальної обчислювальної потужності становить близько 3000P, і для завершення навчання моделі параметрів на 100 мільярдів рівнів потрібно додати більше витрат і більше обчислювальної потужності.
**Два експерти напівпровідникової промисловості повідомили Titanium Media App, що, виходячи з оцінки поточних параметрів продуктивності, дуже ймовірно, що продукти графічного процесора Nvidia B100 більше не будуть продаватися на китайському ринку в наступному році. **
В цілому, якщо велике модельне підприємство хоче проводити навчання великих моделей з такими параметрами, як GPT-4, масштаб кластера обчислювальних потужностей є ядром, і в даний час тільки H800 і H100 можуть бути компетентними для навчання великих моделей, в той час як продуктивність вітчизняного 910B знаходиться між A100 і H100, що є лише «резервним вибором останньої надії».
Тепер новий H20, випущений Nvidia, більше підходить для навчання вертикальних моделей і висновків, які не можуть задовольнити потреби в навчанні великих моделей трильйонного рівня, але загальна продуктивність трохи вища, ніж у 910B, у поєднанні з екологією CUDA від NVIDIA, таким чином блокуючи єдиний шлях вибору для вітчизняних карт на китайському ринку чіпів штучного інтелекту в майбутньому відповідно до наказу США про обмеження чіпів.
Згідно з останнім фінансовим звітом, у кварталі, що закінчився 30 липня, понад 85% продажів Nvidia на $13,5 млрд припало на США та Китай, і лише близько 14% продажів припало на інші країни та регіони.
Під впливом новин про H20, станом на закриття фондового ринку США 9 листопада ціна акцій Nvidia трохи зросла на 0,81% і закрилася на рівні 469,5 долара за акцію. За останні п'ять торгових днів Nvidia зросла більш ніж на 10%, а остання ринкова вартість становить 1,16 трильйона доларів.