Самое важное сегодня — конференция GTC от NVIDIA, по сути это «история человечества» в версии про ИИ.

robot
Генерация тезисов в процессе

Сегодня самое важное — конференция Nvidia GTC, прямо как история человечества, только в формате про ИИ.

Джейсон Ху ещё даже не вышел на сцену, а утечек по итогам уже столько, что можно писать книгу.

Ван-ван собрала три главных пункта. Поехали, друзья, следуйте за мной.

1)Стоимость ИИ-вычислений напрямую снижена вдвое

Предыдущее поколение Blackwell уже было мощным, верно? Скоро объявят о запуске в серийное производство новой линейки чипов Vera Rubin.

Чем так хорош Vera Rubin? Если по-простому — двумя словами: дешевле.

Чтобы запустить тот же самый AI-модель, количество чипов сокращается до четверти, а стоимость инференса падает на 90%. Падение на 90%, друзья. AWS, Microsoft и Google — все три крупнейших облачных провайдера — сразу же становятся первыми, кто «сядет на борт».

2)Про Groq, купленный в прошлом году за 20 млрд долларов, сегодня сдаём домашку

Раньше на отчётном собрании Дженсен Ху говорил, что Groq будет подключён к экосистеме Nvidia в качестве расширяющей архитектуры — примерно как тогда, когда купили Mellanox, чтобы добрать сетевые возможности.

LPU Groq находятся в том же дата-центре, что и GPU Nvidia: GPU понимает задачу, а LPU быстро «выдаёт ответ».

Две разные микросхемы в связке — и задержки в сценариях с Agent сразу идут вниз.

AI Agent делает работу за людей: один и тот же таск может гонять десятки раундов настройки модели, и в каждой итерации сжигаются вычислительные мощности для рассуждений — а пользователь при этом ждёт, и если будет медленнее, то опыт развалится.

Инференс идёт в два шага: сначала понять ваш вопрос, а затем — по одному «слову за словом» выдавать ответ.

GPU силён на первом шаге, но по скорости и стабильности выдачи «текста» Groq LPU лучше.

20 млрд долларов — это дорого?

Представьте дальше: в каждой компании будет работать сотни Agent, и каждый Agent будет перенастраивать модель тысячи раз в день.

3)Запуск OpenClaw от Nvidia — называется NemoClaw

Это целый набор открытых платформ: компания ставит его — и может развернуть AI-сотрудников, которые вместо людей будут вести процессы, обрабатывать данные и вести проекты. Говорят, что уже идут переговоры с Salesforce и Adobe.

Самое интересное в том, что NemoClaw не требует, чтобы вы использовали чипы Nvidia. Понаблюдайте за этой логикой. Продажа чипов приносит прибыль только на уровне железа, а правила — это то, где зарабатываются деньги на всей цепочке. Дженсен Ху этот расчёт, похоже, просчитал идеально.

4)Дженсен Ху говорит, что покажет «чипы, которые мир ещё не видел»

С высокой вероятностью впервые покажут Feynman — архитектуру следующего поколения: в массовое производство в 2028 году, на самом передовом техпроцессе TSMC 1,6 нм.

И ещё один не самый очевидный факт, который мне кажется довольно занятным.

Nvidia выпускает процессоры для ноутбуков — две модели, ориентированные на игры. Продавцам видеокарт придётся идти отвоёвывать место у CPU — за чьей-то работой они в этот раз не смогут просто наблюдать.

У меня ощущение, что в будущем Дженсен Ху станет великим человеком целой эпохи.

MSFT2,20%
NVDA0,36%
CRM1,71%
ADBE-1,08%
TSM1,10%
Посмотреть Оригинал
На этой странице может содержаться сторонний контент, который предоставляется исключительно в информационных целях (не в качестве заявлений/гарантий) и не должен рассматриваться как поддержка взглядов компании Gate или как финансовый или профессиональный совет. Подробности смотрите в разделе «Отказ от ответственности» .
  • Награда
  • комментарий
  • Репост
  • Поделиться
комментарий
Добавить комментарий
Добавить комментарий
Нет комментариев
  • Закреплено