torygreen

vip
Возраст 3год
Максимальный уровень 0
Пока нет содержимого
Последний опрос McKinsey State of AI содержит статистику, которая должна заставить многие SaaS-компании почувствовать себя неуютно:
32% компаний заявляют, что уже отказались от покупки как минимум одного программного продукта или функции, поскольку кодинг-агенты могут создать их самостоятельно.
Это не означает, что компании перестают покупать ПО. Это означает, что монетизировать уровень «функций» становится гораздо сложнее.
Если внутренняя команда может воссоздать узкий рабочий процесс за день или два, поставщикам нужно обосновывать модель подписки чем-то, что агенты не могут дёшево воспроизве
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Скорость инференса начинает иметь для агентов гораздо большее значение, чем просто более быстрое отображение ответов.
Новый CS-4 от Cerebras обеспечивает, по заявлению компании, инференс до 30 раз быстрее, чем GPU-системы, — более 4 400 токенов/с на GPT-OSS-120B.
Для агентов эта скорость превращается в дополнительный бюджет на рассуждения.
За те же 30 секунд более быстрая система может исследовать больше вариантов, повторять неудачные попытки, выполнять больше проверок или использовать более крупную модель, не заставляя пользователя ждать дольше.
Поэтому количество токенов в секунду постепенно
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Наступает момент, когда компании, создающие вертикальные ИИ-решения, перестают выглядеть как клиенты API и начинают выглядеть как компании, создающие модели.
За шесть месяцев Harvey выросла примерно с 1 триллиона до 14,5 триллиона токенов в месяц. Теперь компания проводит постобучение собственной юридической модели поверх Kimi K3, используя специализированные задачи, отзывы экспертов и собственные данные о рабочих процессах.
Thomson Reuters движется в том же направлении, создавая собственную юридическую модель.
Похоже, это вполне естественная эволюция.
При небольших объёмах очевидным выбором я
KIMI3,00%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Программирование, возможно, было лишь первым рынком для агентов, а не крупнейшим.
С февраля число еженедельно активных пользователей Codex выросло:
> в 108 раз в юриспруденции,
> в 41 раз в продажах,
> в 41 раз в рекрутинге
> в 26 раз в маркетинге.
В инженерии рост составил лишь 5 раз.
А к июню на использование агентов уже приходилось 64% совокупного числа выходных токенов Codex и ChatGPT среди корпоративных клиентов.
Вероятно, начать было проще всего с разработки ПО, поскольку эта работа структурирована, требует активного использования инструментов и относительно легко поддаётся проверке.
Теп
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
У LLM интернет уже ждал их. У Embodied AI — нет.
Роботам нужны огромные объёмы данных о взаимодействии с реальным миром, а ACE Robotics оценивает, что сегодня у всего сектора есть лишь около 100 тыс. полезных часов.
Китай уже пытается создать такой датасет: учебные центры покупают роботов, дистанционно управляют ими при выполнении реальных задач, собирают траектории, а затем передают эти данные обратно производителям роботов.
Поэтому некоторые первые внедрения гуманоидов — это нечто большее, чем тестирование оборудования. Они генерируют обучающие данные, которые понадобятся следующему поколени
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Довольно безумно, насколько быстро наращиваются возможности, тогда как бюджет на оборудование почти не меняется.
> Qwen3.5-27B набрала 35 баллов в Artificial Analysis в феврале.
> Qwen3.6-27B подняла этот показатель до 38 в апреле.
> Qwen3.8-27B теперь набирает 52, оставаясь при этом примерно в том же диапазоне из 27B параметров.
А её агентные возможности теперь находятся примерно на уровне моделей, которые значительно крупнее и гораздо дороже в обслуживании.
Для меня это кажется более важным, чем очередная перетасовка рейтинга.
Годами развитие ИИ в основном означало масштабирование лежащего в
Посмотреть Оригинал
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Сетевые технологии для ИИ начинают выглядеть как отдельный мини-цикл капитальных расходов.
@Cisco завершила FY2026 с заказами от гиперскейлеров на инфраструктуру ИИ на сумму 9,3 миллиарда долларов и прогнозирует рост выручки от инфраструктуры ИИ примерно с ~$4B до 7,5 миллиарда долларов в следующем году. Arista только что увеличила выручку на 37,7% г/г — до 3,04 миллиарда долларов
Думаю, интересно то, куда теперь начинает направляться каждый дополнительный доллар, вложенный в ИИ.
На первом этапе развертывания основное внимание уделялось тому, чтобы подключить к работе как можно больше ускорит
CSCO1,17%
Посмотреть Оригинал
  • Награда
  • комментарий
  • 1
  • Поделиться
Несколько лет назад на гиперскейлеров приходилось около 16% капитальных затрат компаний из S&P 500. В следующем году пять из них могут потратить столько же, сколько остальные 495 компаний вместе взятые.
Microsoft, Amazon, Alphabet, Meta, Oracle
Теперь BofA оценивает расходы пяти компаний в 2027 году примерно в 1,07 триллиона долларов против около 1,06 триллиона долларов у всех остальных компаний индекса.
Такая концентрация начинает иметь значение далеко за пределами GPU.
ИИ стал настолько масштабным, что спрос на вычислительные мощности начинает тянуть за собой физическую экономику. Goldman оц
MSFT0,98%
AMZN-0,26%
META1,10%
ORCL2,87%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Агентный трафик в интернете растёт настолько быстро, что Cloudflare создала браузер специально для ИИ-агентов (Kitesurf).
Агенты по сути наследуют примерно 30 лет решений в дизайне браузеров, принятых для людей, смотрящих на экраны, и многое из этого становится ненужными накладными расходами при одновременном запуске тысяч сессий.
Трафик, генерируемый ИИ, почти утроился за 2025 год, а трафик от ИИ-агентов и агентных браузеров вырос на 7 851% год к году.
Согласно текущим оценкам, сегодня агенты генерируют примерно 57% веб-запросов.
Главное преимущество Kitesurf в том, что он убирает такие элеме
NET2,54%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Безумие, что растущий дефицит памяти уже начинает менять ландшафт GPU ещё до их поставки.
@nvidia теперь тестирует варианты HBM с меньшим числом слоёв для Rubin Ultra. Изначальная конструкция с 12 слоями HBM4e могла обеспечить 14–16 Гбит/с, тогда как новый оптимизированный вариант HBM4, вероятно, достигнет 11–12.
Привлекательность такого подхода — в объёмах. Меньшее число слоёв DRAM на один ускоритель позволяет распределить тот же объём поставок пластин между большим количеством GPU.
Но модель не становится меньше из-за сокращения стека памяти. Если ей приходится распределяться между большим ч
NVDA-1,42%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Обязательства крупных технологических компаний по инфраструктуре ИИ выходят далеко за пределы обычно публикуемых показателей капзатрат. Они обязались выплатить в будущем примерно 1,09 триллиона долларов по договорам аренды, главным образом за дата-центры для ИИ.
В настоящее время в качестве арендных обязательств отражается лишь около 285 миллиардов долларов, поскольку многие договоры не признаются до ввода объектов в эксплуатацию.
Настоящий риск заключается в несоответствии сроков. Срок некоторых договоров аренды составляет от 15 до 30 лет, тогда как чипы, модели и клиентский спрос могут измен
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Спрос дата-центров на электроэнергию растёт настолько быстро, что энергосети не успевают, и теперь компании доставляют газовые турбины на грузовиках, чтобы обойти эту проблему.
APR Energy только что ввела в эксплуатацию восемь мобильных установок общей мощностью 1,1 ГВт, предназначенных непосредственно для удовлетворения спроса дата-центров.
Подумайте, что это значит. Турбина на трейлере хуже подключения к энергосети по всем параметрам, кроме одного: её можно запустить за несколько месяцев, а не за несколько лет. Платить такую премию имеет смысл только в том случае, если именно ожидание вас уб
APR0,34%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Запуск DeepSeek V4 Flash 0731 на своём собственном железе — это уже реальность, но то, во сколько это обходится и стоит ли того, сильно зависит от того, кто вы.
машины, которые реально это тянут:
> 256GB M3 Ultra Mac Studio (~$7–9k): держит 4-битную сборку с запасом, чисто одним устройством.
> 512GB M3 Ultra (~$10k+, если удастся найти): комфортно запускает почти без потерь.
> 2x H200 или 4x A100 сервер: полный чекпоинт на 1M контексте, но теперь вы слегка в деньгах датацентра.
технически оно работает и на 128GB, но только на тяжёлой 3-битной компрессии, которая ухудшает качество.
итого ~$7–10
DEEPSEEK12,58%
Посмотреть Оригинал
post-image
  • Награда
  • 1
  • Репост
  • Поделиться
GateUser-3e640a4c:
Это тот самый отечественный deepseek?
Поставщик чипов. Инфраструктурный кредитор. Долевой инвестор в собственных клиентах. Nvidia сейчас одновременно делает все три роли, и в этом месяце счет за ношение всех трех шляп составил $750B
> $250B покрытие аренды OpenAI в Огайо.
> $500B сцеплена со SK Group по памяти.
> $5B входит в SSI — компанию без продукта.
> $1B входит в Naver. Участие в Nebius. Чипы поступают на техасские объекты, которые Nvidia арендует у себя же.
Замкнутый контур, который Nvidia по сути создала, заключается в том, чтобы финансировать клиента -> клиент покупает чипы Nvidia -> Nvidia отражает выручку -> Nvi
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Мы уже пересекли ~$1T в мировых капитальных затратах на дата-центры, идя к $1,7T к 2030 году. Это больше, чем $455B в 2024-м.
Это почти 4-кратный рост за шесть лет. Четыре американских гипермасштабируемых игрока примерно удваиваются за этот период. Все остальное — неоклауды, AI-лаборатории, суверенные проекты — именно то, что на самом деле изгибает кривую, прирастая в среднем примерно на 39% в год. К 2030 году Amazon, Google, Meta и Microsoft будут составлять лишь около половины от этого объема.
Два года назад развертывание по сути было делом четырех компаний. Сейчас это целое поле игрок
AMZN-0,26%
META1,10%
MSFT0,98%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
  • Закреплено