Фьючерсы
Доступ к сотням фьючерсов
CFD
Золото
Одна платформа мировых активов
Опционы
Hot
Торги опционами Vanilla в европейском стиле
Единый счет
Увеличьте эффективность вашего капитала
Демо-торговля
Введение в торговлю фьючерсами
Подготовьтесь к торговле фьючерсами
Фьючерсные события
Получайте награды в событиях
Демо-торговля
Используйте виртуальные средства для торговли без риска
CFD
Деривативы CFD на акции
Акции США
Доступ к реальным акциям США и ETF
Акции Гонконга
Торгуйте качественными акциями, котирующимися в Гонконге
Корейские акции
SK Hynix
Торгуйте реальными корейскими акциями и инвестируйте в популярные активы
Фьючерсы на акции
Высокое кредитное плечо, круглосуточная торговля
Токенизированные акции
Обеспечено реальными акциями
IPO Access
Откройте полный доступ к глобальным IPO акций
GUSD
3.8%
Создать GUSD для получения доходности казначейских RWA
Мероприятия, связанные с акциями
Торгуйте популярными акциями и получайте щедрые эирдропы
Запуск
CandyDrop
Собирайте конфеты, чтобы заработать аирдропы
Launchpool
Быстрый стейкинг, заработайте потенциальные новые токены
HODLer Airdrop
Удерживайте GT и получайте огромные аирдропы бесплатно
Pre-IPOs
Откройте полный доступ к глобальным IPO акций
Alpha Points
Торгуйте и получайте аирдропы
Фьючерсные баллы
Зарабатывайте баллы и получайте награды аирдропа
Инвестиции
Simple Earn
Зарабатывайте проценты с помощью неиспользуемых токенов
Автоинвест.
Автоинвестиции на регулярной основе.
Бивалютные инвестиции
Доход от волатильности рынка
Мягкий стейкинг
Получайте вознаграждения с помощью гибкого стейкинга
Криптозаймы
0 Fees
Заложите одну криптовалюту, чтобы занять другую
Центр кредитования
Единый центр кредитования
VIP-центр богатства
Планы премиального роста
Gate Wealth
Возьмите под контроль свое финансовое будущее
Количественный фонд
Лучшие стратегии
Стейкинг
Делайте стейкинг криптовалюты, чтобы заработать на продуктах PoS
Умное плечо
Плечо без риска ликвидации
GUSD
3.8%
Пополнение и погашение в любое время, без комиссии
Рекламные акции
Промоакции
Участвуйте и получайте награды
Реферал
200 USDT
Приглашайте друзей за бонусы
Партнерская программа
Эксклюзивные комиссионные
Gate Booster
Растите влияние и получайте аирдроп
Анонсы
Обновления в реальном времени
Блог Gate
Статьи о криптоиндустрии
VIP-услуги
Огромные скидки на комиссии
Управление активами
Универсальное решение для управления активами
Институциональный
Крипто-решения для бизнеса
Разработчикам (API)
Подключение к экосистеме приложений Gate
Внебиржевые банковские переводы
Ввод и вывод фиатных денег
Брокерская программа
Щедрые механизмы скидок API
AI
Gate AI
Ваш универсальный AI-ассистент для любых задач
Gate AI Bot
Используйте Gate AI прямо в вашем социальном приложении
GateClaw
Gate Синий Лобстер — готов к использованию
Gate for AI Agent
AI-инфраструктура: Gate MCP, Skills и CLI
Gate Skills Hub
Более 10 тыс навыков
От офиса до трейдинга: единая база навыков для эффективного использования ИИ
Интеллектуальный обзор GLM-5 «Проблема кодировки»: миллиарды вызовов Coding Agent в день, две гонки багов скрыты в KV Cache
После нескольких недель расследования команда выявила два независимых низкоуровневых гонки в коде. Первый связан с архитектурой разделения PD (распределение предварительной обработки и декодирования на разные узлы): при тайм-ауте декодера запрос отменяется и KV Cache (кэшированные состояния внимания, избегая повторных вычислений) освобождается, но запись RDMA на стороне предварительной обработки еще не завершена, новый запрос получает ту же видеопамять, и старые данные перезаписывают новые. Исправление — добавление явной синхронизации перед освобождением, чтобы убедиться, что запись завершена. После внедрения ошибка снизилась с десятих долей процента до менее трети процента.
Второй баг связан с HiCache (многоуровневый KV Cache): при асинхронной загрузке из памяти CPU в кэш отсутствует точка синхронизации между потоками загрузки и вычислений, из-за чего вычислительный блок может начать чтение данных, которые еще не загружены. После исправления такие ошибки полностью исчезли, патч был отправлен в сообщество SGLang (PR #22811).
Во время расследования также было обнаружено неожиданное явление: метрика приемлемости выборки спекулятивных токенов (тех, что сначала предполагаются малой моделью, а затем проверяются большой) может служить сигналом для обнаружения ошибок. При искажении текста почти все черновые токены отвергаются, при повторных воспроизведениях уровень приемлемости заметно выше. Команда внедрила онлайн-мониторинг: при достижении порога генерация автоматически останавливается и повторяется.
После исправления багов команда также оптимизировала узкий место: разделение KV Cache по слоям (LayerSplit KV Cache), при котором каждый GPU хранит только часть слоев, а не весь KV Cache, с помощью координированных вычислений через широковещание. При 90% уровне попадания в кэш, при длине запроса от 40K до 120K, пропускная способность увеличилась на 10% до 132%, а при более длинных контекстах прирост оказался еще выше.