2025-09-29 21:48:48

Selamat kepada tim riset atas kemajuan inferensi DeepSeek V3/R1.

Pada NVIDIA GB200 NVL72, mereka mencapai 26k token input/detik dan 13k token output/detik per GPU — peningkatan kecepatan hampir 4× / 5× dibandingkan H100.

Mereka mencapainya dengan NVFP4 MoE, perhatian FP8, dan penskalaan ke bawah paralelisme ahli

Lihat Asli

Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.

13 Suka

Hadiah
13
7
Posting ulang
Bagikan

Komentar

0/400

Tidak ada komentar

Topik TrendingLihat Lebih Banyak
#Gateperpdexislive
32.9K Popularitas
#Joingrowthpointsdrawtowiniphone17
86.9K Popularitas
#Cryptomarketrebound
207.9K Popularitas
#ShowMyAlphaPoints
167.4K Popularitas
#Fedofficialsspeakup
16.4K Popularitas

Sematkan

peta situs