Hal terpenting hari ini adalah konferensi GTC Nvidia, sungguh sebuah sejarah manusia versi AI.

robot
Pembuatan abstrak sedang berlangsung

Hal terpenting hari ini adalah konferensi GTC dari Nvidia—rasanya seperti sejarah manusia edisi AI.

Belum juga Huang Renxun naik panggung, volume informasi yang sudah bocor lebih dulu sudah cukup untuk dijadikan satu buku.

Wanwan merangkum tiga sorotan utama, ayo teman-teman gemuk, ikuti aku.

1)Biaya komputasi AI langsung dipotong separuh

Blackwell generasi sebelumnya sudah sangat ganas, kan? Segera akan diumumkan produksi massal chip generasi baru, Vera Rubin.

Vera Rubin ganas di mana? Intinya cuma dua kata: lebih murah.

Jalankan model AI yang sama, jumlah chip dipotong menjadi seperempat, biaya komputasi inferensi turun 90%. Turun 90%, teman-teman. AWS, Microsoft, dan Google—tiga perusahaan cloud terbesar—langsung jadi batch pertama yang ikut.

2)Groq yang tahun lalu dibeli senilai 20 miliar dolar hari ini menyerahkan tugas

Sebelumnya Huang Renxun bilang di rapat kinerja bahwa Groq akan diintegrasikan ke ekosistem Nvidia sebagai arsitektur ekstensi, seperti dulu ketika membeli Mellanox untuk melengkapi kemampuan jaringan.

Groq LPU dan GPU Nvidia berada di pusat data yang sama: GPU memahami masalah, LPU mengeluarkan jawaban dengan cepat.

Dua jenis chip yang dibagi tugas dan bekerja sama, latensi skenario Agent langsung ditekan habis-habisan.

Agent AI mengerjakan kerjaan untuk manusia. Satu tugas bisa bolak-balik menyesuaikan model puluhan putaran, dan tiap putaran tetap membakar biaya komputasi inferensi—sementara pengguna di situ menunggu. Kalau lebih lambat, pengalaman langsung berantakan.

Inferensi ada dua langkah: pertama memahami pertanyaanmu, lalu mengeluarkan jawaban kata demi kata.

GPU jago di langkah pertama, tapi untuk kecepatan dan stabilitas saat “mengeluarkan kata” di langkah kedua, LPU Groq lebih kuat.

20 miliar dolar itu mahal?

Bayangin saja nanti tiap perusahaan menjalankan ratusan Agent, dan setiap Agent setiap hari mengubah model ribuan kali.

3)OpenClaw versi Nvidia hadir, namanya NemoClaw

Ini adalah satu platform open-source. Setelah dipasang, perusahaan bisa menerapkan “karyawan AI” untuk menggantikan manusia menjalankan proses, memproses data, dan mengelola proyek. Katanya sudah sedang membahas kerja sama dengan Salesforce dan Adobe.

Yang menarik adalah: NemoClaw tidak mengharuskan kamu memakai chip Nvidia. Coba pikirkan logikanya, kan. Jual chip cuma dapat uang dari lapisan perangkat keras. Hanya dengan menetapkan aturan, baru bisa menghasilkan uang dari seluruh rantai. Huang Renxun menghitung ini dengan sangat matang.

4)Huang Renxun bilang akan menampilkan “chip yang belum pernah dilihat dunia”

Kemungkinan besar Feynman—arsitektur generasi berikutnya—pertama kali unjuk diri, produksi massal pada 2028, dengan proses teknologi 1,6 nm paling canggih dari TSMC.

Selain itu, ada satu bahan yang agak “di luar radar” dan menurutku cukup menarik.

Nvidia mengeluarkan prosesor untuk laptop, ada dua model—fokus utamanya gaming. Penjual kartu grafis mau rebutan penghasilan dari CPU juga ya.

Wanwan rasa ke depannya, Huang Renxun bakal jadi tokoh besar generasi ini.

MSFT-0,80%
NVDA1,20%
CRM-1,49%
ADBE-1,74%
TSM4,10%
Lihat Asli
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Komentar
Tambahkan komentar
Tambahkan komentar
Tidak ada komentar
  • Disematkan