Model difusi dalam tugas penalaran justru lebih buruk daripada autoregresi tradisional? Penelitian ini cukup kontra-intuitif, layak dibaca dengan saksama.

Lihat Asli
CoinNetwork
Tim Huang Gao dari Universitas Tsinghua memenangkan Penghargaan Makalah Terkemuka ICML 2026, dan Penghargaan Uji Waktu diberikan kepada algoritma klasik A3C.
Penghargaan Makalah Terbaik ICML 2026 diberikan kepada tim Huang Gao dari Universitas Tsinghua yang berkolaborasi dengan Alibaba, menunjukkan bahwa fleksibilitas model bahasa difusi dalam menghasilkan urutan acak dapat membatasi potensi tugas penalaran seperti matematika dan pemrograman, sementara generasi kiri-ke-kanan lebih sederhana dan secara signifikan meningkatkan akurasi penalaran. Penghargaan Uji Waktu diberikan kepada makalah tim Google DeepMind tahun 2016 yang mengusulkan arsitektur Asynchronous Advantage Actor-Critic (A3C), yang secara substansial meningkatkan efisiensi pelatihan pembelajaran penguatan mendalam.
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Komentar
Tambahkan komentar
Tambahkan komentar
Tidak ada komentar
  • Disematkan