Postingan

Xiaomi baru saja menerbitkan sesuatu yang biasanya dirahasiakan lab: biaya RL sebenarnya.


MiMo-V2.6 Pro dan Flash sama-sama dilatih dengan 753 ribu sampel dan berhenti di langkah 30.
> Pro menghabiskan 2,62 juta dolar AS.
> Flash menghabiskan 854 ribu dolar AS.
Pengeluaran ekstra 3,1x itu hanya menghasilkan 6,89 poin di DeepSWE.
Kemudian, Flash tetap mengungguli Pro tipis di AutomationBench.
Anda sudah bisa melihat bentuk produk yang sama bermunculan di mana-mana sekarang: satu model untuk tugas yang benar-benar sulit, dan model lain yang sedikit di bawahnya, tetapi cukup murah untuk dijalankan sepanjang hari.
ZAI, Deepseek, Qwen, dan Xiaomi kini semuanya memiliki kesamaan ini.
Begitu model yang lebih kecil melewati ambang keandalan untuk sebagian besar pekerjaan, model yang lebih besar mulai terlihat lebih cocok dipanggil secara selektif daripada menjadi pilihan default untuk segala hal.
Pada akhirnya, itulah yang mungkin menjadi tumpukan model sebenarnya: kecerdasan murah di lapisan bawah, sementara kecerdasan mahal hanya dipanggil ketika tugasnya benar-benar layak.
Lihat Asli
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
DEEPSEEKDEEPSEEK-1,58%

  • 1

Tambahkan komentar
Tambahkan komentar

Komentar
GateUser-67882efc
5 jam yang lalu
Masuk secara nekat 🚀
0Lihat Asli
GateUser-67882efc
5 jam yang lalu
Beli Untuk Menghasilkan 💎
0
GateUser-67882efc
5 jam yang lalu
Kenaikan 🐂
0Lihat Asli
GateUser-67882efc
5 jam yang lalu
HODL Erat 💪
0Lihat Asli
haw81
7 jam yang lalu
Ulasan Pertama
Kosalana kosalana washa hawraman washa washington
0