#DeepSeekV4ProApproachingFable5


DeepSeek V4 Pro Mendekati Fable 5: Perlombaan AI Kini Bukan Lagi Sekadar Siapa yang Paling Pintar

Pembaruan resmi DeepSeek V4 Pro menunjukkan lompatan besar, terutama dalam kemampuan coding, reasoning, penggunaan tools, dan tugas agentic. Sejumlah pengujian menempatkan performanya semakin dekat dengan model frontier seperti Claude Fable 5, meskipun hasilnya tidak seragam di semua benchmark.
Namun, cerita terpentingnya bukan sekadar “DeepSeek hampir menyamai Fable 5.”
Yang sebenarnya berubah adalah harga untuk mendapatkan kecerdasan AI kelas frontier.
Gap Kinerja Menyempit, Persaingan Nilai Semakin Besar
DeepSeek V4 Pro resmi keluar dari fase preview pada pertengahan Agustus dengan peningkatan besar dibanding versi sebelumnya. Dalam pengujian independen Artificial Analysis yang dikutip Reuters, model ini memperoleh skor 53 pada Intelligence Index, naik dari 40 untuk V4 Flash.
Sementara itu, data evaluasi resmi DeepSeek menunjukkan kemampuan kuat pada tugas kompleks. Dalam mode Max, V4 Pro mencatat antara lain 90,1% GPQA Diamond, 93,5% LiveCodeBench, dan rating 3.206 pada Codeforces. Namun benchmark lain tetap menunjukkan bahwa tidak ada satu model yang menang mutlak di semua kategori.
Inilah perubahan penting dalam perlombaan AI:
Perbedaan antara model terbaik dan pesaingnya semakin mengecil, sementara perbedaan biaya dan akses bisa menjadi semakin menentukan.
Bukan Lagi Hanya Chatbot, tetapi Agen yang Bekerja
DeepSeek juga memperkuat fokus pada kemampuan AI agent, AI yang tidak hanya menjawab pertanyaan, tetapi dapat menggunakan tools, menjalankan proses multi-langkah, dan menyelesaikan tugas yang lebih kompleks. Bersamaan dengan pembaruan V4 Pro, DeepSeek juga memperkenalkan perangkat lunak agentic DeepSeek Harness sebagai open source.

Artinya, persaingan berikutnya mungkin bukan:
“AI mana yang memberikan jawaban terbaik?”
Melainkan:
“AI mana yang mampu menyelesaikan pekerjaan nyata secara paling efektif?”
Kesimpulan
DeepSeek V4 Pro belum otomatis mengalahkan Fable 5 di seluruh pengujian. Bahkan laporan terbaru menunjukkan model tersebut masih tertinggal dalam sejumlah evaluasi.
Tetapi justru itulah poin besarnya.
Ketika model yang lebih murah dan terbuka mampu mendekati kemampuan pemain frontier, pasar AI memasuki fase baru. Keunggulan tidak lagi hanya ditentukan oleh skor benchmark tertinggi, tetapi oleh kombinasi kinerja, biaya, kecepatan, akses, dan kemampuan menjalankan pekerjaan nyata.
DeepSeek V4 Pro mungkin belum memenangkan seluruh perlombaan. Namun ia membantu mengubah aturan perlombaannya: AI terbaik tidak selalu harus menjadi yang paling mahal.
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.
889 tayangan
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Komentar
Tambahkan komentar
Tambahkan komentar
Tidak ada komentar
  • Disematkan