Postingan

Jev dari TypeSafe AI @typesafeai kini sepenuhnya terbuka, ditambah Kev open source dari tim Cognition. Sinyal di dunia AI dalam dua hari terakhir sangat jelas: kita tidak lagi perlu menghabiskan komputasi mahal untuk mengambil keputusan “ya atau tidak”.


Saya memiliki alur otomatisasi untuk memproses Leads dalam jumlah besar. Sebelumnya, menggunakan GPT-4o untuk menyaring 700 calon pelanggan bukan hanya menguras biaya, tetapi juga membuat saya khawatir karena sesekali model berhalusinasi dan mengarang alasan.
Kemarin saya mencoba mengubah alurnya: membiarkan Jev memberikan skor kecocokan, dengan menetapkan skor keyakinan untuk setiap Lead dan langsung menyingkirkan yang tidak memenuhi standar. Hasilnya, seluruh proses selesai dalam 40 detik dengan biaya kurang dari 0,1 yuan.
Inti dari “model pengambilan keputusan” ini adalah hanya melakukan satu hal: memilih solusi optimal dari opsi yang kamu berikan, atau memberi skor pada kalimat pernyataanmu. Model ini tidak menulis puisi atau mengobrol, sehingga mampu meningkatkan kecepatan hingga 20 kali bahkan 200 kali lipat.
Selain itu, hambatannya kini benar-benar sudah sangat rendah. Kemunculan Kev membuat deployment lokal menjadi mudah dijangkau; melatih model 4B dengan satu H100 hanya membutuhkan 40 menit. Artinya, kamu bisa menggunakan data khusus dari bisnis sendiri untuk menyetel model pengambilan keputusan khusus dalam hitungan menit. Performa Kev-8B pada data di luar domain sudah mendekati Jev, yang menunjukkan bahwa jalur ini sepenuhnya layak ditempuh.
Cobalah Jev atau Kev, dan ganti routing AI, pengenalan intent, serta gateway keamananmu dengan mesin pengambilan keputusan khusus seperti ini. Saat kamu mendapati waktu respons agenmu turun dari hitungan detik menjadi hitungan milidetik, kamu akan menyadari bahwa inilah manfaat efisiensi yang sesungguhnya.
Lihat Asli
post-image
Halaman ini mungkin berisi konten pihak ketiga, yang disediakan untuk tujuan informasi saja (bukan pernyataan/jaminan) dan tidak boleh dianggap sebagai dukungan terhadap pandangannya oleh Gate, atau sebagai nasihat keuangan atau profesional. Lihat Penafian untuk detailnya.

  • 2

Tambahkan komentar
Tambahkan komentar

Komentar
BearStacker
4 jam yang lalu
Menyelesaikan 700 item dalam 40 detik dan tetap semurah ini, yang satu ini memang mantap. GPT-4o dikhususkan untuk menulis copy, sementara pekerjaan kotor dan berat diserahkan kepada Jev—pembagian tugasnya jelas.
0Lihat Asli
RedGreenFerry
5 jam yang lalu
Kev melatih model 4B hingga selesai dalam 40 menit, agak gila. Dulu, menyesuaikan LoRA saja harus menunggu setengah hari. Deployment lokal sangat penting untuk bisnis yang sensitif terhadap data; menjalankan informasi pelanggan di cloud selalu terasa agak tidak aman.
0Lihat Asli
AirdropPhilosopher
6 jam yang lalu
Ulasan Pertama
Perbandingan dari hitungan detik ke milidetik ini benar-benar telak. Sebelumnya, pengenalan intent dijalankan dengan LLM secara langsung—latensinya tinggi dan boros biaya. Beralih ke model pengambilan keputusan benar-benar terasa seperti naik level. Sudah fork Kev, siap mengutak-atiknya akhir pekan ini.
0Lihat Asli