torygreen

vip
Usia 3Tahun
Tingkat Puncak 0
Belum ada konten
Kecepatan inferensi mulai menjadi penting bagi agen dengan cara yang jauh lebih besar daripada sekadar membuat respons terasa lebih cepat.
CS-4 baru dari Cerebras mengklaim inferensi hingga 30x lebih cepat dibandingkan sistem GPU, dengan kecepatan lebih dari 4.400 token/detik pada GPT-OSS-120B.
Bagi agen, kecepatan itu menjadi anggaran penalaran tambahan.
Dalam jendela waktu 30 detik yang sama, sistem yang lebih cepat dapat menjelajahi lebih banyak jalur, mencoba kembali kegagalan, menjalankan lebih banyak verifikasi, atau menggunakan model yang lebih besar tanpa membuat pengguna menunggu lebi
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Ada titik ketika perusahaan AI vertikal berhenti terlihat seperti pelanggan API dan mulai terlihat seperti perusahaan model.
Harvey tumbuh dari sekitar 1 triliun -> 14,5 triliun token/bulan dalam enam bulan. Kini Harvey melakukan post-training model legalnya sendiri di atas Kimi K3, menggunakan tugas khusus domain, umpan balik pakar, dan data alur kerja proprietary.
Thomson Reuters bergerak ke arah yang sama dengan model legalnya sendiri.
Itu terasa seperti evolusi yang cukup alami.
Pada volume rendah, API frontier adalah pilihan yang jelas. Pada lebih dari 10 triliun token/bulan, pemilihan mo
KIMI1,29%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Pemrograman mungkin baru menjadi pasar agen yang pertama, bukan yang terbesar.
Sejak Februari, jumlah pengguna Codex aktif mingguan tumbuh :
> 108x di bidang hukum,
> 41x di bidang penjualan,
> 41x di bidang rekrutmen
> 26x di bidang pemasaran.
Bidang engineering hanya tumbuh 5x.
Dan pada Juni, penggunaan agen sudah mencakup 64% dari total token output gabungan Codex + ChatGPT di antara pelanggan perusahaan.
Perangkat lunak mungkin menjadi tempat termudah untuk memulai karena pekerjaannya terstruktur, banyak menggunakan alat, dan relatif mudah diverifikasi.
Kini, ketika agen semakin baik dalam
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
LLM memiliki internet yang sudah menunggu mereka. AI berwujud tidak.
Robot membutuhkan data interaksi dunia nyata dalam jumlah sangat besar, dan ACE Robotics memperkirakan seluruh sektor ini saat ini hanya memiliki sekitar 100 ribu jam yang berguna.
China sudah berupaya memproduksi dataset tersebut: pusat pelatihan membeli robot, mengendalikannya dari jarak jauh melalui tugas-tugas nyata, mengumpulkan lintasannya, lalu memasukkan kembali data itu ke pembuat robot.
Jadi, sejumlah penerapan humanoid tahap awal melakukan lebih dari sekadar menguji perangkat keras. Penerapan tersebut menghasilkan
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Cukup gila melihat betapa cepat kapabilitas meningkat tanpa anggaran perangkat keras ikut meningkat sebesar itu.
> Qwen3.5-27B meraih skor 35 di Artificial Analysis pada Februari.
> Qwen3.6-27B menaikkannya menjadi 38 pada April.
> Qwen3.8-27B kini berada di angka 52, sembari tetap berada dalam kisaran parameter yang pada dasarnya sama, yaitu 27 miliar.
Dan performa agentiknya kini berada di kisaran model-model yang jauh lebih besar dan jauh lebih mahal untuk dijalankan.
Bagi saya, ini terasa lebih penting daripada sekadar perombakan peringkat leaderboard.
Selama bertahun-tahun, AI yang lebih
Lihat Asli
post-image
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Jaringan AI mulai terlihat seperti siklus belanja modal mini tersendiri.
@Cisco menutup FY2026 dengan pesanan infrastruktur AI dari hyperscaler senilai 9,3 miliar dolar AS dan memproyeksikan pendapatan infrastruktur AI dari ~$4B menjadi 7,5 miliar dolar AS tahun depan. Arista baru saja tumbuh 37,7% secara tahunan menjadi 3,04 miliar dolar AS
Menurut saya, pergeseran yang menarik adalah ke mana dana AI marginal mulai mengalir.
Fase pertama pembangunan didominasi oleh upaya membuat sebanyak mungkin akselerator aktif. Setelah klaster menjadi cukup besar, memastikan GPU tersebut terus menerima d
CSCO0,77%
Lihat Asli
  • Hadiah
  • Komentar
  • 1
  • Bagikan
Beberapa tahun lalu, hyperscaler menyumbang sekitar 16% dari belanja modal S&P 500. Tahun depan, lima di antaranya mungkin membelanjakan sebanyak gabungan 495 perusahaan lainnya.
Microsoft, Amazon, Alphabet, Meta, Oracle
BofA kini memperkirakan sekitar 1,07 triliun dolar AS untuk kelima perusahaan tersebut pada 2027, dibandingkan sekitar 1,06 triliun dolar AS untuk semua perusahaan lainnya dalam indeks.
Konsentrasi itu kini mulai berdampak jauh melampaui GPU.
AI telah menjadi begitu besar sehingga permintaan komputasi mulai menyeret ekonomi fisik bersamanya. Goldman memperkirakan angkanya sud
MSFT0,85%
AMZN-0,40%
META1,91%
ORCL1,59%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Lalu lintas agentik di web tumbuh begitu cepat hingga Cloudflare membangun browser khusus untuk agen AI (Kitesurf).
Agen pada dasarnya mewarisi sekitar 30 tahun keputusan desain browser yang dibuat untuk manusia yang menatap layar, dan banyak di antaranya menjadi overhead yang tidak perlu saat menjalankan ribuan sesi sekaligus.
Lalu lintas web berbasis AI hampir tiga kali lipat sepanjang 2025, sementara lalu lintas dari agen AI dan browser agentik tumbuh 7.851% secara tahunan.
berdasarkan estimasi saat ini, agen menghasilkan sekitar 57% permintaan web hari ini.
Hal hebat tentang Kitesurf adala
NET-0,98%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Gila, kelangkaan memori yang terus meningkat kini mulai merancang ulang lanskap GPU bahkan sebelum GPU tersebut diluncurkan.
@nvidia kini menguji opsi HBM dengan tumpukan lebih rendah untuk Rubin Ultra. Desain HBM4e 12-Hi awalnya dapat mencapai 14–16 Gbps, sementara jalur HBM4 yang dioptimalkan mungkin mencapai 11–12 Gbps.
Daya tariknya adalah volume. Lebih sedikit lapisan DRAM per akselerator memungkinkan pasokan wafer yang sama digunakan untuk lebih banyak GPU.
Namun, modelnya tidak menjadi lebih kecil hanya karena tumpukan memorinya berkurang. Setelah model harus tersebar di lebih banyak ak
NVDA2,15%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Komitmen infrastruktur AI perusahaan teknologi besar jauh melampaui angka capex yang biasanya kita lihat. Mereka telah berkomitmen sekitar 1,09 triliun dolar AS untuk pembayaran sewa di masa depan, terutama untuk pusat data AI.
Saat ini, hanya sekitar 285 miliar dolar AS yang tercatat sebagai liabilitas sewa karena banyak kontrak belum diakui sampai fasilitas tersebut mulai beroperasi.
Risiko sebenarnya adalah ketidaksesuaian durasi. Beberapa sewa berlangsung selama 15 hingga 30 tahun, sementara chip, model, dan permintaan pelanggan dapat berubah dalam beberapa siklus produk. Permintaan komput
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Permintaan energi untuk pusat data tumbuh begitu cepat hingga jaringan listrik tak mampu mengimbanginya, dan kini perusahaan mengangkut turbin gas untuk mengatasinya.
APR Energy baru saja meluncurkan delapan unit bergerak berkapasitas 1,1 GW, yang ditujukan langsung untuk memenuhi permintaan pusat data.
Pikirkan apa artinya. turbin di atas trailer adalah pilihan yang lebih buruk daripada sambungan jaringan listrik dalam segala hal kecuali satu: turbin itu bisa beroperasi dalam hitungan bulan, bukan tahun. membayar biaya tambahan itu hanya masuk akal jika waktu tunggu adalah hal yang paling men
APR1,13%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Menjalankan DeepSeek V4 Flash 0731 di perangkat keras milikmu sendiri sekarang sudah benar-benar bisa, tapi biaya yang dikeluarkannya dan apakah itu sepadan sangat bergantung pada siapa kamu.
mesin yang benar-benar menjalankannya:
> Mac Studio M3 Ultra 256GB (~7-9 ribu dolar AS): menyimpan build 4-bit dengan ruang lega, satu kotak yang bersih.
> M3 Ultra 512GB (~10 ribu dolar AS+, jika kamu bisa menemukannya): menjalankan versi nyaris tanpa kehilangan dengan nyaman.
> server 2x H200 atau 4x A100: full checkpoint untuk konteks 1M, tapi sekarang kamu sudah masuk kelas uang pusat data.
secara tek
DEEPSEEK-8,87%
Lihat Asli
post-image
  • Hadiah
  • 1
  • Posting ulang
  • Bagikan
GateUser-3e640a4c:
Apakah itu deepseek buatan dalam negeri?
Pemasok chip. Pemberi pinjaman infrastruktur. Investor ekuitas di pelanggannya sendiri. Nvidia sekarang melakukan semuanya sekaligus, dan bulan ini tagihan untuk memakai semua tiga topi itu mencapai $750B
> $250B sebagai penyangga sewa OpenAI di Ohio.
> $500B terkait dengan SK Group pada memori.
> $5B masuk ke SSI, sebuah perusahaan yang tidak punya produk.
> $1B masuk ke Naver. Kepemilikan di Nebius. Chip mengalir ke fasilitas di Texas yang disewakannya kembali ke dirinya sendiri.
Lingkaran yang pada dasarnya Nvidia ciptakan adalah: mendanai pelanggan -> pelanggan membeli chip Nvidia
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Jadi sekarang kita telah melewati ~$1T dalam belanja modal pusat data global, mengarah ke $1,7T pada 2030. Dari $455B pada 2024.
Itu hampir 4x dalam enam tahun. Empat hyperscaler AS kira-kira berlipat dua selama rentang itu. Yang benar-benar membuat kurva melengkung adalah semua yang lain—neocloud, lab AI, proyek berdaulat—tumbuh sekitar 39% per tahun rata-rata. Pada 2030, Amazon, Google, Meta, dan Microsoft hanya sekitar setengah dari total itu.
Dua tahun lalu, pembangunan pada dasarnya hanya melibatkan empat perusahaan. Sekarang itu sudah jadi sebuah bidang yang penuh, dan uang baru me
AMZN-0,40%
META1,91%
MSFT0,85%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
2026 bukan tahun yang direncanakan untuk menutup lab, dan ruang tempat model frontier tertutup bisa menghasilkan uang kini selebar kira-kira tiga poin setelah K3 dari @Kimi_Moonshot
K3 baru saja mendarat dengan bersih tepat di atas Opus 4,8 dari sisi kapabilitas, dengan harga per tugas yang setengahnya, sementara bobot akan dipublikasikan dalam hitungan hari. Hanya Fable 5 dan GPT-5.6 Sol yang masih berada di atasnya. Semua yang berada di bawah garis itu kini menjadi wilayah terbuka, model yang bisa dilayani siapa pun dengan biaya perangkat keras, tanpa margin R&D untuk dipulihkan.
Itu mat
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
  • Disematkan