torygreen

vip
Usia 2.9Tahun
Tingkat Puncak 0
Belum ada konten
Menjalankan DeepSeek V4 Flash 0731 di perangkat keras milikmu sendiri sekarang sudah benar-benar bisa, tapi biaya yang dikeluarkannya dan apakah itu sepadan sangat bergantung pada siapa kamu.
mesin yang benar-benar menjalankannya:
> Mac Studio M3 Ultra 256GB (~7-9 ribu dolar AS): menyimpan build 4-bit dengan ruang lega, satu kotak yang bersih.
> M3 Ultra 512GB (~10 ribu dolar AS+, jika kamu bisa menemukannya): menjalankan versi nyaris tanpa kehilangan dengan nyaman.
> server 2x H200 atau 4x A100: full checkpoint untuk konteks 1M, tapi sekarang kamu sudah masuk kelas uang pusat data.
secara tek
Lihat Asli
post-image
  • Hadiah
  • 1
  • Posting ulang
  • Bagikan
GateUser-3e640a4c:
Apakah itu deepseek buatan dalam negeri?
Pemasok chip. Pemberi pinjaman infrastruktur. Investor ekuitas di pelanggannya sendiri. Nvidia sekarang melakukan semuanya sekaligus, dan bulan ini tagihan untuk memakai semua tiga topi itu mencapai $750B
> $250B sebagai penyangga sewa OpenAI di Ohio.
> $500B terkait dengan SK Group pada memori.
> $5B masuk ke SSI, sebuah perusahaan yang tidak punya produk.
> $1B masuk ke Naver. Kepemilikan di Nebius. Chip mengalir ke fasilitas di Texas yang disewakannya kembali ke dirinya sendiri.
Lingkaran yang pada dasarnya Nvidia ciptakan adalah: mendanai pelanggan -> pelanggan membeli chip Nvidia
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Jadi sekarang kita telah melewati ~$1T dalam belanja modal pusat data global, mengarah ke $1,7T pada 2030. Dari $455B pada 2024.
Itu hampir 4x dalam enam tahun. Empat hyperscaler AS kira-kira berlipat dua selama rentang itu. Yang benar-benar membuat kurva melengkung adalah semua yang lain—neocloud, lab AI, proyek berdaulat—tumbuh sekitar 39% per tahun rata-rata. Pada 2030, Amazon, Google, Meta, dan Microsoft hanya sekitar setengah dari total itu.
Dua tahun lalu, pembangunan pada dasarnya hanya melibatkan empat perusahaan. Sekarang itu sudah jadi sebuah bidang yang penuh, dan uang baru me
AMZN4,58%
META6,11%
MSFT4,85%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
2026 bukan tahun yang direncanakan untuk menutup lab, dan ruang tempat model frontier tertutup bisa menghasilkan uang kini selebar kira-kira tiga poin setelah K3 dari @Kimi_Moonshot
K3 baru saja mendarat dengan bersih tepat di atas Opus 4,8 dari sisi kapabilitas, dengan harga per tugas yang setengahnya, sementara bobot akan dipublikasikan dalam hitungan hari. Hanya Fable 5 dan GPT-5.6 Sol yang masih berada di atasnya. Semua yang berada di bawah garis itu kini menjadi wilayah terbuka, model yang bisa dilayani siapa pun dengan biaya perangkat keras, tanpa margin R&D untuk dipulihkan.
Itu mat
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
.@nvidia menempatkan 170.000 GPU di sebuah pulau di Indonesia. Kampus itu diumumkan 2 minggu lalu dan akan mulai beroperasi pada Q1 2027, tenggat waktu yang nyaris mustahil di AS saat ini.
GPU bukan penghambatnya, Nvidia membagikan 170.000 unit GPU tersebut berdasarkan skema revenue share. Yang langka adalah tempat untuk memasangkannya dalam tenggat waktu yang benar-benar berarti.
Antrian interkoneksi di AS bisa mencapai 5+ tahun di banyak wilayah. Turbin gas di belakang meteran memakan waktu 18 bulan. Celah itulah yang kini menjadi keseluruhan permainan penentuan lokasi.
Dan lebih banya
NVDA2,91%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Korban pertama dari meledaknya AI mungkin bukan pekerjaan, melainkan tagihan listrik semua orang, dan pabrik sedang jadi yang paling dulu terpukul.
> Belden Brick, Ohio: biaya kapasitas bulanan naik dari $1.600 menjadi $12.000. Sekarang perusahaan itu mematok harga pembangkit listriknya sendiri untuk lepas dari jaringan.
> Plaskolite, produsen plastik, naik dari $200K menjadi $1,2 juta per tahun.
> Pennsylvania: listrik industri naik 31% dalam dua belas bulan.
> Ohio: naik 26%. Rata-rata nasional: 7%.
Di hulu semuanya: harga kapasitas PJM naik dari $28,92 -> $329,17 per megawatt-day dalam 2
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
$130B dalam proyek pusat data yang diblokir atau ditunda pada Q1. Itu cocok dengan semua tahun 2025 hanya dalam satu kuartal tahun ini.
75 proyek. Kelompok oposisi berlipat dua dari 396 menjadi 833 di 49 negara bagian dalam tiga bulan. 300+ RUU diajukan dalam enam minggu pertama tahun ini, proposal moratorium di 14 negara bagian, dan legislatif New York baru saja meloloskan jeda satu tahun untuk apa pun di atas 20MW. Gallup mencatat 71% orang Amerika menentang pusat data dekat rumah mereka, naik dari sekitar setengah tahun lalu.
Sementara itu, hyperscaler berencana menghabiskan $690B untuk b
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Properti paling berharga di bidang AI saat ini adalah pabrik aluminium yang sudah tutup di Kentucky.
@AnthropicAI menandatangani sewa $19B selama 20 tahun untuk 401 megawatt di kampus TeraWulf di Hawesville, bekas lokasi smelter dengan koneksi grid warisan sekitar 480 megawatt. TeraWulf menghasilkan sekitar $1B dalam pendapatan tahun lalu; kontrak tunggal ini bernilai hampir dua puluh kali lipat dari itu.
Asetnya adalah sambungan listrik. Anda bisa memproduksi lebih banyak chip. Anda tidak bisa menciptakan megawatt dalam semalam.
Setiap penambang bitcoin yang duduk di atas daya terdampar beru
BTC1,67%
HUT4,22%
IREN7,98%
CORZ10,29%
RIOT6,19%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Investasi AI melampaui pendapatan AI sebesar 46%. Selama kehancuran telekomunikasi tahun 2001, kesenjangan itu adalah 32%. Kita telah melewati wilayah kehancuran telekom dan masih mempercepat menuju $1T dalam belanja modal tahunan pada tahun 2027.
Harga token menceritakan sisi lain. Indeks Pengeluaran Token LLM Data Silikon mencapai puncak $2,06 per juta token pada bulan Mei. Sekarang berada di $1,62. Turun 20% dalam enam minggu. Turun lebih dari 90% sejak 2023.
Total pengeluaran token kira-kira berlipat ganda dari tahun ke tahun. Token yang lebih murah memperluas pasar, bukan menghancurkanny
TOKEN-7,61%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
.@nvidia tidak lagi hanya berada dalam permainan pembuatan chip. Mereka memposisikan diri sebagai partisipan langsung dalam ekonomi infrastruktur AI.
Dari pengumuman terbaru, mereka mendanai pusat data dan mengambil bagian dari pendapatan cloud yang dihasilkan.
Dua kemitraan terbaru menggambarkan perubahan ini dengan sempurna:
210.000 GPU terikat pada komitmen pembelian senilai $25–30 miliar selama enam tahun
> Sharon AI $SHAZ menyebarkan 40.000 GB300 di Australia
> Firmus meningkatkan skala hingga 170.000 akselerator di 360MW di Batam
Pada saat yang sama, Nvidia dan mitra memperkenalkan XFRA,
NVDA2,91%
SHAZ8,47%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
70% perusahaan mengatakan mereka menggunakan AI. Kurang dari 1 dari 10 yang memiliki agen yang benar-benar berjalan di produksi.
Kesenjangan itu berada di dalam AI Index Stanford, kumpulan data AI yang paling banyak dikutip dan paling tidak bias yang ada, tidak diterbitkan oleh laboratorium yang memiliki kepentingan dalam hasilnya.
Google sendiri menghabiskan lebih dari $150 miliar untuk infrastruktur AI tahun lalu. Pendapatan laboratorium perbatasan (frontier lab) meningkat pada tingkat yang bersejarah, dan pengeluaran komputasi meningkat seiring dengannya, tidak menyusut sebagai bagian dari
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Kendala AI pada tahun 2026 bukanlah kualitas model. Itu adalah kapasitas jaringan.
PJM baru saja mencetak lonjakan 833% dalam harga kapasitas untuk Virginia. Negara bagian itu sekarang mengirimkan sekitar 40% listriknya ke pusat data dan mengimpor lebih banyak listrik daripada California. Dublin mengonsumsi hampir 80% dari jaringan nasional Irlandia. Frankfurt berada di 42% dari pasokan regional.
IEA memperkirakan permintaan pusat data akan sekitar dua kali lipat lagi pada tahun 2030, sementara separuh proyek AS yang sedang dikembangkan terkonsentrasi di tempat-tempat yang sudah membebani jari
Lihat Asli
post-image
  • Hadiah
  • 2
  • Posting ulang
  • Bagikan
Nil3437:
Micron (MU) Airdrop: Daftar untuk Memenangkan Saham AS Tanpa Hambatan, Hadiah Trading CFD Hingga 8 Saham MU https://www.gate.com/campaigns/5371?ch=4468&ref=VLARAFKMAQ&ref_type=132
Lihat Lebih Banyak
Menghabiskan waktu dengan angka inferensi dan satu statistik terus kembali.
70% dari inferensi AI pada tahun 2026 berjalan di edge. Bukan di pusat data hyperscale. Bukan di AWS. Di sistem industri, peralatan otonom, dan perangkat terhubung di mana perjalanan pulang-pergi ke server cloud bukanlah masalah latensi, melainkan mode kegagalan.
Pasar inferensi senilai $106 miliar tidak tumbuh karena orang mengirim lebih banyak kueri "chat" ke AI mereka. Ini tumbuh karena AI ditanamkan ke dalam infrastruktur fisik yang berjalan terus-menerus, beroperasi di lingkungan tanpa jaringan yang andal, dan tid
Lihat Asli
  • Hadiah
  • Komentar
  • 1
  • Bagikan
Ternyata berada dekat dengan teknologi fisik memiliki kaitan yang sangat kecil dengan adopsi sebenarnya.
California adalah rumah bagi setiap laboratorium AI perbatasan yang penting. New York memiliki lebih banyak perusahaan Fortune 500 daripada negara bagian lain. Keduanya disalip oleh Colorado, yang mencapai 23.2% adopsi AI bisnis sementara New York hanya 13.8%.
Apa yang dimiliki Colorado dan Arizona bukanlah infrastruktur atau bakat yang lebih baik. Melainkan kemauan untuk bergerak sebelum industri memberi sinyal bahwa itu aman. Negara bagian yang paling dekat dengan teknologi sering kali ya
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Di atas kertas, biaya AI seharusnya sudah runtuh sekarang.
Tugas tingkat frontier yang sama yang berharga $30 per juta token saat peluncuran GPT-4 pada tahun 2023 kini hanya $1,25 dengan GPT-5. Penurunan 96× dalam tiga tahun, di seluruh model bernama dengan harga yang dipublikasikan.
Menurut aturan normal apa pun, tagihan AI perusahaan seharusnya menurun drastis. Sebaliknya, rata-rata anggaran AI Fortune-500 naik dari $7M pada tahun 2024 menjadi $19M pada tahun 2026. Hampir 3× dalam dua siklus anggaran.
Alasannya: token murah tidak dihemat, melainkan dipersenjatai. Chatbot memicu token
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Sesuatu yang diam-diam berbalik dalam komputasi AI tahun ini, dan itu mengubah untuk apa sebenarnya pembangunan itu.
Pada tahun 2023, 2/3 dari komputasi AI digunakan untuk pelatihan, pekerjaan sebenarnya dalam membangun model. Bagian lainnya yang lebih kecil digunakan untuk inferensi, pekerjaan menjalankannya setelah jadi. Namun rasio itu diam-diam mulai berbalik.
Inferensi kini menjadi 2/3 dan masih meningkat, menurut Deloitte, dan chip yang dibuat untuk menjalankannya telah melampaui $50B tahun ini.
Alasan utama pembalikan ini penting (dan bukan dari segi persentase): pelatihan dan inferens
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Dua tahun yang lalu, model terbuka di bagan ini akan berada di dekat posisi terbawah. Laboratorium tertutup sudah unggul beberapa generasi, dan kesenjangan itulah alasan utama orang menyewa model alih-alih memilikinya.
Sekarang GLM-5.2 berada di peringkat 51 pada indeks @ArtificialAnlys.
Bobot terbuka, laboratorium Tiongkok, peringkat kelima secara keseluruhan. Dan singkirkan Fable dari daftar karena tidak tersedia, dan model bobot terbuka jauh lebih dekat ke puncak daripada yang ditunjukkan oleh peringkatnya.
Argumen utama untuk model tertutup selalu soal keunggulan. Bayar API, terima persyar
GLM1,37%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Inilah pembagian dalam komputasi AI yang tidak banyak dibaca dengan benar.
Pelatihan frontier semakin terkonsentrasi setiap kuartal, ribuan GPU yang harus ditempatkan di satu tempat dan dihubungkan. Namun pelatihan hanya 30% dari permintaan pada tahun 2026. 70% lainnya adalah inferensi, dan menjalankannya di hyperscaler berarti membayar infrastruktur yang dibangun untuk beban kerja terberat untuk melakukan yang termudah.
Di jaringan terdistribusi, inferensi yang sama bisa berjalan 45-75% lebih murah dan bagi siapa pun yang menyusun anggaran infrastruktur AI, kesenjangan itulah intinya.
Pelatih
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
Sudah memikirkan tentang berita GLM 5.2 terbaru dan sudut pandang open weights yang dikejar semua orang, tetapi mereka melewatkan sudut pandang yang sama sekali berbeda di sini.
Semua orang fokus pada fakta bahwa sebuah laboratorium China mencapai performa level frontier dan membuka sumbernya, tetapi bagian yang layak direnungkan adalah bagaimana. ZAI dan laboratorium China lainnya diputus dari Nvidia pada awal tahun 2025, jadi mungkin tidak ada H100, tidak ada H200 yang langsung ke mereka sejak saat itu.
Mereka melampaui $128B on model yang dilatih pada silikon China yang mungkin berada dalam
GLM1,37%
NVDA2,91%
Lihat Asli
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
95% dari kapasitas GPU perusahaan saat ini sedang tidak digunakan.
Angka tersebut berasal dari pengukuran Cast AI terhadap 23.000 klaster produksi nyata, bukan survei umum.
Rata-rata pemanfaatan adalah 5% dan ini terjadi pada saat Nvidia menaikkan harga H200 sebesar 15%, kenaikan pertama dalam 20 tahun. Perangkat keras yang dikatakan langka oleh semua orang sebagian besar tidak melakukan apa-apa.
Jika Anda mencoba mencari tahu mengapa komputasi terasa tidak mungkin didapatkan, inilah alasannya. Tidak ada yang mengembalikan alokasi yang mereka tunggu berbulan-bulan. Jadi armada tetap di 5%, dit
NVDA2,91%
Lihat Asli
post-image
  • Hadiah
  • Komentar
  • Posting ulang
  • Bagikan
  • Disematkan