torygreen

vip
Số năm 2.9Năm
Cấp cao nhất 0
Chưa có nội dung
Nhu cầu năng lượng của các trung tâm dữ liệu đang tăng nhanh đến mức lưới điện không thể theo kịp, và các công ty giờ đây đang vận chuyển các turbine khí bằng xe tải đến để né tránh vấn đề này.
APR Energy vừa triển khai tám tổ máy di động, công suất 1,1GW, nhắm thẳng vào nhu cầu của các trung tâm dữ liệu.
Hãy nghĩ về điều đó. Một turbine đặt trên rơ-moóc tệ hơn kết nối lưới điện về mọi mặt, ngoại trừ một điều: bạn có thể đưa nó vào vận hành trong vài tháng thay vì vài năm. Chỉ đáng trả mức phí cao đó nếu thời gian chờ là thứ đang kìm hãm bạn, và hiện tại thời gian chờ ở nhiều bang của Mỹ là hơ
APR6,36%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Việc chạy DeepSeek V4 Flash 0731 trên phần cứng của riêng bạn giờ là có thật, nhưng chi phí là bao nhiêu và liệu nó có đáng hay không phụ thuộc rất nhiều vào việc bạn là ai.
những cỗ máy thực sự chạy nó:
> Mac Studio M3 Ultra 256GB (~7-9 nghìn USD): chứa bản build 4-bit với khoảng dư, gọn trong một máy duy nhất.
> M3 Ultra 512GB (~10 nghìn USD trở lên, nếu bạn tìm được): chạy phiên bản gần như không tổn hao một cách thoải mái.
> Server 2x H200 hoặc 4x A100: checkpoint đầy đủ ở ngữ cảnh 1M, nhưng lúc này bạn đã bước vào tầm tiền kiểu trung tâm dữ liệu.
về mặt kỹ thuật, nó cũng chạy được trên 12
DEEPSEEK-3,36%
Xem bản gốc
post-image
  • Phần thưởng
  • 1
  • Đăng lại
  • Retweed
GateUser-3e640a4c:
Đây có phải DeepSeek do nội địa Trung Quốc sản xuất không?
Nhà cung cấp chip. Tổ chức cho vay hạ tầng. Nhà đầu tư vốn vào chính các khách hàng của mình. Nvidia giờ là cả ba vai trò cùng lúc, và tháng này, khoản phí phải trả để giữ cả ba chiếc mũ đã đạt $750B
> $250B , trong đó bao gồm việc hỗ trợ cho thuê văn phòng của OpenAI tại Ohio.
> $500B gắn kết với SK Group về bộ nhớ.
> $5B tham gia vào SSI, một công ty không có sản phẩm.
> $1B vào Naver. Một phần sở hữu tại Nebius. Chip chảy vào các cơ sở ở Texas mà hãng này cho chính mình thuê lại.
Vòng lặp mà Nvidia đã tạo ra về cơ bản là: tài trợ cho khách hàng -> khách hàng mua chip Nvidia -> Nvidia ghi
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Vì vậy, chúng tôi hiện đã vượt ~$1T trong tổng chi tiêu vốn (capex) cho trung tâm dữ liệu toàn cầu, hướng tới mức $1,7T vào năm 2030. Tăng từ $455B vào năm 2024.
Con số này gần như tăng gấp 4 lần trong sáu năm. Bốn siêu nhà cung cấp (hyperscalers) tại Mỹ ước tính sẽ tăng gấp đôi trong khoảng thời gian đó. Còn lại—các bên “neocloud”, các phòng thí nghiệm AI, các dự án thuộc khu vực nhà nước—mới là những yếu tố thực sự bẻ cong quỹ đạo, tăng trưởng trung bình khoảng 39% mỗi năm. Đến năm 2030, Amazon, Google, Meta và Microsoft chỉ chiếm khoảng một nửa.
Cách đây hai năm, việc xây dựng gần như
AMZN-2,32%
META-0,47%
MSFT1,07%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
2026 không phải là năm các phòng thí nghiệm đóng lab đã lên kế hoạch kết thúc, và không gian nơi một mô hình frontier đóng có thể thu tiền hiện chỉ rộng khoảng ba phần sau K3 từ @Kimi_Moonshot
K3 vừa hạ cánh gọn gàng vượt Opus 4,8 về năng lực, với giá cho mỗi tác vụ chỉ bằng một nửa, trong khi trọng số sẽ được công khai trong vài ngày. Chỉ Fable 5 và GPT-5.6 Sol vẫn nằm cao hơn nó. Mọi thứ nằm dưới đường này giờ đã là lãnh địa mở, nơi các mô hình ai cũng có thể cung cấp với chi phí phần cứng, không có biên lợi nhuận R&D để bù lại.
Đó là phép tính mới cho mọi bản phát hành đóng. Nằm trên fr
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
.@nvidia đang triển khai 170.000 GPU trên một hòn đảo ở Indonesia. Khuôn viên này được công bố cách đây 2 tuần và sẽ ra mắt vào Q1 2027, một mốc thời gian gần như không thể thực hiện ngay lúc này tại Mỹ.
GPU không phải là nút thắt; Nvidia đang phân phối 170.000 GPU theo mô hình chia sẻ doanh thu. Thứ khan hiếm nằm ở chỗ cần cắm chúng vào trong một khung thời gian có ý nghĩa.
Các hàng chờ kết nối liên mạng tại Mỹ thường kéo dài 5+ năm ở nhiều khu vực. Một tua-bin khí phía sau đồng hồ (behind-the-meter) mất 18 tháng. Khoảng trống đó giờ chính là toàn bộ cuộc chơi chọn địa điểm.
Và thêm nhi
NVDA2,51%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Nạn nhân đầu tiên của cơn sốt AI có thể không phải là việc làm, mà là hóa đơn điện của mọi người — và các nhà máy đang bị ảnh hưởng trước.
> Belden Brick, Ohio: phí công suất theo tháng tăng từ $1.600 lên $12.000. Giờ doanh nghiệp đang tự định giá cho nhà máy điện của mình để rời khỏi lưới.
> Plaskolite, một nhà sản xuất nhựa, từ $200K lên $1,2M mỗi năm.
> Pennsylvania: điện cho sản xuất công nghiệp tăng 31% trong 12 tháng.
> Ohio: tăng 26%. Mức trung bình toàn quốc: 7%.
Ở “thượng nguồn” của mọi chuyện: giá công suất của PJM tăng từ $28,92 -> $329,17 mỗi megawatt-day sau 2 phiên đấu giá =>11
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
$130B trong các dự án trung tâm dữ liệu bị chặn hoặc hoãn trong Q1. Điều này khớp toàn bộ năm 2025 chỉ trong một quý của năm nay.
75 dự án. Các nhóm phe đối lập đã tăng gấp đôi từ 396 lên 833 trên 49 bang trong vòng ba tháng. Hơn 300 dự luật được nộp trong sáu tuần đầu năm, các đề xuất tạm hoãn ở 14 bang, và cơ quan lập pháp New York vừa thông qua việc tạm dừng một năm đối với mọi thứ vượt quá 20MW. Gallup ghi nhận 71% người Mỹ phản đối đặt trung tâm dữ liệu gần nhà họ, tăng từ khoảng một nửa cách đây nửa năm.
Trong khi đó, các nhà siêu cấp dự kiến sẽ chi $690B cho capex chỉ riêng trong năm
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Khu bất động sản có giá trị nhất trong lĩnh vực AI hiện nay là một nhà máy luyện nhôm đã đóng cửa ở Kentucky.
@AnthropicAI đã ký hợp đồng thuê 19 tỷ USD trong 20 năm cho 401 megawatt tại khuôn viên Hawesville của TeraWulf, một khu vực từng là nhà máy luyện nhôm với khoảng 480 megawatt kết nối lưới điện cũ. TeraWulf kiếm được khoảng $1B doanh thu vào năm ngoái; hợp đồng đơn lẻ này trị giá gần hai mươi năm doanh thu đó.
Tài sản chính là kết nối nguồn điện. Bạn có thể sản xuất thêm chip. Bạn không thể tạo ra megawatt qua một đêm.
Mọi thợ đào Bitcoin đang ngồi trên nguồn điện bị bỏ hoang đều trở
BTC0,74%
HUT-9,69%
IREN2,74%
CORZ0,00%
RIOT0,69%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Đầu tư AI đang vượt doanh thu AI 46%. Trong thời kỳ bùng nổ viễn thông năm 2001, khoảng cách đó là 32%. Chúng ta đã vượt qua thời kỳ bùng nổ viễn thông và vẫn đang tăng tốc hướng tới $1T tỷ chi tiêu vốn hàng năm vào năm 2027.
Giá token thể hiện mặt còn lại. Chỉ số Chi tiêu Token LLM Dữ liệu Silicon đạt đỉnh 2,06 đô la mỗi triệu token vào tháng 5. Hiện là 1,62 đô la. Giảm 20% trong sáu tuần. Giảm hơn 90% kể từ năm 2023.
Tổng chi tiêu token đã tăng gần gấp đôi so với cùng kỳ năm trước. Token rẻ hơn đang mở rộng thị trường, không phá hủy nó. Vấn đề là hóa đơn chi tiêu vốn không giảm khi giá giảm
TOKEN-5,97%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
.@nvidia không còn chỉ đơn thuần tham gia vào lĩnh vực sản xuất chip nữa. Họ đang định vị mình như một người tham gia trực tiếp vào nền kinh tế của cơ sở hạ tầng AI.
Từ những thông báo gần đây, họ đang tài trợ cho các trung tâm dữ liệu và chiếm một phần doanh thu từ đám mây mà các trung tâm này tạo ra.
Hai quan hệ đối tác gần đây minh họa hoàn hảo cho sự chuyển dịch này:
210.000 GPU gắn liền với cam kết mua từ 25–30 tỷ USD trong vòng sáu năm
> Sharon AI $SHAZ triển khai 40.000 GB300 tại Úc
> Firmus mở rộng lên 170.000 bộ tăng tốc trên 360MW ở Batam
Đồng thời, Nvidia và các đối tác đã giới thiệ
NVDA2,51%
SHAZ5,86%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
70% công ty cho biết họ sử dụng AI. Ít hơn 1 trong 10 có một tác nhân thực tế đang chạy trong sản xuất.
Khoảng cách đó nằm trong Chỉ số AI của Stanford, bộ dữ liệu về AI được trích dẫn nhiều nhất, ít thiên vị nhất hiện có, không được công bố bởi một phòng thí nghiệm có lợi ích trong kết quả.
Riêng Google đã chi hơn 150 tỷ đô la cho cơ sở hạ tầng AI vào năm ngoái. Doanh thu của các phòng thí nghiệm tiên phong đang tăng với tốc độ lịch sử, và chi tiêu tính toán cũng tăng theo, không giảm như tỷ lệ phần trăm doanh thu như cơ sở hạ tầng thường làm khi một thứ gì đó mở rộng quy mô.
Việc áp dụng chư
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Ràng buộc về AI vào năm 2026 không phải là chất lượng mô hình. Đó là công suất lưới điện.
PJM vừa công bố mức tăng 833% về giá công suất cho Virginia. Bang này hiện cung cấp khoảng 40% điện năng cho các trung tâm dữ liệu và nhập khẩu nhiều điện hơn California. Dublin đang tiêu thụ gần 80% lưới điện quốc gia của Ireland. Frankfurt chiếm 42% nguồn cung khu vực.
IEA cho rằng nhu cầu của trung tâm dữ liệu sẽ tăng gấp đôi vào năm 2030, trong khi một nửa số dự án đang phát triển của Mỹ tập trung ở những nơi đã căng thẳng lưới điện.
Chúng ta đang tiến bộ trong việc tối ưu hóa joules trên mỗi token và
Xem bản gốc
post-image
  • Phần thưởng
  • 2
  • Đăng lại
  • Retweed
Nil3437:
Airdrop Micron (MU): Đăng ký để giành cổ phiếu Mỹ với không rào cản, Phần thưởng giao dịch CFD lên đến 8 cổ phiếu MU https://www.gate.com/campaigns/5371?ch=4468&ref=VLARAFKMAQ&ref_type=132
Xem thêm
Dành thời gian với các con số suy luận và một số liệu thống kê cứ quay lại.
70% suy luận AI vào năm 2026 chạy ở biên. Không phải trong trung tâm dữ liệu siêu quy mô. Không phải trên AWS. Trên các hệ thống công nghiệp, thiết bị tự hành và thiết bị kết nối, nơi mà việc truyền tải qua lại đến máy chủ đám mây không phải là vấn đề độ trễ, mà là một chế độ thất bại.
Thị trường suy luận trị giá 106 tỷ đô la không phải đang phát triển vì mọi người gửi nhiều truy vấn "chat" hơn đến AI của họ. Nó đang phát triển vì AI đang được nhúng vào cơ sở hạ tầng vật lý chạy liên tục, hoạt động trong môi trường khô
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • 1
  • Retweed
Rõ ràng là việc ở gần công nghệ vật lý không liên quan nhiều đến việc thực sự áp dụng nó.
California là nơi có tất cả các phòng thí nghiệm AI tiên phong quan trọng. New York có nhiều công ty Fortune 500 hơn bất kỳ tiểu bang nào khác. Cả hai đều bị Colorado vượt mặt, với tỷ lệ áp dụng AI trong kinh doanh đạt 23,2% trong khi New York chỉ đạt 13,8%.
Điều mà Colorado và Arizona có không phải là cơ sở hạ tầng hay nhân tài tốt hơn. Đó là sự sẵn sàng hành động trước khi ngành công nghiệp báo hiệu rằng điều đó an toàn. Các tiểu bang gần công nghệ nhất thường là những nơi chậm triển khai nhất vì họ có
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Trên lý thuyết, chi phí AI lẽ ra đã giảm mạnh đến nay.
Cùng một tác vụ cấp tiên phong tốn $30 mỗi triệu token khi GPT-4 ra mắt năm 2023 nay chỉ còn $1.25 với GPT-5. Mức giảm 96 lần trong ba năm, trên các mô hình có tên tuổi với giá công bố.
Theo bất kỳ quy tắc thông thường nào, hóa đơn AI doanh nghiệp lẽ ra phải giảm mạnh. Thay vào đó, ngân sách AI trung bình của Fortune-500 đã tăng từ $7M năm 2024 lên $19M năm 2026. Gần 3 lần trong hai chu kỳ ngân sách.
Lý do: token rẻ không được tiết kiệm, mà được vũ khí hóa. Một chatbot sử dụng token một lần rồi dừng. Một tác nhân làm việc thực sự chạy nh
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Một điều gì đó đã lặng lẽ đảo ngược trong tính toán AI năm nay, và nó thay đổi mục đích thực sự của việc xây dựng hạ tầng.
Năm 2023, 2/3 sức mạnh tính toán AI dành cho training, công việc thực tế xây dựng một mô hình. Phần nhỏ hơn còn lại dành cho inference, công việc thực tế chạy mô hình sau khi nó được xây dựng. Nhưng tỷ lệ đó đã lặng lẽ bắt đầu đảo chiều.
Hiện tại, inference chiếm 2/3 và vẫn đang tăng, theo Deloitte, và các chip được xây dựng để chạy nó đã vượt qua $50B trong năm nay.
Lý do chính sự đảo chiều này quan trọng (và không phải ở tỷ lệ phần trăm): training và inference là hai th
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Hai năm trước, một mô hình mở trên biểu đồ này sẽ nằm gần cuối. Các phòng thí nghiệm đóng cửa đã đi trước hàng thế hệ, và khoảng cách đó chính là lý do mà mọi người thuê mô hình thay vì sở hữu một cái.
Bây giờ GLM-5.2 đứng ở vị trí 51 trên chỉ số @ArtificialAnlys.
Trọng số mở, phòng thí nghiệm Trung Quốc, thứ năm tổng thể. Và loại Fable khỏi danh sách vì nó không khả dụng, và mô hình trọng số mở gần đỉnh hơn nhiều so với thứ hạng của nó cho thấy.
Lời chào hàng cho mô hình đóng luôn là sự dẫn đầu. Trả tiền API, chấp nhận các điều khoản, xây dựng trên thứ bạn không kiểm soát, bởi vì mô hình đủ x
GLM0,09%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Đây là sự phân chia trong điện toán AI mà ít người đọc đúng.
Huấn luyện tiên phong đang tập trung hơn mỗi quý, hàng nghìn GPU phải đặt cùng một chỗ và kết nối với nhau. Nhưng huấn luyện chỉ chiếm 30% nhu cầu vào năm 2026. 70% còn lại là suy luận, và chạy nó trên một hyperscaler có nghĩa là trả tiền cho hạ tầng được xây dựng cho khối lượng công việc khó nhất để thực hiện công việc dễ nhất.
Trên các mạng phân tán, cùng suy luận đó có thể chạy rẻ hơn 45-75% và đối với bất kỳ ai đang lên ngân sách hạ tầng AI, khoảng cách đó là toàn bộ câu chuyện.
Huấn luyện tập trung hóa vì cần thiết. Suy luận phâ
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Tôi đã suy nghĩ về tin tức GLM 5.2 gần đây và góc nhìn về trọng số mở mà mọi người đang khai thác nhưng họ đang bỏ lỡ một góc nhìn hoàn toàn khác ở đây.
Mọi người đang tập trung vào việc một phòng thí nghiệm Trung Quốc đã đạt hiệu suất ngang tầm tiên phong và mã nguồn mở nó, nhưng phần đáng để suy ngẫm là cách thức.
ZAI và các phòng thí nghiệm Trung Quốc khác đã bị cắt đứt khỏi Nvidia vào đầu năm 2025, vì vậy có lẽ không có H100, H200 nào được trực tiếp chuyển đến họ kể từ đó.
Họ đã vượt qua $128B trên một mô hình được huấn luyện trên silicon của Trung Quốc, đạt được hiệu suất chỉ kém tiên ph
GLM0,09%
NVDA2,51%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
  • Đã ghim