torygreen

vip
Số năm 3Năm
Cấp cao nhất 0
Chưa có nội dung
Khảo sát State of AI mới nhất của McKinsey có một số liệu đáng khiến nhiều công ty SaaS phải lo ngại:
32% công ty cho biết họ đã bỏ qua việc mua ít nhất một sản phẩm hoặc tính năng phần mềm vì các tác nhân lập trình có thể xây dựng sản phẩm đó nội bộ.
Điều đó không có nghĩa là các công ty ngừng mua phần mềm. Nó có nghĩa là lớp “tính năng” trở nên khó kiếm tiền hơn nhiều.
Nếu một đội ngũ nội bộ có thể tái tạo một quy trình chuyên biệt trong một hoặc hai ngày, các nhà cung cấp cần biện minh cho mô hình thuê bao bằng những thứ mà tác nhân không thể tái tạo với chi phí thấp: khả năng phân phối, dữ
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Tốc độ suy luận đang bắt đầu trở nên quan trọng hơn nhiều đối với các tác nhân AI, chứ không chỉ giúp phản hồi nhanh hơn.
CS-4 mới của Cerebras tuyên bố tốc độ suy luận nhanh hơn tới 30 lần so với các hệ thống GPU, đạt hơn 4.400 tok/s trên GPT-OSS-120B.
Đối với các tác nhân AI, tốc độ đó trở thành ngân sách suy luận bổ sung.
Trong cùng khoảng thời gian 30 giây, một hệ thống nhanh hơn có thể khám phá nhiều hướng hơn, thử lại các lần thất bại, thực hiện thêm nhiều bước xác minh hoặc sử dụng mô hình lớn hơn mà không khiến người dùng phải chờ lâu hơn.
Vì vậy, token/giây đang dần trở thành nhiều hơ
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Có một thời điểm khi các công ty AI theo ngành dọc không còn giống khách hàng API nữa mà bắt đầu giống các công ty mô hình.
Harvey đã tăng từ khoảng 1 nghìn tỷ -> 14,5 nghìn tỷ token/tháng trong sáu tháng. Hiện công ty đang huấn luyện hậu kỳ mô hình pháp lý của riêng mình trên nền Kimi K3, sử dụng các tác vụ chuyên biệt theo lĩnh vực, phản hồi từ chuyên gia và dữ liệu quy trình độc quyền.
Thomson Reuters cũng đang đi theo hướng tương tự với mô hình pháp lý của riêng mình.
Đó có vẻ là một sự tiến hóa khá tự nhiên.
Ở mức lưu lượng thấp, các API mô hình tiên tiến là lựa chọn hiển nhiên. Ở mức trê
KIMI0,32%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Lập trình có thể chỉ là thị trường agent đầu tiên, chứ không phải thị trường lớn nhất.
Kể từ tháng 2, số người dùng Codex hoạt động hàng tuần đã tăng:
> 108 lần trong lĩnh vực pháp lý,
> 41 lần trong lĩnh vực bán hàng,
> 41 lần trong tuyển dụng
> 26 lần trong marketing.
Kỹ thuật chỉ tăng 5 lần.
Đến tháng 6, việc sử dụng agent đã chiếm 64% tổng số token đầu ra kết hợp của Codex + ChatGPT ở các khách hàng doanh nghiệp.
Phần mềm có lẽ là nơi dễ bắt đầu nhất vì công việc có cấu trúc, phụ thuộc nhiều vào công cụ và tương đối dễ xác minh.
Giờ đây, khi các agent ngày càng giỏi điều hướng những quy tr
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
LLM đã có internet chờ sẵn. AI hiện thân thì không.
Robot cần lượng dữ liệu tương tác trong thế giới thực khổng lồ, và ACE Robotics ước tính toàn ngành hiện chỉ có khoảng 100 nghìn giờ hữu ích.
Trung Quốc đang nỗ lực tạo ra bộ dữ liệu đó: các trung tâm đào tạo mua robot, điều khiển chúng từ xa để thực hiện các nhiệm vụ thực tế, thu thập quỹ đạo, rồi cung cấp dữ liệu đó trở lại cho các nhà sản xuất robot.
Vì vậy, một số đợt triển khai robot hình người ban đầu đang làm nhiều hơn việc thử nghiệm phần cứng. Chúng đang tạo ra dữ liệu đào tạo mà thế hệ AI vật lý tiếp theo sẽ cần.
Điều đó khiến cuộc
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Thật khó tin khi năng lực đang tăng trưởng lũy tiến nhanh đến vậy, trong khi ngân sách phần cứng gần như không tăng tương ứng.
> Qwen3.5-27B đạt 35 điểm trên Artificial Analysis vào tháng 2.
> Qwen3.6-27B nâng con số đó lên 38 vào tháng 4.
> Qwen3.8-27B hiện đạt 52, trong khi vẫn nằm trong cùng khoảng 27 tỷ tham số về cơ bản.
Và hiệu năng tác tử của nó hiện đã tương đương với những mô hình lớn hơn đáng kể và tốn kém hơn rất nhiều khi vận hành.
Điều đó có vẻ quan trọng hơn đối với tôi so với một lần xáo trộn bảng xếp hạng nữa.
Trong nhiều năm, AI tốt hơn chủ yếu đồng nghĩa với việc mở rộng phần
Xem bản gốc
post-image
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Mạng lưới AI đang bắt đầu giống như một chu kỳ chi tiêu vốn thu nhỏ của riêng nó.
@Cisco khép lại FY2026 với các đơn hàng hạ tầng AI trị giá 9,3 tỷ USD từ các hyperscaler và dự báo doanh thu hạ tầng AI sẽ tăng từ khoảng $4B lên 7,5 tỷ USD vào năm tới. Arista vừa tăng trưởng 37,7% so với cùng kỳ năm trước lên 3,04 tỷ USD
Tôi nghĩ sự thay đổi đáng chú ý nằm ở nơi dòng tiền AI cận biên đang bắt đầu đổ vào.
Giai đoạn đầu của quá trình xây dựng hạ tầng tập trung vào việc đưa càng nhiều bộ tăng tốc trực tuyến càng tốt. Khi các cụm máy đạt quy mô đủ lớn, việc cung cấp dữ liệu cho các GPU đó và giúp
CSCO-0,28%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • 1
  • Retweed
Cách đây vài năm, các hyperscaler chiếm khoảng 16% chi tiêu vốn của S&P 500. Năm tới, năm công ty trong số đó có thể chi tiêu nhiều bằng tổng 495 công ty còn lại cộng lại.
Microsoft, Amazon, Alphabet, Meta, Oracle
BofA hiện ước tính năm công ty này sẽ chi khoảng 1,07 nghìn tỷ USD trong năm 2027, so với khoảng 1,06 nghìn tỷ USD của tất cả các công ty còn lại trong chỉ số.
Sự tập trung đó bắt đầu trở nên đáng chú ý vượt xa lĩnh vực GPU.
AI đã phát triển lớn đến mức nhu cầu điện toán đang bắt đầu kéo theo cả nền kinh tế vật chất. Goldman ước tính con số này hiện đã chiếm khoảng 15% đầu tư thiết b
MSFT0,10%
AMZN-1,11%
META0,66%
ORCL1,55%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Lưu lượng tác nhân tự chủ trên web đang tăng nhanh đến mức Cloudflare đã xây dựng một trình duyệt dành riêng cho các tác nhân AI (Kitesurf).
Các tác nhân về cơ bản đang kế thừa khoảng 30 năm quyết định thiết kế trình duyệt được tạo ra cho con người nhìn vào màn hình, và phần lớn trong số đó trở thành chi phí dư thừa không cần thiết khi chạy hàng nghìn phiên cùng lúc.
Lưu lượng web do AI thúc đẩy gần như tăng gấp ba trong suốt năm 2025, trong khi lưu lượng từ các tác nhân AI và trình duyệt tự chủ tăng 7.851% so với cùng kỳ năm trước.
Theo các ước tính hiện tại, các tác nhân tạo ra khoảng 57% số
NET5,03%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Thật điên rồ khi tình trạng thiếu hụt bộ nhớ ngày càng trầm trọng giờ đây bắt đầu tái định hình toàn cảnh GPU trước cả khi chúng được xuất xưởng.
@nvidia hiện đang thử nghiệm các tùy chọn HBM có cấu hình xếp chồng thấp hơn cho Rubin Ultra. Thiết kế HBM4e 12-Hi ban đầu có thể đạt 14–16 Gbps, trong khi hướng HBM4 được tối ưu hóa mới có thể đạt 11–12.
Điểm hấp dẫn nằm ở sản lượng. Ít lớp DRAM hơn trên mỗi bộ tăng tốc cho phép cùng nguồn cung wafer đáp ứng được nhiều GPU hơn.
Nhưng mô hình không thu nhỏ chỉ vì cấu hình bộ nhớ đã thu nhỏ. Khi phải phân bổ trên nhiều bộ tăng tốc hơn, hạ tầng mạng và
NVDA6,04%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Các công ty công nghệ lớn đang cam kết cho cơ sở hạ tầng AI vượt xa những con số chi tiêu vốn mà chúng ta thường thấy. Họ đã cam kết khoảng 1,09 nghìn tỷ USD cho các khoản thanh toán thuê trong tương lai, phần lớn dành cho các trung tâm dữ liệu AI.
Hiện chỉ khoảng 285 tỷ USD được ghi nhận là nợ thuê, vì nhiều hợp đồng chưa được ghi nhận cho đến khi các cơ sở đi vào hoạt động.
Rủi ro thực sự nằm ở sự lệch pha về thời hạn. Một số hợp đồng thuê kéo dài từ 15 đến 30 năm, trong khi chip, mô hình và nhu cầu của khách hàng có thể thay đổi chỉ sau vài chu kỳ sản phẩm. Nhu cầu năng lực tính toán có thể
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Nhu cầu năng lượng của các trung tâm dữ liệu đang tăng nhanh đến mức lưới điện không thể theo kịp, và các công ty giờ đây đang vận chuyển các turbine khí bằng xe tải đến để né tránh vấn đề này.
APR Energy vừa triển khai tám tổ máy di động, công suất 1,1GW, nhắm thẳng vào nhu cầu của các trung tâm dữ liệu.
Hãy nghĩ về điều đó. Một turbine đặt trên rơ-moóc tệ hơn kết nối lưới điện về mọi mặt, ngoại trừ một điều: bạn có thể đưa nó vào vận hành trong vài tháng thay vì vài năm. Chỉ đáng trả mức phí cao đó nếu thời gian chờ là thứ đang kìm hãm bạn, và hiện tại thời gian chờ ở nhiều bang của Mỹ là hơ
APR-1,69%
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Việc chạy DeepSeek V4 Flash 0731 trên phần cứng của riêng bạn giờ là có thật, nhưng chi phí là bao nhiêu và liệu nó có đáng hay không phụ thuộc rất nhiều vào việc bạn là ai.
những cỗ máy thực sự chạy nó:
> Mac Studio M3 Ultra 256GB (~7-9 nghìn USD): chứa bản build 4-bit với khoảng dư, gọn trong một máy duy nhất.
> M3 Ultra 512GB (~10 nghìn USD trở lên, nếu bạn tìm được): chạy phiên bản gần như không tổn hao một cách thoải mái.
> Server 2x H200 hoặc 4x A100: checkpoint đầy đủ ở ngữ cảnh 1M, nhưng lúc này bạn đã bước vào tầm tiền kiểu trung tâm dữ liệu.
về mặt kỹ thuật, nó cũng chạy được trên 12
Xem bản gốc
post-image
  • Phần thưởng
  • 1
  • Đăng lại
  • Retweed
GateUser-3e640a4c:
Đây có phải DeepSeek do nội địa Trung Quốc sản xuất không?
Nhà cung cấp chip. Tổ chức cho vay hạ tầng. Nhà đầu tư vốn vào chính các khách hàng của mình. Nvidia giờ là cả ba vai trò cùng lúc, và tháng này, khoản phí phải trả để giữ cả ba chiếc mũ đã đạt $750B
> $250B , trong đó bao gồm việc hỗ trợ cho thuê văn phòng của OpenAI tại Ohio.
> $500B gắn kết với SK Group về bộ nhớ.
> $5B tham gia vào SSI, một công ty không có sản phẩm.
> $1B vào Naver. Một phần sở hữu tại Nebius. Chip chảy vào các cơ sở ở Texas mà hãng này cho chính mình thuê lại.
Vòng lặp mà Nvidia đã tạo ra về cơ bản là: tài trợ cho khách hàng -> khách hàng mua chip Nvidia -> Nvidia ghi
Xem bản gốc
post-image
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Vì vậy, chúng tôi hiện đã vượt ~$1T trong tổng chi tiêu vốn (capex) cho trung tâm dữ liệu toàn cầu, hướng tới mức $1,7T vào năm 2030. Tăng từ $455B vào năm 2024.
Con số này gần như tăng gấp 4 lần trong sáu năm. Bốn siêu nhà cung cấp (hyperscalers) tại Mỹ ước tính sẽ tăng gấp đôi trong khoảng thời gian đó. Còn lại—các bên “neocloud”, các phòng thí nghiệm AI, các dự án thuộc khu vực nhà nước—mới là những yếu tố thực sự bẻ cong quỹ đạo, tăng trưởng trung bình khoảng 39% mỗi năm. Đến năm 2030, Amazon, Google, Meta và Microsoft chỉ chiếm khoảng một nửa.
Cách đây hai năm, việc xây dựng gần như
AMZN-1,11%
META0,66%
MSFT0,10%
Xem bản gốc
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
  • Đã ghim