#DeepSeekV4ProTiếnGầnFable5


DeepSeek V4 Pro Tiến Gần Fable 5: Cuộc Đua AI Giờ Đây Không Còn Chỉ Là Ai Thông Minh Nhất

Bản cập nhật chính thức của DeepSeek V4 Pro cho thấy bước tiến lớn, đặc biệt trong khả năng lập trình, suy luận, sử dụng công cụ và thực hiện các nhiệm vụ tác nhân. Một số thử nghiệm cho thấy hiệu suất của mô hình ngày càng tiến gần đến các mô hình hàng đầu như Claude Fable 5, dù kết quả không đồng nhất trên tất cả các bài đánh giá.
Tuy nhiên, câu chuyện quan trọng nhất không chỉ đơn giản là “DeepSeek gần bắt kịp Fable 5.”
Điều thực sự thay đổi là mức giá để sở hữu trí tuệ AI cấp độ hàng đầu.
Khoảng Cách Hiệu Suất Thu Hẹp, Cạnh Tranh Về Giá Trị Ngày Càng Lớn
DeepSeek V4 Pro chính thức rời giai đoạn xem trước vào giữa tháng 8 với những cải tiến lớn so với phiên bản trước. Trong bài đánh giá độc lập của Artificial Analysis được Reuters trích dẫn, mô hình này đạt 53 điểm trên Intelligence Index, tăng từ mức 40 của V4 Flash.
Trong khi đó, dữ liệu đánh giá chính thức của DeepSeek cho thấy năng lực mạnh mẽ trong các nhiệm vụ phức tạp. Ở chế độ Max, V4 Pro lần lượt đạt 90,1% GPQA Diamond, 93,5% LiveCodeBench và xếp hạng 3.206 trên Codeforces. Tuy nhiên, các bài đánh giá khác vẫn cho thấy không có mô hình nào hoàn toàn chiến thắng ở mọi hạng mục.
Đây là thay đổi quan trọng trong cuộc đua AI:
Sự khác biệt giữa mô hình tốt nhất và các đối thủ ngày càng thu hẹp, trong khi chênh lệch về chi phí và khả năng tiếp cận có thể ngày càng mang tính quyết định.
Không Còn Chỉ Là Chatbot, Mà Là Những Tác Nhân Biết Làm Việc
DeepSeek cũng tăng cường tập trung vào khả năng tác nhân AI, tức AI không chỉ trả lời câu hỏi mà còn có thể sử dụng công cụ, thực hiện quy trình nhiều bước và hoàn thành các nhiệm vụ phức tạp hơn. Cùng với bản cập nhật V4 Pro, DeepSeek cũng giới thiệu phần mềm tác nhân DeepSeek Harness dưới dạng mã nguồn mở.

Điều đó có nghĩa là cuộc cạnh tranh tiếp theo có thể không phải là:
“AI nào đưa ra câu trả lời tốt nhất?”
Mà là:
“AI nào có thể hoàn thành công việc thực tế hiệu quả nhất?”
Kết luận
DeepSeek V4 Pro chưa tự động đánh bại Fable 5 trong mọi bài đánh giá. Thậm chí, các báo cáo mới nhất cho thấy mô hình này vẫn kém hơn trong một số bài đánh giá.
Nhưng đó mới chính là điểm mấu chốt.
Khi một mô hình rẻ hơn và cởi mở hơn có thể tiến gần năng lực của các mô hình hàng đầu, thị trường AI bước vào một giai đoạn mới. Lợi thế không còn chỉ được quyết định bởi điểm số đánh giá cao nhất, mà bởi sự kết hợp giữa hiệu suất, chi phí, tốc độ, khả năng tiếp cận và năng lực thực hiện công việc thực tế.
DeepSeek V4 Pro có thể chưa giành chiến thắng trong toàn bộ cuộc đua. Tuy nhiên, nó góp phần thay đổi luật chơi: AI tốt nhất không phải lúc nào cũng là AI đắt nhất.
Xem bản gốc
Trang này có thể chứa nội dung của bên thứ ba, được cung cấp chỉ nhằm mục đích thông tin (không phải là tuyên bố/bảo đảm) và không được coi là sự chứng thực cho quan điểm của Gate hoặc là lời khuyên về tài chính hoặc chuyên môn. Xem Tuyên bố từ chối trách nhiệm để biết chi tiết.
911 lượt xem
  • Phần thưởng
  • Bình luận
  • Đăng lại
  • Retweed
Bình luận
Thêm một bình luận
Thêm một bình luận
Không có bình luận
  • Đã ghim