AI科研閉環跑通了,零人干預+自我博弈,這波是agent自己捲自己

查看原文
币 界 网
DeepSeek研究員陳德里開源Deli AutoResearch:AI已能自主做285B大模型實驗並寫論文
幣界網報導,DeepSeek資深研究員陳德里開源Deli AutoResearch,第四篇綜述由智能體全自主撰寫。通過skill.md協議文件實現AI調用子智能體協作完成科研全流程。自我博弈綜述在零人干預下首次自主規劃GPU實驗,並在285B參數的DeepSeek模型上進行強化學習訓練,採用GRPO算法完成從設計到結論的研究閉環,在模擬同行評審獲得8.6/10。此前其方法已產出三篇綜述,首篇約60輪迭代、總耗時約10小時,驗證AI原生研究路徑可行。
此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 回覆
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆
  • 已置頂