首個AI程式員指數發布:Cursor搭配Opus 4.7險勝Codex登頂

robot
摘要生成中
幣界網消息,人工智能分析平台發布了首個編碼智能體綜合基準指數(coding agent index)。該指數綜合了代碼生成、終端操作和技術問答三項測試,用來評估AI程序員的真實工程表現。首期評測中,Cursor CLI搭配Opus 4.7模型以61分拿下榜首,以1分優勢力壓OpenAI的Codex(搭配GPT-5.5)和Anthropic的Claude Code(搭配Opus 4.7)。同樣調用Opus 4.7模型,Cursor CLI的得分略高於官方的Claude Code,但代價是單次任務平均耗時更長(7.8分鐘對5.8分鐘),API調用成本也更高(1.47美元對1.24美元)。最省錢的是Cursor內置的Composer 2,單次任務只要0.07美元DeepSeek V4 Pro和Kimi K2.6緊隨其後,但這幾款國產模型跑起來耗時明顯更長。
查看原文
此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 回覆
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆
  • 已置頂