谷歌用 Claude Fable 5 和七个新 AI 模型更新了 Android 基准测试
谷歌今日更新了 Android Bench,在其安卓应用开发基准排行榜中新增了八个 AI 模型。此次更新包括 Claude Fable 5、Claude Sonnet 5、Claude Opus 4.8、GLM 5.2、Kimi K2.7 Code、MiniMax M3、Qwen 3.7 Plus 和 Qwen 3.7 Max。谷歌创建该基准测试以评估大型语言模型在 100 项安卓开发任务中的表现,最初版本于三月推出。 谷歌在 Android Bench 排行榜中新增八个 AI 模型 谷歌扩展了 Android Bench,新增了八个模型。这些新增模型包括 Claude Fable 5、Claude Sonnet 5、Claude Opus 4.8、GLM 5.2、Kimi K2.7 Code、MiniMax M3、Qwen 3.7 Plus 和 Qwen 3.7 Max。公司还采用了新的框架,并增加了成本和效率的指标。谷歌邀请开发者自行测试并提交反馈。 Claude Fable 5 以 84.5% 准确率领先基准测试 Claude Fable 5 在 Android Bench 测试
Oliver Grant·07-08 16:53
