伯克利团队宣布攻破8个主要智能体评测基准并开源工具

ME News 消息,4 月 19 日(UTC+8),伯克利人工智能研究小组(berkeley_ai)转述了Dawn Song的声明,宣布其团队成功攻破了8个主要的智能体评测基准。团队决定开源用于实现这一结果的工具,并将其命名为BenchJack。该工具被描述为"针对评测的渗透测试",旨在帮助其他开发者主动测试和发现自身评测系统的潜在弱点。(来源:InFoQ)

此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
  • 赞赏
  • 评论
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
暂无评论