据Beating报道,Poolside近日开源了Laguna S 2.1,这是一个1180亿参数的混合专家代码模型,每次推理仅激活80亿参数,并支持100万词元的上下文窗口。在Terminal-Bench 2.1基准测试中,Laguna S 2.1取得了70.2%的成绩,超过了DeepSeek-V4-Pro-Max的64.0%,尽管后者总参数达1.6万亿。 然而,该模型落后于在同一基准测试中得分88.3%的Kimi K3。Poolside指出,得分反映了不同的评估环境和框架,其他竞争模型的成绩来自公开结果。