登录
注册
Woofun AI 获悉,编程Agent工具Poolside已开源混合专家(MoE)模型Laguna S 2.1。该模型总参数量为1180亿,单次推理仅激活800亿参数,支持长达100万个Token的上下文窗口,经量化后可在单台英伟达DGX Spark设备上运行。
Poolside自测数据显示,Laguna S 2.1在Terminal-Bench 2.1测试中得分为70.2%,高于DeepSeek-V4-Pro-Max的64.0%;在SWE-Bench Multilingual、SWE-Bench Pro及DeepSWE测试中亦表现更优。
不过,其性能仍落后于Kimi K3,后者在Terminal-Bench 2.1和DeepSWE测试中分别获得88.3%和69%的分数,而Laguna S 2.1在这两项测试中的得分分别为70.2%和40.4%。需注意的是,上述对比并非基于统一测试环境,Poolside使用自研Agent框架,而竞品引用的是公开最佳数据。