维度网讯,美国初创公司Poolside发布Laguna S 2.1,这是一款拥有1180亿参数的开源权重编码模型,采用混合专家架构,每个token可激活80亿参数。该模型专为智能体编码设计,紧凑到可以在单台英伟达DGX Spark桌面系统上运行,其权重已根据Linux基金会的OpenMDW许可证在Hugging Face平台上发布。

在两项智能体编码评估Terminal-Bench和SWE-Bench Pro中,Laguna S 2.1分别获得略高于70%和接近60%的得分。Poolside表示,该模型性能匹敌甚至超越了来自DeepSeek、Nvidia和Thinking Machines等公司拥有2至8倍活跃参数的模型,但该公司也承认该模型尚未达到前沿水平,OpenAI和Anthropic的闭源系统在相同基准测试中仍明显领先。
此次发布被视为对中国实验室在开源权重领域主导地位的直接回应。过去一年多,DeepSeek、阿里巴巴的Qwen系列和月之暗面的Kimi在该领域保持领先。据该公司称,在此次发布前的11个月里,没有西方实验室推出过1180亿参数级别的开源权重模型。据《福布斯》报道,Poolside将此次发布定位为向西方企业和政府提供可供自主部署的替代方案,使其无需将数据发送给海外供应商。
Poolside由前GitHub首席技术官Jason Warner和Eiso Kant于2023年创立,2024年10月以30亿美元估值完成5亿美元B轮融资,得到了Nvidia和eBay的支持。2026年4月,由于CoreWeave退出了一个在得克萨斯州的联合数据中心项目,原本计划以140亿美元估值进行的20亿美元C轮融资宣告失败。该公司目前通过其API和智能体工具为政府、国防及其他高度受监管的组织提供服务。
该公司表示,其利用内部Model Factory平台构建了该模型,该平台可自动进行架构搜索和基于代码执行的强化学习,并在不到四周时间内使用4000块Nvidia H200 GPU完成训练。三周前,更小的Laguna XS也已发布,公司表示大致以五周为周期推出新模型。作为长程推理的展示,Poolside发布了该模型独立解决一个组合学问题的运行轨迹,而直到最近,只有最大的前沿模型才能解决该问题。
Poolside的商业模式主张企业愿意付费在自己的硬件上运行功能强大的编码模型,而不将提示发送到封闭的API。这一预期取决于Laguna S 2.1在生产环境中的表现能否与基准测试一致。公司自己的结果显示,该模型在Terminal-Bench上落后闭源领先者大约10至15个百分点。该公司能否在下一周期缩小这一差距,同时与也在快速进步的中国开源权重模型竞争,将决定西方在开源权重领域的差距是暂时现象还是结构性问题。










