HeadlinesBriefing favicon HeadlinesBriefing.com

Cognition推出SWE-2,挑战Fable 5.1与GPT-Astra

Hacker News •
×

作者:The Cognition Team09.10.26——Cognition推出了SWE-2,这是迄今最先进其编码模型。它在Frontier Code 1.1 Main上取得50.0%的成绩,仅比Fable 5.1低一个百分点,但成本要低64%。不同于以往的模型,SWE-2利用一种在一次运行中同时训练所有推理投入等级的算法,将强化学习扩展至数万亿参数规模,从而推进整个成本—性能前沿。在Frontier Code 1.1 Main和Deep SWE 1.1上,SWE-2在得分和成本两方面均超过SWE-1.7和Grok 4.6;其价格仅为GPT-5.6 Sol和Fable 5/5.1的一小部分,却能达到相同的水平;而成本仅为GPT-6 Astra的四分之一,成绩也只相差几个百分点。SWE-2建立在拥有2.8T参数的Kimi K33模型之上,采用针对局部帕累托前沿斜率调优的成本惩罚、改进的奖励基线,以及经过优化的RL rollout服务。该模型今天已在Devin Desktop和CLI中提供,并将登陆Devin Web和Fusion。该模型展现出更强的工程判断力,能写出更完整的解决方案,且少绕弯路——相比SWE-1.7,它得分更高,却减少了58%的轮次,成本也低81%。