HeadlinesBriefing favicon HeadlinesBriefing.com

SWE-2がFable 5.1とGPT-Astraに匹敵

Hacker News •
×

The Cognition Team09.10.26 — CognitionがSWE-2を発表しました。これは同社のこれまでで最も高度なコーディングモデルです。Frontier Code 1.1 Mainでは50.0%を達成し、Fable 5.1には1ポイント及ばないものの、コストは64%低いです。以前のモデルとは異なり、SWE-2は単一のランで推論努力レベルすべてを訓練するアルゴリズムを使用して、RLを数兆パラメータ規模にスケーリングし、コスト–性能フロンティア全体を進化させます。Frontier Code 1.1 MainとDeep SWE 1.1では、SWE-2はスコアとコストの両方でSWE-1.7とGrok 4.6を上回り、GPT-5.6 SolとFable 5/5.1をその価格のほんの一部で上回り、GPT-6 Astraにはその4分の1の価格で数ポイント届きます。2.8TパラメータのKimi K33モデルを基盤とするSWE-2は、局所のパレートフロンティアの傾きに調整したコストペナルティ、改善された報酬ベースライン、最適化されたRL rolloutサービスを使用します。Devin DesktopとCLIでは本日利用でき、Devin WebとFusionでも展開されます。このモデルはより強いエンジニアリング判断力を示し、より多くの解決策をより少ない遠回りで作成します。SWE-1.7より高いスコアを獲得しながら、ターン数を58%減らし、コストは81%低くなります。