HeadlinesBriefing favicon HeadlinesBriefing.com

SWE-2 Cognition saingan Fable 5.1 dan GPT-Astra

Hacker News •
×

Oleh The Cognition Team09.10.26 — Cognition telah memperkenalkan SWE-2, model coding paling canggih mereka sejauh ini. Model ini meraih 50.0% pada Frontier Code 1.1 Main, hanya terpaut satu poin dari Fable 5.1 sekaligus 64% lebih murah. Tidak seperti model sebelumnya, SWE-2 menskalakan RL ke rezim multi-triliun parameter menggunakan algoritma yang melatih semua tingkat effort penalaran dalam satu run, memajukan seluruh cost–performance frontier.

Pada Frontier Code 1.1 Main dan Deep SWE 1.1, SWE-2 mengalahkan SWE-1.7 dan Grok 4.6 dalam hal skor dan biaya, menyamai GPT-5.6 Sol dan Fable 5/5.1 dengan hanya sebagian kecil dari harga mereka, serta mendekati GPT-6 Astra dalam beberapa poin dengan biaya seperempat. Dibangun di atas model Kimi K33 berparameter 2.8T, SWE-2 menggunakan penalti biaya yang disesuaikan dengan kemiringan frontier Pareto lokal, baseline reward yang lebih baik, dan penyajian rollout RL yang dioptimalkan. Model ini tersedia hari ini di Devin Desktop dan CLI, dengan rollout di Devin Web dan Fusion.

Model ini menunjukkan kemampuan menilai teknik yang lebih kuat, menulis solusi yang lebih lengkap dengan lebih sedikit penyimpangan—mencapai skor lebih tinggi daripada SWE-1.7 sekaligus membutuhkan 58% turn lebih sedikit dan biaya 81% lebih murah.