HeadlinesBriefing favicon HeadlinesBriefing.com

SWE-2 da Cognition rivaliza com Fable 5.1 e GPT-Astra

Hacker News •
×

Por The Cognition Team09.10.26 — A Cognition apresentou o SWE-2, seu modelo de programação mais avançado até agora. Ele alcança 50,0% no Frontier Code 1.1 Main, a um ponto de Fable 5.1, mas custa 64% menos. Diferentemente dos modelos anteriores, o SWE-2 escala o RL para o regime de múltiplos trilhões de parâmetros usando um algoritmo que treina todos os níveis de esforço de raciocínio em uma única execução, avançando toda a fronteira custo-desempenho.

No Frontier Code 1.1 Main e no Deep SWE 1.1, o SWE-2 supera o SWE-1.7 e o Grok 4.6 tanto em pontuação quanto em custo, iguala o GPT-5.6 Sol e o Fable 5/5.1 por uma fração do preço deles e fica a poucos pontos do GPT-6 Astra com um quarto do custo. Baseado no modelo Kimi K33 de 2,8T parâmetros, o SWE-2 usa penalidades de custo ajustadas às inclinações locais da fronteira de Pareto, bases de recompensa melhoradas e serviço de rollout RL otimizado. Ele está disponível hoje no Devin Desktop e no CLI, com rollout no Devin Web e no Fusion.

O modelo demonstra um julgamento de engenharia mais forte, escrevendo soluções mais completas com menos desvios — obtendo uma pontuação maior que a do SWE-1.7, mas com 58% menos turnos e custando 81% menos.