HeadlinesBriefing favicon HeadlinesBriefing.com

SWE-2 de Cognition rivaliza con Fable 5.1 y GPT-Astra

Hacker News •
×

Por The Cognition Team09.10.26 — Cognition ha presentado SWE-2, su modelo de programación más avanzado hasta la fecha. Obtiene un 50,0% en Frontier Code 1.1 Main, a un punto de Fable 5.1, pero cuesta un 64% menos. A diferencia de los modelos anteriores, SWE-2 escala el RL al régimen de varios billones de parámetros mediante un algoritmo que entrena todos los niveles de esfuerzo de razonamiento en una sola ejecución, avanzando toda la frontera coste-rendimiento.

En Frontier Code 1.1 Main y Deep SWE 1.1, SWE-2 supera a SWE-1.7 y Grok 4.6 tanto en puntuación como en coste, iguala a GPT-5.6 Sol y Fable 5/5.1 por una fracción de su precio, y se sitúa a pocos puntos de GPT-6 Astra con una cuarta parte del coste. Basado en el modelo Kimi K33 de 2,8T parámetros, SWE-2 utiliza penalizaciones de coste ajustadas a las pendientes locales de la frontera de Pareto, bases de recompensa mejoradas y un servicio de rollout de RL optimizado. Está disponible desde hoy en Devin Desktop y CLI, con un despliegue en Devin Web y Fusion.

El modelo demuestra un mejor criterio de ingeniería, escribe soluciones más completas con menos desvíos: obtiene una puntuación superior a SWE-1.7, pero con un 58% menos de turnos y un coste un 81% menor.