HeadlinesBriefing favicon HeadlinesBriefing.com

SWE-2 من Cognition ينافس Fable 5.1 وGPT-Astra

Hacker News •
×

بقلم The Cognition Team09.10.26 — أعلنت Cognition عن SWE-2، أكثر نموذج برمجة متطورًا لديها حتى الآن. حقق 50.0% في Frontier Code 1.1 Main، على بُعد نقطة واحدة عن Fable 5.1 مع كونه أرخص بنسبة 64%. وعلى unlike النماذج السابقة، يوسّع SWE-2 نطاق RL إلى نظام يتجاوز تريليونَي بارامتر باستخدام خوارزمية تدرب جميع مستويات جهد الاستدلال في تشغيل واحد، مما يدفع كامل حدود الأداء مقابل التكلفة إلى الأمام. وعلى Frontier Code 1.1 Main وDeep SWE 1.1، يتفوق SWE-2 على SWE-1.7 وGrok 4.6 من حيث النتيجة والتكلفة، ويوازي GPT-5.6 Sol وFable 5/5.1 بكسر من سعرهما، ويقترب بضع نقاط من GPT-6 Astra بتكلفة ربع تكلفته. وبنيًّا على نموذج Kimi K33 ذي 2.8T بارامتر، يستخدم SWE-2 عقوبات تكلفة مُعدَّلة وفق انحدارات حدود Pareto المحلية، وقواعد أساسية محسّنة للمكافآت، وخدمة نشر RL محسّنة. وهو متاح اليوم في Devin Desktop وCLI، مع نشره على Devin Web وFusion. ويُظهر النموذج حكمًا هندسيًا أقوى، ويكتب حلولًا أكثر اكتمالًا مع مسارات أقل—فهي تحقق نتيجة أعلى من SWE-1.7 مع تقليل عدد المرات بنسبة 58% وتكلفة أقل بنسبة 81%.