HeadlinesBriefing favicon HeadlinesBriefing

AI & ML Research 24 Hours

×
8 articles summarized · Last updated: LATEST

آخر تحديث: September 25, 2026, 10:31 PM ET

الذكاء الاصطناعي وأدوات الهندسة

قامت شركة Proaction بتعزيز مبيعاتها بنسبة 60% واستعادت أكثر من 75 ساعة من وقت الهندسة من خلال دمج Codex وGPT-Live-1 وGPT-6 Astra مباشرة في مجموعتها التشغيلية. تقوم الشركة الآن ببناء وتشغيل وبيع نماذج التعلم الآلي باستخدام هذه الأدوات كبنية تحتية أساسية بدلاً من كونها مساعدات طرفية.

هندسة RAG والوكلاء

تفصل بنية جديدة عملية الاسترجاع عن الفعل من خلال بناء الطبقة بين أنظمة RAG والوكلاء المستقلين بشكل صريح. يجادل المؤلف بأن خلط الاسترجاع والفعل يؤدي إلى أنظمة هشة، ويوضح تصميمًا معياريًا حيث يغذي الاسترجاع طبقة اتخاذ القرار التي تؤدي إلى استخدام الأدوات فقط عند الضرورة.

التقييم وعدم اليقين

مقاييس MSE التقليدية تضلل المطورين عندما يتم تقييم النماذج عبر التوليد التلقائي المتسلسل. يقدم الجزء الثاني من هذه السلسلة تقنيات نشر عدم اليقين لتحديد ثقة التنبؤ بشكل أفضل عبر نقاط القرار المتسلسلة، محذرًا من أن مقاييس الخطأ الساذجة تتجاهل التباين المتراكم في الأنظمة التكرارية.

معايير اتخاذ القرار

تم اختبار نموذج Jev من TypeSafe AI على 3,080 مهمة تصنيف لقياس تحوله من الأداء التوليدي إلى أداء اتخاذ القرار. تظهر النتائج أن Jev يتفوق على نماذج LLM القياسية في التصنيف المنظم بنسبة 22% في الدقة، خاصة في الحالات الحدودية حيث تكون عتبات الثقة أكثر أهمية من تنوع المخرجات الخام.

الطلاقة التقنية الأوسع

إلى جانب ضبط النماذج، يتعلم الممارسون التقنيات المجاورة — بما في ذلك الأنظمة الموزعة، والمراقبة، وأخلاقيات هندسة المطالبات — لبناء أنظمة ذكاء اصطناعي جاهزة للإنتاج. يسرد المؤلف عشر كفاءات تميز باحثي التعلم الآلي عن مهندسي الذكاء الاصطناعي القابلين للنشر.

الدفاع والبحوث الحيوية

تخصص وزارة الدفاع الأمريكية 30.3 مليون دولار على مدى خمس سنوات لتطوير كاشف كذب مدعوم بالذكاء الاصطناعي، مما يثير تساؤلات حول العدالة الخوارزمية وأخلاقيات المراقبة. بشكل منفصل، تتحدى دراسة فرضية تجديد "الأعضاء الشابة"، حيث لم تجد أي إعادة برمجة جينية كبيرة في متلقي زراعة أعضاء شابة — مما يقوض ركيزة أساسية لنظرية "ينبوع الشباب".