HeadlinesBriefing favicon HeadlinesBriefing

AI & ML Research 3d

×
29 articles summarized · Last updated: v1880
You are viewing an older version. View latest →

अंतिम अपडेट: August 21, 2026, 1:33 PM ET

निर्णय बुद्धिमत्ता और अनुकूलन

अनिश्चितता स्वचालित निर्णय-निर्माण में एक प्रथम श्रेणी के इनपुट के रूप में बनती जा रही है। बेयज़ियन गार्डरेल पर एक नया विश्लेषण तर्क देता है कि AI सिस्टम को कोई निर्णय केवल इसलिए स्वचालित नहीं करना चाहिए कि वे भविष्यवाणी कर सकते हैं; इसके बजाय, उन्हें यह मापना चाहिए कि वह भविष्यवाणी कितनी अनिश्चित है, और जब भी गलती महँगी पड़ सकती हो, निर्णय टाल देना चाहिए। अनुकूलन की ओर, बेंडर्स डिकंपोज़िशन पर श्रृंखला का दूसरा भाग दिखाता है कि फ़ार्कास की लेम्मा कैसे अव्यवहार्य उप-समस्याओं को व्यवहार्यता कटौतियों में बदलती है — इसे क्षमता-सीमित सुविधा स्थान समस्या पर प्रदर्शित किया गया है। इस बीच, MIT टेक्नोलॉजी रिव्यू यह जानता है कि एयरलाइंस मार्केट मॉडल का उपयोग कैसे करती हैं छिपे राजस्व को अनलॉक करने के लिए ऐसे नेटवर्कों में जो सैकड़ों उड़ानों पर प्रतिदिन दसियों हज़ार यात्रियों को ढोते हैं, जिनमें से कई को कई कनेक्शनों की आवश्यकता होती है।

LLM मूल्यांकन और फ़ाइन-ट्यूनिंग

इस सप्ताह स्वचालित मूल्यांकन पर भरोसे को झटका लगा। एक ऐसे LLM जज पर पोस्ट-मॉर्टम, जो लगातार खुद से ही सहमत होता रहा, बताता है कि एक प्रोडक्शन घटना ने एक इंजीनियर को किसी मॉडल पर दूसरे मॉडल के काम को ग्रेड करने का भरोसा करने के बारे में क्या सिखाया। अपने सिस्टम प्रशिक्षित करने वाले डेवलपर्स के लिए, एक व्यावहारिक एंड-टू-एंड गाइड वास्तविक दुनिया की परिस्थितियों के लिए LLM को फ़ाइन-ट्यून करने को कवर करती है। सबसे तीखा अनुभवजन्य योगदान Kimi K3 की 1M-टोकन कॉन्टेक्स्ट विंडो बनाम RAG की एक नियंत्रित तुलना से आया: एक पूर्ण 127,000-टोकन प्रॉम्प्ट का सामना एक टॉप-5 RAG पाइपलाइन से हुआ — वही 12 प्रश्न, वही सिस्टम प्रॉम्प्ट और वही मॉडल, सटीकता, पूर्णता और ग्राउंडिंग पर ब्लाइंड ग्रेडिंग के साथ।

RAG और ज्ञान अवसंरचना

पुनर्प्राप्ति डिज़ाइन को कॉर्पस आकृति के इर्द-गिर्द पुनर्निर्मित किया जा रहा है। एक वर्गीकरण तीन नैदानिक प्रश्नों के ज़रिए RAG कॉर्पस प्रकारों की पहचान करता है और चेतावनी देता है कि प्रत्येक दस्तावेज़-सं