HeadlinesBriefing favicon HeadlinesBriefing.com

वॉर्प ने Claude प्लेटफॉर्म पर स्व-सुधारित एजेंट्स बनाए

Hacker News •
×

वॉर्प, जो AI-सश्रित टर्मिनल और विकास वातावरण है, ने दोहराव वाले कार्य भरोसेमंदता समस्याओं को हल करने के लिए Claude प्लेटफॉर्म पर एक स्व-सुधारित एजेंट आर्किटेक्चर निर्मित किया है। 2020 में Zach Lloyd द्वारा स्थापित वॉर्प एक सामान्य समस्या का सामना करता है जहां पहले से ही 80% कार्य सहीता प्राप्त करने वाला एक प्रॉम्प्ट गूंजते हुए उपयोगकर्ता अनुभव पैदा करता है। टीम ने शुरुआती रूप से मैन्युअल प्रॉम्प्ट रीराइटिंग और सुधारित संदर्भ फ़ाइलों का प्रयास किया, लेकिन यह पाया कि ये समाधान स्केल नहीं होते। मूल समस्या यह थी कि एजेंट्स को भेजी गई प्रतिक्रिया आम तौर पर सत्र समाप्त होने पर गायब हो जाती है, जिससे एजेंट लूप से महत्वपूर्ण संदर्भ हट जाता है। वॉर्प का समाधान एक Agent Skills-आधारित ढांचा है जहां प्रतिक्रिया समय के साथ संचयी रूप से सुधार करती है। आर्किटेक्चर में दो प्रकार कौशल शामिल हैं: एक आंतरिक/आधार कौशल जो कार्यात्मक डोमेन ज्ञान और निर्देशों को धारण करता है, और एक बाहरी/सुधारक कौशल जो एक निरीक्षक एजेंट के रूप में कार्य करता है। सुधारक एक निर्धारित समय सारणी पर चलता है, जमा हुई मानव प्रतिक्रिया निकालता है और एजेंट सुझावों की तुलना मानव प्रतिक्रियाओं से करकर आधार कौशल में लक्षित संपादनों का प्रस्तावन करता है। चूंकि कौशल साधारण फ़ाइलें हैं, अद्यतन समीक्षा योग्य, मंजूर योग्य और मानक PR वर्कफ़्लो के माध्यम से मर्ज करने योग्य हैं। एक बार मर्ज हो जाने पर, आंतरिक कौशल का अगला चलाव उन सुधारों को विरासत में लेता है। वॉर्प अब इस पैटर्न को अपने पूरे ओपन-सोर्स रेपो में चलाता है, जिसमें अलग-अलग विशिष्टता लेखन, समीक्षा और ट्राइएज एजेंट्स शामिल हैं, प्रत्येक के अपने स्वयं के सुधार लूप के साथ। यह ढांचा समय के साथ सुधारों की संचयी प्रकृति की अनुमति देता है बिना कच्चे प्रॉम्प्ट्स को प्रदूषित किए, जिससे अधिक भरोसेमंद AI-सहायता विकास की ओर एक टिकाऊ मार्ग बनता है।