हाल ही में Google के एक पेपर ने दिखाया कि स्पेक-संचालित टेस्ट जनरेशन ने उनके कोडबेस के नमूने पर बग डिटेक्शन को 9.8 प्रतिशत अंक बढ़ाया। लेकिन उनका स्पेक कोड से पढ़ा जाता है, जो मेरे लिए महत्वपूर्ण आधे हिस्से को अनसुलझा छोड़ देता है। मैं महीनों से तर्क दे रहा हूं कि जिस मॉडल ने कोड लिखा है, उसी मॉडल द्वारा लिखा गया टेस्ट सूट वास्तव में उससे असहमत नहीं हो सकता है, और अपने दावे के समर्थन में मैंने एक नई ओपन सोर्स Python लाइब्रेरी विकसित की है।
सॉफ्टवेयर टेस्टिंग बीस वर्षों से एक दिशा में आगे बढ़ रही है, और स्पेसिफिकेशन-संचालित विकास (SDD) वह जगह है जहां यह आंदोलन हाल ही में पहुंचा है। यह लेख एक और कदम की वकालत करता है: स्वतंत्र SDD, या ISDD। TDD ने कहा कि टेस्ट ही स्पेसिफिकेशन हैं। BDD उसका उत्तर था। SDD वह संस्करण है जो एजेंटों के साथ आया।
वर्तमान में, स्पेक-संचालित विकास काम को विभाजित करता है। यह विभाजित नहीं करता कि ज्ञान किसके पास है। वही स्पेसिफिकेशन प्लानर, टेस्ट जनरेटर और कोडिंग एजेंट के पास जाता है। मेरा तर्क उस रेखा के साथ काटना है: कोडिंग एजेंट को निर्णय दें और स्वीकृति मानदंड रोक दें, ताकि टेस्ट सूट कोड को बता सके कि वह गलत है।
Google की एक टीम ने रोकने से पहले के कदम को मापा। "Grounding AI Agents in Contracts: An Empirical Evaluation of Spec-Driven Test Generation" मेरे तर्क से संकीर्ण कुछ करता है। वे पहले इसे कोड के बारे में तर्क करने और अपना अनुबंध लिखने के लिए कहते हैं। वह दस्तावेज़ एक संज्ञानात्मक मचान बन जाता है और उससे टेस्ट उत्पन्न होते हैं। परिणाम, Google के अपने कोडबेस के उत्पादन बग्स पर, दिखाते हैं कि आधे से अधिक समय, एक उत्पन्न टेस्ट सूट...
स्रोत: Towards Data Science · HeadlinesBriefing द्वारा सारांशित