HeadlinesBriefing favicon HeadlinesBriefing.com

AI लागत में भारी गिरावट: मॉडल लागत हर साल कई क्रम घट रही

Hacker News •
×

मशीन लर्निंग इंटेलिजेंस का उपयोग करने की लागत हर साल कई क्रम से घट रही है, जिसमें धीमा होने के कोई संकेत नहीं हैं। उम्मीद है कि LLMs सर्वव्यापी बुनियादी ढांचा बन जाएंगे, 3‑6 वर्षों में कमोडिटी हार्डवेयर पर स्थानीय रूप से चलेंगे। साक्ष्य में GPT‑6 Astra जैसे मालिकाना मॉडल और GLM‑5.3‑flash जैसे ओपन-वेट मॉडल, साथ ही Muse Glimmer और Qwen3 Coder जैसे स्थानीय मॉडल शामिल हैं। GPU पावर दक्षता एक लॉगरिदमिक वक्र का अनुसरण करती है, लगभग हर दो साल में दोगुनी होती है — ऐतिहासिक Moore's Law लाभ के समान। मॉडल मूल्य निर्धारण प्रति टोकन है, लेकिन टास्क-स्तर की लागत तेजी से गिर रही है; 2026 में पारेतो फ्रंटियर सस्ते, कम बुद्धिमान विकल्पों से लेकर महंगे, उच्च-प्रदर्शन वाले विकल्पों तक के मॉडल दिखाता है। इन्फ्रेंस इंजन तेजी से सुधर रहे हैं, हर साल 10‑50% लाभ दे रहे हैं। जैसे-जैसे टोकन लागत नगण्य होती जा रही है, गुणवत्ता और पहुंच AI अपनाने के नए सीमित कारक बन रहे हैं।