HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3-Flash: फ्रंटियर AI फ्लैश लागत पर

Hacker News •
×

2026-08-26 · अनुसंधान GLM-5.3-Flash: फ्रंटियर इंटेलिजेंस, फ्लैश लागत* इसे Z.ai पर कॉल करें* Z.ai कोडिंग प्लान* ZCode के साथ कोड करें* Hugging Face हम GLM-5.3-Flash पेश करते हैं, GLM-5 श्रृंखला का पहला मूल रूप से मल्टीमॉडल मॉडल। 320B कुल पैरामीटर और केवल 18B सक्रिय पैरामीटर के साथ, यह बेंचमार्क और वास्तविक दुनिया के कार्यभार में दसवें मूल्य पर GLM-5.2 से बेहतर प्रदर्शन करता है, जबकि कोडिंग और एजेंटिक बेंचमार्क में Claude Opus 4.8 के करीब पहुंचता है।

GLM-5.3-Flash में GLM-5 की तुलना में कई वास्तु सुधार शामिल हैं। पहली बार, हम स्पार्स और रैखिक ध्यान को मिलाकर एक हाइब्रिड वास्तुकला पेश करते हैं, जो लंबे संदर्भ सेवा लागत को तेजी से कम करता है जबकि सटीक लंबे संदर्भ क्षमताओं को संरक्षित करता है। यह स्केलिंग दक्षता में और सुधार के लिए Manifold-Constrained Hyper-Connections (m HC) भी अपनाता है। हमारे नवीनतम 30T-टोकन मल्टीमॉडल प्री-ट्रेनिंग कॉर्पस के साथ, ये परिवर्तन GLM-5.3-Flash को कम कंप्यूट के साथ अधिक बुद्धिमत्ता उत्पन्न करने की अनुमति देते हैं।

रिलीज़ से पहले, हमने उपयोगकर्ता प्रतिक्रिया एकत्र करने के लिए Open Code और Open Router पर `ox-alpha` के रूप में GLM-5.3-Flash का गुमनाम रूप से परीक्षण किया। यह जल्दी से सप्ताह का सबसे लोकप्रिय मॉडल बन गया — यह सारा ट्रैफ़िक चीनी AI चिप्स पर परोसा गया। GLM-5.3-Flash Artificial Analysis Intelligence Index v4.1.1 के पारेटो फ्रंटियर को आगे बढ़ाता है, केवल $0.045 प्रति कार्य (छूट पर) पर 57 स्कोर करता है — बुद्धिमत्ता का एक स्तर जो पहले केवल लगभग 10 गुना लागत पर उपलब्ध था।

छह कोडिंग और एजेंटिक बेंचमार्क में, GLM-5.3-Flash लगातार GLM-5.2 से बेहतर प्रदर्शन करता है, अक्सर व्यापक अंतर से — Deep SWE v1.1 पर 63.4 बनाम 46.2 और Automation Bench पर 48.8 बनाम 26.2 — जबकि समग्र रूप से Claude Opus 4.8 के करीब पहुंचता है। GLM-4.5 श्रृंखला की तुलना में, GLM-5.3-Flash विशेष रूप से अति-कम लागत अनुमान के लिए डिज़ाइन किया गया है, जो सक्रिय पैरामीटर गणना और परतों की संख्या दोनों को लगभग आधा कर देता है।

मुख्य संस्थाएँ: कंपनियाँ: Z.ai, Hugging Face, Open Code, Open Router