HeadlinesBriefing favicon HeadlinesBriefing.com

GLM-5.3-Flash: ফ্ল্যাশ খরচে ফ্রন্টিয়ার AI

Hacker News •
×

2026-08-26 · গবেষণা GLM-5.3-Flash: ফ্রন্টিয়ার ইন্টেলিজেন্স, ফ্ল্যাশ খরচ* Z.ai-তে কল করুন* Z.ai কোডিং প্ল্যান* ZCode দিয়ে কোড করুন* Hugging Face আমরা GLM-5.3-Flash উপস্থাপন করছি, GLM-5 সিরিজের প্রথম নেটিভভাবে মাল্টিমোডাল মডেল। 320B মোট প্যারামিটার এবং মাত্র 18B সক্রিয় প্যারামিটার সহ, এটি GLM-5.2-কে বেঞ্চমার্ক এবং বাস্তব-বিশ্বের কাজের চাপে দশমাংশ খরচে ছাড়িয়ে যায়, পাশাপাশি কোডিং এবং এজেন্টিক বেঞ্চমার্কে Claude Opus 4.8-এর কাছাকাছি পৌঁছে।

GLM-5.3-Flash GLM-5-এর তুলনায় বেশ কিছু আর্কিটেকচারাল উন্নতি অন্তর্ভুক্ত করে। প্রথমবারের মতো, আমরা স্পার্স এবং লিনিয়ার অ্যাটেনশন একত্রিত করে একটি হাইব্রিড আর্কিটেকচার প্রবর্তন করছি, যা দীর্ঘ-প্রসঙ্গ সার্ভিং খরচ তীব্রভাবে হ্রাস করে এবং সুনির্দিষ্ট দীর্ঘ-প্রসঙ্গ ক্ষমতা সংরক্ষণ করে। এটি স্কেলিং দক্ষতা আরও উন্নত করতে Manifold-Constrained Hyper-Connections (m HC) গ্রহণ করে। আমাদের সর্বশেষ 30T-টোকেন মাল্টিমোডাল প্রি-ট্রেনিং কর্পাসের সাথে মিলিত হয়ে, এই পরিবর্তনগুলি GLM-5.3-Flash-কে কম কম্পিউটে আরও বুদ্ধিমত্তা উৎপাদন করতে দেয়।

রিলিজের আগে, আমরা Open Code এবং Open Router-এ `ox-alpha` হিসাবে GLM-5.3-Flash-কে বেনামে পরীক্ষা করেছি ব্যবহারকারীর প্রতিক্রিয়া সংগ্রহ করতে। এটি দ্রুত সপ্তাহের সবচেয়ে জনপ্রিয় মডেল হয়ে ওঠে — এই সমস্ত ট্র্যাফিক চীনা AI চিপে পরিবেশিত হয়েছিল। GLM-5.3-Flash Artificial Analysis Intelligence Index v4.1.1-এর প্যারেটো ফ্রন্টিয়ারকে ঠেলে দেয়, প্রতি কাজে মাত্র $0.045 (ছাড়ে) স্কোর 57 — বুদ্ধিমত্তার একটি স্তর যা আগে প্রায় 10 গুণ খরচে পাওয়া যেত।

ছয়টি কোডিং এবং এজেন্টিক বেঞ্চমার্ক জুড়ে, GLM-5.3-Flash ধারাবাহিকভাবে GLM-5.2-কে ছাড়িয়ে যায়, প্রায়শই বিস্তৃত ব্যবধানে — Deep SWE v1.1-এ 63.4 বনাম 46.2 এবং Automation Bench-এ 48.8 বনাম 26.2 — পাশাপাশি সামগ্রিকভাবে Claude Opus 4.8-এর কাছাকাছি পৌঁছে। GLM-4.5 সিরিজের তুলনায়, GLM-5.3-Flash বিশেষভাবে অতি-কম খরচের ইনফারেন্সের জন্য ডিজাইন করা হয়েছে, যা সক্রিয় প্যারামিটার সংখ্যা এবং স্তরের সংখ্যা উভয়ই প্রায় অর্ধেক করে।

মূল সত্তা: কোম্পানি: Z.ai, Hugging Face, Open Code, Open Router