HeadlinesBriefing favicon HeadlinesBriefing.com

مُسرّع NVIDIA Rubin CPX AI ب ذاكرة HBM4

TechPowerUp News •
×

NVIDIA أحيت مشروع مُسرّع Rubin CPX AI، الآن بذاكرة HBM4 بدل GDDR7 الذي كان مخططًا له مسبقًا. أفاد المُحلّل المعروف لسلسلة التوريد Ming Chi Kuo بال redesign، ملاحظًا أن Rubin CPX تم إيقافه بعد أن أعلنت NVIDIA عن خططها لمُسرّع مخصص مشتق من عائلة GPUs Rubin لحمولات IA العاملة على scales كبيرة. يحتوي Rubin CPX المُ redesigned على 168 جيجابايت من ذاكرة HBM4، ترقية عن الخطة الأصلية لـ 128 جيجابايت GDDR7. يُ housed هذا SKU لل GPU في رف منفصل ب configurations تتراوح بين 64 إلى 256 GPU CPX مستقلة لكل رف. هذا GPU مخصص لحمولات prefill، ي powering الأرفف التي تدير سياقدخل LLMs وعملية معالجة KV cache. NVIDIA تفصل prefill عن decode المهام، مع GPUs CPX ت Handling prefill و GPUs Rubin العادية ت Handling decode. رف tray بـ eight GPUs CPX يمكن أن ي handling 1.34 تيرابايت من prefill السياق الطويل والـ KV cache المرتبط به. بما أن التصميم السابقة لم يكن يحتاج إلى تكامل HBM4، NVIDIA redesigned الحزم، على الأرجح باستخدام TSMC's Co Wo S-S أو Co Wo S-L للpacking. ي delivers الشipe 30 Peta FLOPS من أداء NVFP4 Compute على die أحادي. يشمل أربع NVENC مدمجة وأربع NVDEC مشفرات فيديو مباشرة على الشipe. لـ LLMs التي تحتوي الآن على تريليونات المعلمين، وجود أرفف مخصصة لـ prefill بينما أخرى ت Handling decode يسمح ب {?} أسرع token delivery. NVIDIA توصي أيضًا بال maintaining 1:1 ratio من GPUs CPX إلى GPUs عادية في رف decode.