HeadlinesBriefing favicon HeadlinesBriefing.com

مُحسّن نواة CUDA الوكيل مع LangGraph

Hacker News •
×

يقدم هذا المشروع مُحسّن نواة CUDA الوكيل الذي يحول وصفات أعباء العمل إلى تنفيذات GPU من خلال توليد código تلقائي، فحوصات صحة، اختبارات أداء، وتحسين. مدعوم بـ LangGraph، يستكشف الوكيل تنفيذات النواة وتكوينات الإطلاق، ويستفسر عن خصائص GPU، ويمكنه البحث في وثائق NVIDIA للحصول على إرشادات التحسين. كما يفحص عدادات Nsight Compute لتوجيه تجربته التالية. يتم تسجيل كل تجربة، ويتم الاحتفاظ بأسرع تنفيذ تم التحقق منه.

يمكن للنموذج تغيير كل من كود النواة وتكوينات الإطلاق لكل حالة. يستخدم حزام C++ مستقل NVRTC لترجمة النواة، ويطلقها عبر واجهة برمجة تطبيقات تشغيل CUDA، ويحفظ المخرجات. يتعامل بايثون مع المقارنة واختيار المرشحين. يتطلب النظام Python 3.12+، ووحدة معالجة رسومات NVIDIA، ومجموعة أدوات/محرك CUDA متوافق، بالإضافة إلى CMake 3.24+ ومترجم C++17. يتضمن الإعداد إنشاء بيئة افتراضية، تثبيت التبعيات، وتكوين البناء باستخدام Visual Studio 2026.

يمكن للمستخدمين تشغيل المحسّن بوصف حمل عمل، مثل "GEMM أحادية الدقة مع مصفوفات مستطيلة"، وتحديد عدد أقصى للتكرارات. النموذج الافتراضي هو gpt-5-mini بجهد استدلال متوسط، ويتم فرض رسوم استخدام واجهة برمجة التطبيقات على حساب المستخدم. تفعيل العلامات الاختيارية يُمكّن من التحليل باستخدام Nsight Compute واسترداد إرشادات البحث من NVIDIA قبل توليد النواة.

الكيانات الرئيسية: الشركات: NVIDIA, OpenAI | المواقع: Windows, RTX 3060 Laptop GPU

الأسئلة الشائعة: ما هو مُحسّن نواة CUDA الوكيل؟

هو نظام يستخدم وكلاء الذكاء الاصطناعي لتوليد، اختبار، وتحسين نواة CUDA تلقائيًا بناءً على وصفات أعباء العمل، مستفيدًا من LangGraph لإدارة سير العمل وNsight Compute لأداء التحليل.