HeadlinesBriefing HeadlinesBriefing.com

Janus خادم LLM محلي

Hacker News •
×

Janus هو ملف ثنائي Go واحد يشغل نماذج .gguf على جهازك (GPU أو CPU) ويعرض واجهة برمجة تطبيقات متوافقة مع Open AI. لا حاجة لـ Python أو Docker أو Ollama. استخدمه بطريقتك: استدعه من سطر الأوامر (curl, Power Shell, scripts)، وصله بـ Cursor / Cline / أي عميل Open AI — نفس النماذج المحلية، أي سير عمل يناسبك.

ما تحصل عليه يشمل الاستدلال المحلي عبر llama.cpp من خلال Vulkan (AMD / Intel / NVIDIA) أو الرجوع إلى CPU، وواجهة برمجة تطبيقات متوافقة مع Open AI مع نقاط نهاية مثل /v1/chat/completions و /v1/models، وتبديل النماذج دون إعادة تشغيل، ودعم نموذج التفكير مع تقسيم الاستدلال، والكشف التلقائي عن قالب الدردشة من بيانات GGUF الوصفية، وعدم وجود تبعيات — ملف .exe واحد على Windows.

المتطلبات: Windows 10/11 مع Go 1.22+ وGPU يدعم Vulkan موصى به، Linux مع Go 1.22+ وVulkan أو CPU، أو macOS مع Go 1.22+ وCPU backend. مساحة القرص تشمل حجم النموذج (غالبًا 2–8 GB لكل نموذج) بالإضافة إلى ~50 MB لـ Janus + llama.dll. البداية السريعة تتضمن استنساخ المستودع، والبناء باستخدام build.ps1، وتنزيل ملف .gguf، وتكوين ملف .env (مثل INFERENCE_BACKEND=vulkan، JANUS_MODEL_PATH)، وتشغيل الخادم على 127.0.0.1:8990.

تخطيط المشروع يشمل cmd/janus/ للخادم الرئيسي، cmd/modelget/ لتنزيل النماذج، وinternal/engine/ لمشغل llama.cpp Vulkan. تشمل المشاكل ضمان عدم وجود عمليات متبقية تحتل المنفذ 8990، ومسار JANUS_MODEL_PATH الصحيح، وبرامج تشغيل GPU محدثة.

المصدر: Hacker News · لخّصه HeadlinesBriefing