HeadlinesBriefing HeadlinesBriefing 12 languages

Kolibri: A Sovereign Open-Weight Model

Hacker News ·

🇬🇧 English

Research Aleph Alpha On German Reunification Day, the AI company Aleph Alpha released Kolibri, a new open-weight Mixture-of-Experts Transformer model with 78B total parameters and 3B active parameters. The model supports context lengths of up to 1M tokens and is released under the Apache 2.0 license via Hugging Face. Kolibri represents a significant evolution from the company's earlier Kolibri Origin model, a 30B parameter model with a 65k token context window.

The development team leveraged a robust training pipeline to run hundreds of ablation experiments and achieve stable pre-training despite hardware failures. Kolibri is specialized for German language, reasoning, math, and agentic behavior, targeting sovereign mission-critical work in regulated sectors like public administration, industrials, and aerospace. The model optimizes the trade-off between capability and deployment costs, positioning itself on the Pareto frontier for quality versus serving cost in both English and German.

Aleph Alpha emphasizes full supply-chain integrity and transparency, offering customers deployment freedom and intellectual-property safety as inherited compliance properties. The model's small and efficient size allows it to run effectively on-premise, avoiding the need to send internal data to third-party inference services. Read the full tech report for detailed benchmark analysis.

View original article →


🇸🇦 العربية

Aleph Alpha تصدر نموذج الوزن المفتوح السيادي Kolibri

بحث Aleph Alpha في يوم وحدة ألمانيا، شركة الذكاء الاصطناعي Aleph Alpha أطلقت Kolibri، نموذج ترانسفورمر مفتوح الوزن جديد مبني على مزيج الخبراء بمعلمات إجمالية تبلغ 78B ومعلمات نشطة تبلغ 3B. يدعم النموذج طول سياق يصل إلى 1M رمز ويتم إصداره بموجب رخصة Apache 2.0 عبر Hugging Face. يمثل Kolibri تطورًا كبيرًا من نموذج Kolibri Origin السابق للشركة، وهو نموذج بمعلمات 30B ونافذة سياق تبلغ 65k رمزًا. استخدم فريق التطوير خط معالجة تدريب قوي لتشغيل مئات التجارب الاستبدالية وتحقيق تدريب أولي ثابت على الرغم من فشل العتاد. يتخصص Kolibri في اللغة الألمانية، والاستنتاج، والرياضيات، والسلوك العقدي، موجه للعمل الحاسم السيادي في قطاعات منظمة مثل الإدارة العامة، والصناعات، والفضاء. يحسن النموذج التوازن بين القدرة والتكاليف النشر، موقع نفسه على الحدود باريتو للجودة مقابل تكلفة الخدمة في كل من الإنجليزية والألمانية. تؤكد Aleph Alpha على سلامة وشفافية سلسلة التوريد الكاملة، وتقدم للعملاء حرية النشر وأمان الملكية الفكرية كخصائص امتثال موروثة. يتيح للنموذج بفضل حجمه الصغير والكفاءة العالية له أن يعمل بشكل فعال على الصعيد المحلي، تجنب الحاجة إلى إرسال بيانات داخلية إلى خدمات استنتاج الطرف الثالث. اقرأ التقرير التقني الكامل لتحليل بنقاط المرجع المفصلة.

ما هي القدرات الرئيسية لنموذج Kolibri الخاص بـ Aleph Alpha؟

Kolibri نموذج ترانسفورمر مزيج الخبراء بمعلمات 78B مع 3B معلمة نشطة، يدعم طول سياق يصل إلى 1M رمز. يتخصص في اللغة الألمانية، والاستنتاج، والرياضيات، والسلوك العقدي، محسّن للعمل الحاسم السيادي في قطاعات منظمة مثل الإدارة العامة والفضاء. يحقق النموذج جودة مثلى باريتو مقابل تكلفة الخدمة ويمكن نشره على الصعيد المحلي بموجب رخصة Apache 2.0.

العربية version →


🇧🇩 বাংলা

Aleph Alpha স্বরাজ্য ওপেন-ওজন মডেল Kolibri প্রকাশ করে

গবেষণা Aleph Alpha জার্মানির ঐক্য দিবসে, AI কোম্পানি Aleph Alpha এর Kolibri প্রকাশ করা হয়েছে, যা একটি নতুন ওপেন-ওজন Mixture-of-Experts Transformer মডেল যার 78B মোট প্যারামিটার এবং 3B সক্রিয় প্যারামিটার। মডেল 1M টোকেন পর্যন্ত সংদর্ভের দৈর্ঘ্য সমর্থন করে এবং Hugging Face এর মাধ্যমে Apache 2.0 লাইসেন্সের অধীনে প্রকাশ করা হয়। Kolibri কোম্পানির আগের Kolibri Origin মডেল থেকে একটি উল্লেখযোগ্য বিবর্তন উপস্থাপন করে, যা একটি 30B প্যারামিটার মডেল যার সংদর্ভ খিড়ায় 65k টোকেন। বিকাশ দল হার্ডওয়্যার ব্যর্থতার মধ্যে স্থিতিশীল প্রি-ট্রেনিং অর্জনের জন্য একটি শক্তিশালী প্রশিক্ষণ পাইপলাইন ব্যবহার করে সদ্দন অ্যাব্লেশন পরীক্ষা চালায়। Kolibri জার্মান ভাষা, যুক্তি, গণিত এবং এজেন্ট আচরণের জন্য বিশেষজ্ঞ, যা সরকারি প্রশাসন, শিল্প এবং বিমান ও অনুপ্রান্ত আকাশ যান বাহিনীর মতো নিয়ন্ত্রিত সেক্টরে স্বরাজ্য মিশন-গুরুত্বপূর্ণ কাজের লক্ষ্য করে। মডেল ক্ষমতা এবং স্থাপনা খরচের মধ্যে ব্যবস্থাপনা করে, যা গুণমানের বিপরীতে পরিসেবা খরচের জন্য পারেটো সীমানা নির্ধারণ করে ইংরেজি এবং জার্মানি উভয় ভাষায়। Aleph Alpha পূর্ণ সরবরাহ শ্রেণীর অখণ্ডতা এবং স্বচ্ছতা জোর দেয়, গ্রাহকদের স্থাপনা স্বাধীনতা এবং বৌদ্ধিক সম্পদ সুরক্ষা প্রদান করে যা একটি উত্তরাধিকার অনুপালন বৈশিষ্ট্য। মডেলের ছোট এবং দক্ষ আকার এটিকে কার্যকরভাবে প্রিমিসেসে চালাতে দেয়, অভ্যন্তরীণ ডেটা তৃতীয় পক্ষের অনুমান পরিষেবায় পাঠানোর প্রয়োজন থেকে মুক্তি দেয়। বিস্তারিত বেঞ্চমার্ক বিশ্লেষণের জন্য পূর্ণ টেক রিপোর্ট পড়ুন।

Aleph Alpha-এর Kolibri মডেলের মূল ক্ষমতাগুলি কী?

Kolibri একটি 78B প্যারামিটার ভিত্তিক Mixture-of-Experts Transformer মডেল, যার 3B সক্রিয় প্যারামিটার এবং 1M টোকেন পর্যন্ত সংদর্ভের দৈর্ঘ্য সমর্থন করে। এটি জার্মান ভাষা, যুক্তি, গণিত এবং এজেন্ট আচরণের জন্য বিশেষজ্ঞ, সরকারি প্রশাসন এবং বিমান ও অনুপ্রান্ত আকাশ যান বাহিনীর মতো নিয়ন্ত্রিত সেক্টরে স্বরাজ্য মিশন-গুরুত্বপূর্ণ কাজের জন্য অপ্টিমাইজড। মডেল পরিসেবা খরচের বিপরীতে গুণমানের জন্য পারেটো-অপটিমাল অর্জন করে এবং Apache 2.0 লাইসেন্সের অধীনে প্রিমিসেসে স্থাপন করা যেতে পারে।

বাংলা version →


🇩🇪 Deutsch

Aleph Alpha veröffentlicht souverälles Open-Weight-Modell Kolibri

Forschung Aleph Alpha Am Tag der Deutschen Einheit veröffentlichte das KI-Unternehmen Aleph Alpha Kolibri, ein neues Open-Weight-Mixture-of-Experts-Transformer-Modell mit 78B Gesamtparametern und 3B aktiven Parametern. Das Modell unterstützt Kontextlängen von bis zu 1M Tokens und wird über Hugging Face unter der Apache 2.0-Lizenz veröffentlicht. Kolibri repräsentiert eine bedeutende Entwicklung vom früheren Modell der Firma Kolibri Origin, ein 30B-Parameter-Modell mit einem 65k-Token-Kontextfenster.

Das Entwicklungsteam nutzte eine robuste Trainings-Pipeline, um Hunderte von Ablationsversuchen durchzuführen und trotz Hardware-Ausfällen ein stabiles Pre-Training zu erreichen. Kolibri ist auf Deutsch, Reasoning, Mathematik und agentisches Verhalten spezialisiert und zielt auf souveräne, kritische Aufgaben in regulierten Sektoren wie der öffentlichen Verwaltung, der Industrie und der Luft- und Raumfahrt ab. Das Modell optimiert den Trade-off zwischen Leistungsfähigkeit und Implementierungskosten und positioniert sich auf der Pareto-Front für Qualität im Vergleich zu Service-Kosten sowohl im Englischen als auch im Deutschen.

Aleph Alpha legt Wert auf vollständige Integrität und Transparenz der Lieferkette und bietet Kunden Implementierungsfreiheit und Schutz des geistigen Eigentums als ererbte Compliance-Eigenschaften. Die kleine und effiziente Größe des Modells ermöglicht es, effektiv vor Ort eingesetzt zu werden und die Notwendigkeit, interne Daten an Drittanbieter-Inferenzdienste zu senden, zu vermeiden. Lesen Sie den vollständigen Tech-Bericht für eine detaillierte Benchmark-Analyse.

Welche sind die wichtigsten Fähigkeiten des Kolibri-Modells von Aleph Alpha?

Kolibri ist ein 78B-Parameter-Mixture-of-Experts-Transformer mit 3B aktiven Parametern, der Kontextlängen von bis zu 1M Tokens unterstützt. Es ist auf Deutsch, Reasoning, Mathematik und agentisches Verhalten spezialisiert und für souveräne, kritische Aufgaben in regulierten Sektoren wie der öffentlichen Verwaltung und der Luft- und Raumfahrt optimiert. Das Modell erreicht eine Pareto-optimale Qualität im Vergleich zu den Service-Kosten und kann vor Ort unter der Apache 2.0-Lizenz implementiert werden.

Deutsch version →


🇪🇸 Español

Aleph Alpha publica el modelo de peso abierto soberano Kolibri

Investigación Aleph Alpha En el Día de la Reunificación Alemana, la empresa de IA Aleph Alpha publicó Kolibri, un nuevo modelo Transformer de peso abierto basado en mezcla de expertos con 78B parámetros totales y 3B parámetros activos. El modelo admite longitudes de contexto de hasta 1M tokens y se publica bajo la licencia Apache 2.0 a través de Hugging Face. Kolibri representa una evolución significativa desde el anterior modelo Kolibri Origin de la empresa, un modelo de 30B parámetros con una ventana de contexto de 65k tokens.

El equipo de desarrollo aprovechó una canalización de entrenamiento robusta para ejecutar cientos de experimentos de ablación y lograr un preentrenamiento estable a pesar de fallos en el hardware. Kolibri está especializado en lenguaje alemán, razonamiento, matemáticas y comportamiento agente, dirigido a trabajos soberanos críticos en sectores regulados como la administración pública, las industrias y la aeroespacial. El modelo optimiza la relación entre capacidad y costos de implementación, posicionándose en la frontera de Pareto para calidad frente al costo de servicio tanto en inglés como en alemán.

Aleph Alpha enfatiza la plena integridad y transparencia de la cadena de suministro, ofreciendo a los clientes libertad de implementación y seguridad de propiedad intelectual como propiedades de cumplimiento heredadas. El pequeño y eficiente tamaño del modelo permite que funcione eficazmente en las instalaciones, evitando la necesidad de enviar datos internos a servicios de inferencia de terceros. Lea el informe técnico completo para obtener un análisis detallado de los resultados.

¿Cuáles son las capacidades clave del modelo Kolibri de Aleph Alpha?

Kolibri es un modelo Transformer de mezcla de expertos de peso abierto de 78B parámetros con 3B parámetros activos, que admite longitudes de contexto de hasta 1M tokens. Está especializado en lenguaje alemán, razonamiento, matemáticas y comportamiento agente, optimizado para trabajos soberanos críticos en sectores regulados como la administración pública y la aeroespacial. El modelo alcanza una calidad óptima de Pareto frente al costo de servicio y puede implementarse en las instalaciones bajo la licencia Apache 2.0.

Español version →


🇫🇷 Français

Aleph Alpha publie le modèle ouvert souverain Kolibri

Recherche Aleph Alpha Le jour de la Réunification allemande, l'entreprise d'IA Aleph Alpha a publié Kolibri, un nouveau modèle Transformer ouvert basé sur un mélange d'experts avec 78B paramètres au total et 3B paramètres actifs. Le modèle prend en charge des longueurs de contexte allant jusqu'à 1M tokens et est publié sous licence Apache 2.0 via Hugging Face. Kolibri représente une évolution significative par rapport au modèle Kolibri Origin précédent de l'entreprise, un modèle de 30B paramètres avec une fenêtre de contexte de 65k tokens.

L'équipe de développement a exploité un pipeline d'entraînement robuste pour exécuter des centaines d'expériences d'ablations et obtenir un pré-entraînement stable malgré des pannes matérielles. Kolibri est spécialisé dans la langue allemande, le raisonnement, les mathématiques et le comportement agentique, ciblant un travail souverain critique dans des secteurs réglementés tels que l'administration publique, les industries et l'aérospatiale. Le modèle optimise le compromis entre capacité et coûts de déploiement, se positionnant sur la frontière de Pareto pour la qualité par rapport au coût de service en anglais et en allemand.

Aleph Alpha met l'accent sur l'intégrité et la transparence de toute la chaîne d'approvisionnement, offrant aux clients la liberté de déploiement et la sécurité de la propriété intellectuelle comme propriétés de conformité héritées. La petite taille et l'efficacité du modèle lui permettent de fonctionner efficacement sur site, évitant la nécessité d'envoyer des données internes aux services d'inférence de tiers. Lisez le rapport technique complet pour une analyse détaillée des références.

Quelles sont les capacités clés du modèle Kolibri d'Aleph Alpha ?

Kolibri est un modèle Transformer à experts mélangés ouvert de 78B paramètres avec 3B paramètres actifs, prenant en charge des longueurs de contexte allant jusqu'à 1M tokens. Il est spécialisé dans la langue allemande, le raisonnement, les mathématiques et le comportement agentique, optimisé pour un travail souverain critique dans des secteurs réglementés tels que l'administration publique et l'aérospatiale. Le modèle atteint une qualité optimale de Pareto par rapport au coût de service et peut être déployé sur site sous licence Apache 2.0.

Français version →


🇮🇳 हिन्दी

Aleph Alpha ने स्वराज्य ओपन-वेट मॉडल Kolibri जारी किया

अनुसंधान Aleph Alpha जर्मनी के एकीकरण दिवस पर, AI कंपनी Aleph Alpha ने Kolibri जारी किया, एक नई ओपन-वेट Mixture-of-Experts Transformer मॉडल जिसमें 78B कुल पैरामीटर और 3B सक्रिय पैरामीटर हैं। यह मॉडल 1M टोकन तक की संदर्भ लंबाई का समर्थन करता है और Hugging Face के माध्यम से Apache 2.0 लाइसेंस के तहत जारी किया गया है। Kolibri कंपनी के पहले से ही Kolibri Origin मॉडल के विकास से एक महत्वपूर्ण विकृति का प्रतिनिधित्व करता है, जो एक 30B पैरामीटर मॉडल है जिसकी संदर्भ खिड़ाई 65k टोकन है। विकास टीम ने हार्डवेयर की विफलता के बावजूद स्थिर प्री-ट्रेनिंग प्राप्त करने के लिए सैकड़ों एब्लेशन प्रयोग चलाने के लिए एक मजबूत प्रशिक्षण पाइपलाइन का उपयोग किया। Kolibri जर्मन भाषा, तर्कशक्ति, गणित और एजेंट व्यवहार के लिए विशेषज्ञ है, जो सार्वजनिक प्रशालन, औद्योगिक और विमानन एवं अंतरिक्ष क्षेत्रों जैसे नियमित क्षेत्रों में स्वराज्य मिशन-क्रिटिकल कार्य को लक्षित करता है। यह मॉडल क्षमता और परिनिर्देशन लागत के बीच के व्यापार को अनुकूलित करता है, जो गुणवत्ता के विपरीत सेवा लागत के लिए पेयरो फ्रंटियर पर स्थित है, भारत और जर्मनी दोनों में। Aleph Alpha पूरी आपूर्ति श्रृंखला की पूर्णता और पारदर्शिता पर जोर देता है, ग्राहकों को परिनिर्देशन की आज़ादी और बौद्धिक संपदा सुरक्षा प्रदान करता है जो एक विरासती अनुपालन गुण है। मॉडल का छोटा और दक्ष आकार इसे प्रभावी ढंग से ऑन-प्रिमाइस चलाने की अनुमति देता है, जिससे आंतरिक डेटा को तीसरे पक्ष के अनुमान सेवाओं को भेजने की आवश्यकता नहीं होती है। विस्तृत बेंचमार्क विश्लेषण के लिए पूरा तकनीकी रिपोर्ट पढ़ें।

Aleph Alpha के Kolibri मॉडल की प्रमुख क्षमताएँ क्या हैं?

Kolibri एक 78B पैरामीटर वाला Mixture-of-Experts Transformer मॉडल है जिसमें 3B सक्रिय पैरामीटर हैं और जो 1M टोकन तक की संदर्भ लंबाई का समर्थन करता है। यह जर्मन भाषा, तर्कशक्ति, गणित और एजेंट व्यवहार के लिए विशेषज्ञ है, जो सार्वजनिक प्रशालन और विमानन एवं अंतरिक्ष क्षेत्रों जैसे नियमित क्षेत्रों में स्वराज्य मिशन-क्रिटिकल कार्य के लिए अनुकूलित है। मॉडल सेवा लागत के विपरीत गुणवत्ता के लिए पेयरो-अनुकूल गुणवत्ता प्राप्त करता है और Apache 2.0 लाइसेंस के तहत ऑन-प्रिमाइस परिनिर्देशन के लिए सक्षम है।

हिन्दी version →


🇮🇩 Bahasa Indonesia

Aleph Alpha Merilis Model Open-Weight Sovereign Kolibri

Penelitian Aleph Alpha Pada Hari Reunifikasi Jerman, perusahaan AI Aleph Alpha merilis Kolibri, model Transformer open-weight Mixture-of-Experts baru dengan 78B parameter total dan 3B parameter aktif. Model ini mendukung panjang konteks hingga 1M token dan dirilis di bawah lisensi Apache 2.0 melalui Hugging Face. Kolibri mewakili evolusi signifikan dari model sebelumnya perusahaan Kolibri Origin, sebuah model dengan 30B parameter dan jendela konteks 65k token.

Tim pengembang memanfaatkan pipeline pelatihan yang tangguh untuk menjalankan ratusan eksperimen ablasi dan mencapai pelatihan pra-stabilisasi yang stabil meskipun terjadi kegagalan perangkat keras. Kolibri dioptimalkan untuk bahasa Jerman, penalaran, matematika, dan perilaku ajan, menargetkan pekerjaan kritis kedaulatan dalam sektor yang diatur seperti administrasi publik, industri, dan aeroangkasa. Model mengoptimalkan kompromi antara kemampuan dan biaya penerapan, memosisikan dirinya di batas Pareto untuk kualitas versus biaya layanan dalam bahasa Inggris dan Jerman.

Aleph Alpha menekankan integritas dan transparansi pasokan penuh, menawarkan kebebasan penerapan dan keamanan kekayaan intelektual sebagai properti kepatuhan yang diwarisi. Ukuran model yang kecil dan efisien memungkinkan ia berjalan secara efektif secara on-premise, menghindari kebutuhan untuk mengirimkan data internal ke layanan inferensi pihak ketiga. Baca laporan teknis lengkap untuk analisis pengukuran rinci.

Apa kemampuan utama model Kolibri dari Aleph Alpha?

Kolibri adalah model Transformer Mixture-of-Experts open-weight dengan 78B parameter dan 3B parameter aktif, yang mendukung panjang konteks hingga 1M token. Ia dioptimalkan untuk bahasa Jerman, penalaran, matematika, dan perilaku ajan, ditujukan untuk pekerjaan kritis kedaulatan dalam sektor yang diatur seperti administrasi publik dan aeroangkasa. Model mencapai kualitas Pareto-optimal versus biaya layanan dan dapat diterapkan secara on-premise di bawah lisensi Apache 2.0.

Bahasa Indonesia version →


🇯🇵 日本語

Aleph Alpha、主権的オープンウェイトモデルKolibriをリリース

研究 Aleph Alpha ドイツの再統一記念日に、AI企業Aleph Alphaは、合計78Bパラメータと3Bアクティブパラメータを持つ新しいオープンウェイトMixture-of-Experts TransformerモデルであるKolibriをリリースしました。このモデルは最大1Mトークンのコンテキスト長をサポートし、Hugging Faceを通じてApache 2.0ライセンスの下にリリースされています。Kolibriは、会社の以前のKolibri Originモデル、すなわち30Bパラメータモデルで65kトークンのコンテキストウィンドウを備えたモデルからの significantな進化を表しています。開発チームは、数百回のアブレーション実験を実行し、ハードウェアの障害にもかかわらず安定した事前トレーニングを達成するために、堅牢なトレーニングパイプラインを活用しました。Kolibriは、ドイツ語、推論、数学、エージェント行動に特化しており、公共行政、産業、航空宇宙などの規制されたセクターで主権的なミッションクリティカルな作業を対象としています。このモデルは、能力とデプロイメントコストのトレードオフを最適化し、英語とドイツ語の両方で品質対サービングコストのパレートフロンティアに位置しています。Aleph Alphaは、完全なサプライチェーンの整合性と透明性を強調し、顧客にデプロイメントの自由と知的財産の安全性を継承されたコンプライアンスプロパティとして提供しています。モデルの小さく効率的なサイズにより、オンプレミスで効果的に実行でき、内部データをサードパーティの推論サービスに送信する必要がなくなります。詳細なベンチマーク分析については、完全なテックレポートをお読みください。

Aleph AlphaのKolibriモデルの主要な機能は何ですか?

Kolibriは、3Bのアクティブパラメータを持つ78BパラメータのMixture-of-Experts Transformerであり、最大1Mトークンのコンテキスト長をサポートします。ドイツ語、推論、数学、エージェント行動に特化しており、公共行政や航空宇宙などの規制されたセクターで主権的なミッションクリティカルな作業に最適化されています。このモデルは、サービングコストに対するパレート最適品質を達成し、Apache 2.0ライセンスの下でオンプレミスにデプロイできます。

日本語 version →


🇧🇷 Português

Aleph Alpha lança modelo de peso aberto soberano Kolibri

Pesquisa Aleph Alpha No Dia da Reunificação Alemã, a empresa de IA Aleph Alpha lançou Kolibri, um novo modelo Transformer de peso aberto baseado em mistura de especialistas com 78B parâmetros totais e 3B parâmetros ativos. O modelo suporta comprimentos de contexto de até 1M tokens e é lançado sob a licença Apache 2.0 por meio do Hugging Face. Kolibri representa uma evolução significativa em relação ao modelo anterior Kolibri Origin da empresa, um modelo de 30B parâmetros com uma janela de contexto de 65k tokens.

A equipe de desenvolvimento aproveitou um pipeline de treinamento robusto para executar centenas de experimentos de ablação e alcançar um pré-treinamento estável apesar de falhas de hardware. Kolibri é especializado em língua alemã, raciocínio, matemática e comportamento agente, direcionado a trabalhos soberanos críticos em setores regulados como administração pública, indústrias e aeroespacial. O modelo otimiza a relação entre capacidade e custos de implantação, posicionando-se na fronteira de Pareto para qualidade versus custo de serviço tanto em inglês quanto em alemão.

Aleph Alpha enfatiza a plena integridade e transparência da cadeia de suprimentos, oferecendo aos clientes liberdade de implantação e segurança de propriedade intelectual como propriedades de conformidade herdadas. O pequeno e eficiente tamanho do modelo permite que ele funcione efetivamente no local, evitando a necessidade de enviar dados internos para serviços de inferência de terceiros. Leia o relatório técnico completo para uma análise detalhada dos benchmarks.

Quais são as principais capacidades do modelo Kolibri da Aleph Alpha?

Kolibri é um modelo Transformer de mistura de especialistas aberto de 78B parâmetros com 3B parâmetros ativos, suportando comprimentos de contexto de até 1M tokens. É especializado em língua alemã, raciocínio, matemática e comportamento agente, otimizado para trabalhos soberanos críticos em setores regulados como administração pública e aeroespacial. O modelo atinge qualidade ótima de Pareto versus custo de serviço e pode ser implantado no local sob a licença Apache 2.0.

Português version →


🇷🇺 Русский

Aleph Alpha выпускает суверенную модель открытого веса Kolibri

Исследование Aleph Alpha В День объединения Германии, ИИ-компания Aleph Alpha выпустила Kolibri — новую модель открытого веса на основе смешанных экспертов Transformer с 78 миллиардами параметров в сумме и 3 миллиардами активных параметров. Модель поддерживает длину контекста до 1 миллиона токенов и выпущена под лицензией Apache 2.0 через Hugging Face. Kolibri представляет собой значительное развитие по сравнению с более ранней моделью компании Kolibri Origin — модель с 30 миллиардами параметров и окном контекста 65 тысяч токенов. Команда разработки использовала мощный конвейер обучения для проведения сотен экспериментов по отжигу и достижения стабильного предобучения несмотря на сбои оборудования. Kolibri специализируется на немецком языке, логике, математике и агентном поведении, ориентируясь на суверенную критически важную работу в регулируемых секторах, таких как государственное управление, промышленность и космонавтика. Модель оптимизирует компромисс между мощностью и затратами на развертывание, позиционируя себя на границе Парето по качеству по сравнению с затратами на обслуживание как на английском, так и на немецком языке.

Aleph Alpha подчеркивает полную целостность и прозрачность цепочки поставок, предлагая клиентам свободу развертывания и защиту интеллектуальной собственности как унаследованные свойства соответствия. Малый и эффективный размер модели позволяет ей эффективно работать на месте, избегая необходимости отправки внутренних данных в сервисы вывода третьих сторон. Прочтите полный технический отчет для подробного анализа эталонов.

Какие ключевые возможности модели Kolibri от Aleph Alpha?

Kolibri — это модель трансформера смешанных экспертов открытого веса с 78 миллиардами параметров и 3 миллиардами активных параметров, поддерживающая длину контекста до 1 миллиона токенов. Она специализируется на немецком языке, логике, математике и агентном поведении, оптимизирована для суверенной критически важной работы в регулируемых секторах, таких как государственное управление и космонавтика. Модель достигает Парето-оптимального качества по сравнению со стоимостью обслуживания и может быть развернута на месте под лицензией Apache 2.0.

Русский version →


🇨🇳 简体中文

Aleph Alpha发布主权开放权重模型Kolibri

研究 Aleph Alpha 在德国统一日,AI公司Aleph Alpha发布了Kolibri,一款新的开放权重混合专家Transformer模型,总参数量为78B,活跃参数量为3B。该模型支持高达1M token的上下文长度,并通过Hugging Face在Apache 2.0许可下发布。Kolibri代表了该公司早期Kolibri Origin模型的一次重要进化,这是一款30B参数模型,上下文窗口为65k token。开发团队利用强大的训练流程运行了数百次消融实验,并在硬件故障面前实现了稳定的预训练。Kolibri专注于德语、推理、数学和代理行为,面向公共行政、工业和航空航天等监管严格的领域开展主权级的关键任务工作。该模型在能力与部署成本之间进行了优化,在英语和德语中都处于质量与服务成本的帕累托前沿。Aleph Alpha强调完全的供应链完整性和透明度,为客户提供部署自由和知识产权安全作为继承的合规属性。该模型小而高效的大小使其能够在本地有效运行,避免将内部数据发送到第三方推理服务。阅读完整的技术报告以获取详细的基准分析。

Aleph Alpha的Kolibri模型有哪些关键能力?

Kolibri是一款78B参数的混合专家Transformer模型,具有3B活跃参数,支持高达1M token的上下文长度。它专注于德语、推理、数学和代理行为,针对公共行政和航空航天等监管严格的领域的主权级关键任务工作进行了优化。该模型在质量与服务成本之间实现了帕累托最优,并可在Apache 2.0许可下本地部署。

简体中文 version →