Kolibri ist ein Open-Wight-Large-Language-Modell (LLM) von Aleph Alpha für Deutsch und Englisch: ein Mixture-of-Experts mit 78 Milliarden Parametern, die pro Token nur etwa 3,5 Milliarden verwenden. Am 3. Oktober 2026 unter der Apache-2.0-Lizenz veröffentlicht, sind die Gewichte auf Hugging Face, und es wurde von Grund auf auf Infrastruktur in Deutschland und Finnland trainiert.
Aleph Alpha nennt Kolibri souverän, weil er in Deutschland und Finnland unter europäischem und deutschem Recht ohne ausländische Kontrolle trainiert wurde, und Kunden erhalten volle Bereitstellungsfreiheit und geistigen Eigentumsschutz. Das Modell hat insgesamt 78,1 Milliarden Parameter, pro Token 3,46 Milliarden aktiv, unterstützt nativ einen Kontext von 262.144 Token, und wurde auf etwa 24 Billionen Trainingsdaten trainiert, davon mehr als ein Fünftel Deutsch, auf 768 NVIDIA B200 GPUs. Es schneidet in Aleph Alpha’s Evaluation sowohl für Deutsch als auch für Englisch besser ab als vergleichbare Modelle.
Quelle: Hacker News · Zusammengefasst von HeadlinesBriefing