Kolibri是由Aleph Alpha开发的开放权重大型语言模型(LLM),专为德语和英语设计:一种仅在读写每个token时使用约35亿参数的混合专家模型,总参数量780亿。它于2026年10月3日发布,采用Apache 2.0许可证,权重托管在Hugging Face上,且完全在德国和芬兰的基础设施上从头训练而成。Aleph Alpha将Kolibri称为主权AI,意指其在德国和芬兰依据欧洲和德国法律训练,无外国控制,客户可获得完全的部署自由和知识产权安全。该模型总参数量781亿,每个token激活346亿,原生支持262144个token上下文,训练数据约为24万亿token,其中五分之一来自德语,训练时使用了768块NVIDIA B200 GPU。在Aleph Alpha的评估中,该模型在德语和英语方面均优于可比模型。
来源: Hacker News · 由HeadlinesBriefing整理摘要