Aleph Alphaは、2026年10月3日に英語・ドイツ語対応のオープンウェイト大規模言語モデル(LLM)「Kolibri」をリリースしました。Apache 2.0ライセンスの下で提供されるこのモデルは、Mixture of Experts(MoE)アーキテクチャを採用しており、総パラメータ数は781億で、そのうち1トークンあたり約35億パラメータがアクティブになります。
Aleph Alphaがドイツ語と英語に対応した78BパラメータのオープンウェイトMoEモデル「Kolibri」をリリース
このモデルは「主権」に重点を置いて設計されており、同社はこれを、データプライバシーと制御を確実にするために、欧州およびドイツの法律を遵守し、ドイツとフィンランドのインフラ上で欧州のチームによって開発されることと定義しています。Kolibriは最大1,048,576トークンのコンテキスト長をサポートしており、長文コンテキスト処理中の効率を維持するために、50層のうち40層にスライディングウィンドウ・アテンション機構を採用しています。
ドイツ語の言語的精度を向上させるため、KolibriはUniBPEアルゴリズムを使用した専用のトークナイザーを採用しています。このアプローチにより、モデルはGPT-5のトークナイザーよりも11.2%から15%少ないトークン数でドイツ語のテキストを処理できます。さらに、このモデルはドイツ語で直接推論タスクを実行できるようにトレーニングされており、ドイツ語でプロンプトを入力した場合、AIME 2025などの数学的ベンチマークで高スコアを記録しています。
ハルシネーションを軽減するために、KolibriはMerlin-Arthurプロトコルを組み込んでいます。これは、提供されたコンテキストに情報が不足している場合に、モデルがそれを認識できるように設計されたトレーニング手法です。AA-Omniscienceテストによる評価では、このモデルは答えを知らない場合に約44%の確率で正しくそれを特定しました。
Kolibriのデプロイには、単体のNVIDIA H200、または2枚のNVIDIA A100/H100 80GB GPUなど、少なくとも78GBのGPUメモリを含む大幅なハードウェアリソースが必要です。モデルのウェイトはHugging Faceからダウンロード可能です。
出典
- Show HN: Germany's new sovereign AI model Kolibri (Hacker News Frontpage, 2026-10-03)
- Aleph Alpha