Kolibri positioniert sich als deutsche Alternative zu KI aus den USA und China
Komplett in Deutschland entwickelt.

Image by Insaanu Studio via Unsplash/Illustration by Cybernews
- Aleph Alpha aus Heidelberg veröffentlicht Kolibri, ein in Deutschland entwickeltes zweisprachiges KI-Modell für Unternehmen und Behörden.
- Kolibri verfügt über insgesamt 78,1 Milliarden Parameter und kann lokal betrieben werden, sodass interne Daten nie extern gespeichert werden.
- Laut Aleph Alpha übertraf Kolibri Modelle von Alibaba, Mistral und Nvidia in Tests zu logischem Denken, Programmierung und Informationssuche.
- Beim Verständnis langer Kontexte und beim Abrufen von Informationen liegt Kolibri weiterhin hinter Alibabas Qwen-Modell.
Zentrale Fakten von nexos.ai, geprüft von der Cybernews-Redaktion.
Das neue Open-Weight-Sprachmodell (LLM) für die öffentliche Verwaltung schlägt Konkurrenten von Alibaba und Nvidia.
Das Heidelberger KI-Startup Aleph Alpha hat Kolibri am 3. Oktober 2026, dem Tag der Deutschen Einheit, veröffentlicht.
Kolibri ist ein englisch-deutscher Mixture-of-Experts-Transformer. Das bedeutet, dass er in einzelne Teilnetze, sogenannte „Experten“, aufgeteilt ist. Das Modell nutzt pro Token 3,46 Milliarden aktive Parameter von insgesamt 78,1 Milliarden.
Das Modell wurde gezielt für „souveräne, geschäftskritische Aufgaben“ in regulierten Bereichen wie öffentlicher Verwaltung, Industrie und Luftfahrt entwickelt und berücksichtigt deren „fachspezifische Sprache sowie regulatorische und verfahrenstechnische Gegebenheiten“.
Laut des Unternehmens ermöglicht die geringe, effiziente Größe von Kolibri den lokalen Betrieb, ohne dass interne Daten an externe Inferenzdienste gesendet werden müssen.
Kolibri erfülle laut Aleph Alpha die Vorgaben des EU AI Act, des Verhaltenskodex für KI mit allgemeinem Verwendungszweck und der Datenschutz-Grundverordnung (DSGVO). Das Urheberrecht sei „ein Schwerpunkt unserer Arbeit an vertrauenswürdiger Technologie“.
Das Modell wurde in Deutschland entwickelt und auf Infrastruktur in Deutschland und Finnland nach dem Recht dieser Länder trainiert.
Es wurde gezielt darauf trainiert, „Ich weiß es nicht“ zu antworten, wenn es keine Antwort liefern kann. Das verringert das Risiko von Halluzinationen.
Kolibri wurde als zweisprachiges Modell für Deutsch und Englisch entwickelt, unter anderem mit organischen deutschen Daten: 21,3 % der Tokens im Pre-Training sind deutsch.
„Wir sind mit der Überzeugung ins Jahr gestartet, dass Europa eine eigene souveräne KI braucht. Entwickelt in Deutschland von Grund auf und auf Infrastruktur in Europa, speziell für unsere Kunden“, heißt es in einem X-Beitrag von Aleph Alpha.
Kolibri im Vergleich zu amerikanischen und chinesischen Modellen
Aleph Alpha verglich Kolibri mit drei weiteren Open-Weight-Modellen, die bis zu viermal so viele aktive Parameter haben: Alibaba Qwen 3.6-35B-A3B, Mistral Small 4 119B-A6B und Nvidia Nemotron 3 Super 120B-A12B.
Kolibri übertraf alle Konkurrenten bei mathematischem Denken auf Deutsch und Englisch (Benchmark AIME 2025 und 2026), bei tiefem logischem Denken (GPQA Diamond) und beim Programmieren (LiveCodeBench v6).
Auch bei Benchmarks, die prüfen, wie gut ein KI-Agent große Informationsmengen findet und durchsucht, zeigte sich das Modell überlegen.
Beim Verständnis langer Kontexte und beim Abrufen von Informationen blieb Kolibri jedoch hinter Qwen 3.6-35B-A3B zurück.
Wo kannst du Kolibri herunterladen?
Das Modell steht auf Hugging Face zum Download bereit und darf unter den Bedingungen der Apache-2.0-Lizenz genutzt werden.
Du benötigst das Paket Aleph-Alpha-inference, das das Kolibri-vLLM-Plugin bereitstellt. Das Plugin kannst du hier installieren.
Welche anderen europäischen Alternativen gibt es?
Kolibri erscheint zu einer Zeit, in der Europa nach Alternativen zu US-Technologie sucht, darunter auch zu Produkten führender KI-Labore.
Im Juli veröffentlichte das deutsche Forschungskonsortium Soofi das Open-Source-Sprachmodell Soofi S. Es übertrifft größere Konkurrenten in englischen und deutschen Benchmarks und überzeugt beim Programmieren, in Mathematik und bei regionalem Wissen über Deutschland.
Mimir, ein Modell mit 1 Milliarde Parametern, das die Süddänische Universität und das KI-Unternehmen Ordbogen A/S entwickelt haben, zeigte ebenfalls Fähigkeiten, die mit denen größerer Modelle der Klassen 2 bis 3 und 4 bis 5 Milliarden Parameter vergleichbar sind, darunter Gemma 4 E2B.