JetBrains Mellum2: Quelloffenes 12B-MoE-Modell für schnelle Aufgaben
KI-generiert mit ChatGPT
JetBrains hat Mellum2 veröffentlicht, ein quelloffenes Modell mit Mixture-of-Experts-Architektur und 12 Milliarden Parametern. Es ist nicht als Allzweckmodell gedacht, sondern für schnelle, klar umrissene Aufgaben innerhalb größerer KI-Systeme. Besagtes Modell steht unter der Apache-2.0-Lizenz und ist auf Hugging Face verfügbar.
Eine Mixture-of-Experts-Architektur teilt ein Modell in zahlreiche Subnetze auf. Bei Mellum2 sind es ingesamgt 64 der sogenannten Experten. Pro Token werden laut JetBrains nur acht davon aktiviert. Dadurch werden nicht alle 12 Milliarden Parameter gleichzeitig genutzt. Pro Token rechnet das Modell nur mit rund 2,5 Milliarden aktiven Modellgewichten.
Was Mellum2 kann und wofür es gedacht ist
JetBrains positioniert Mellum2 nicht als Ersatz für große Spitzenmodelle. JetBrains beschreibt es im eigenen Blog als fokales Modell. Gemeint ist eine schnelle, spezialisierte Komponente innerhalb größerer Systeme. Typische Aufgaben sind Routing, das Zusammenfassen von Inhalten und Zwischenschritte beim Schlussfolgern.
Der Vorgänger Mellum war ein reines Modell für die Code-Vervollständigung mit 4 Milliarden Parametern. Mellum2 verarbeitet laut JetBrains sowohl natürliche Sprache als auch Code. Das Kontextfenster umfasst laut Hugging Face 131.072 Token. JetBrains veröffentlicht mehrere Varianten, darunter eine Instruct- und eine Thinking-Version.
Der Fokus liegt auf niedriger Latenz und hohem Durchsatz. Laut The New Stack erreicht Mellum2 unter Last einen deutlichen Vorsprung gegenüber vergleichbaren Modellen. Das Modell lässt sich lokal betreiben, selbst hosten oder für eigene Anwendungen anpassen.
Warum das für die Modellauswahl wichtig ist
Mellum2 ist für alle interessant, die das passende Modell für Agenten-Workflows suchen. Wer dabei den Überblick behalten will, findet bei uns einen Vergleich zur Modellauswahl aus über 500 KI-Modellen für OpenClaw. Die offene Lizenz erlaubt auch den kommerziellen Einsatz.
Mit dem Schritt reiht sich JetBrains in eine Reihe offener Modelle ein. Erst kürzlich startete Mistral Medium 3.5 Coding-Agenten in der Cloud. Auch Gemma 4 von Google erschien unter Apache 2.0. Mellum2 setzt mit seinem Fokus auf Geschwindigkeit einen eigenen Akzent.
Server, KI-Modelle und Recherche kosten Geld. ClawNews ist unabhängig — hilf mit, dass das so bleibt.



