

Jetbrains · v2 · seit 2026-06-02 · 5× · zuletzt 29. Juni 2026
Mellum2 ist ein von JetBrains entwickeltes, quelloffenes Sprachmodell mit 12 Milliarden Parametern in Mixture-of-Experts-Architektur (64 Experten, davon 8 pro Token aktiv, entsprechend ca. 2,5 Mrd. aktiven Parametern). Es wurde von Grund auf auf natürlicher Sprache und Code trainiert und ist als Nachfolger des reinen Code-Completion-Modells Mellum als "Fokusmodell" für Routing, RAG, Sub-Agenten und private On-Premise-Bereitstellung konzipiert. Das Modell wird unter Apache-2.0-Lizenz mit offenen Gewichten auf Hugging Face bereitgestellt und liefert laut Hersteller mehr als doppelt so schnelle Inferenz wie ähnlich große offene Modelle.
Features
| Basis-Modell | Von Grund auf trainiertes MoE-Modell (12B gesamt, 2,5B aktiv, 64 Experten/8 aktiv pro Token) |
| Kontextgröße | 131.072 Tokens (≈128K); erreicht durch layer-selektives YaRN-Verfahren nach dem Pre-Training. Architektur kombiniert Sliding-Window-Attention (auf 3 von 4 Layern) mit Full-Attention-Layern. |
| Lizenz | Apache 2.0 (offene Gewichte) |
| Plattform | Hugging Face (offene Gewichte), lokal via vLLM/Transformers, Cloud- oder Self-Hosting, JetBrains AI Assistant |
| Preis | Kostenlos (offene Gewichte, Apache 2.0); nur eigene Rechenkosten beim Selbst-Hosting |
| Release-Datum | 1. Juni 2026 |
| Schnittstelle (IDE/CLI/Web) | IDE (JetBrains AI Assistant), CLI/API via vLLM (OpenAI-kompatibel), RAG-/Agent-Pipelines |
| Unterstützte Sprachen | Englisch und alle wichtigen Programmiersprachen (allgemeine Chat-Nutzung) |