

Inception Labs · seit Februar 2025 · 5× · zuletzt 29. Juni 2026
Mercury ist eine Familie kommerzieller Diffusions-Sprachmodelle (dLLMs) von Inception Labs, die Text durch parallele Verfeinerung statt sequenzieller Token-für-Token-Generierung erzeugen. Das Unternehmen bewirbt Mercury als schnellste kommerzielle dLLM-Reihe mit über 1000 Tokens/Sekunde auf Standard-NVIDIA-GPUs bei laut Anbieter frontier-naher Qualität. Mercury wird primär über eine OpenAI-kompatible API sowie über Cloud-Partner (AWS Bedrock, Azure AI Foundry) angeboten und in IDE-Integrationen (z.B. Zed, Continue) sowie Coding-Workflows (Autocomplete, Next-Edit) eingesetzt. Aktuellstes Modell ist Mercury 2, eine "reasoning"-Variante mit einstellbaren Reasoning-Stufen; Mercury 1 wird nur noch für Bestandskunden unterstützt.
Features
| Basis-Modell | Eigene Diffusions-Transformer-Architektur (dLLM), kein autoregressives Basismodell; Parametergröße nicht offengelegt |
| Lizenz | Proprietäres, kommerzielles Modell (API-Zugang, kein Open Source) |
| Plattform | Inception API-Plattform, AWS Bedrock, SageMaker JumpStart, Azure AI Foundry, OpenRouter |
| Preis | Mercury 2: $0,25 / 1M Input-Tokens, $0,75 / 1M Output-Tokens (Mercury 1: $0,25 / $1,00); 10 Mio. Gratis-Tokens bei Kontoerstellung |
| Release-Datum | Februar 2025 (Mercury/Mercury Coder); Mercury 2 am 4. März 2026 |
| Schnittstelle (IDE/CLI/Web) | OpenAI-kompatible REST-API, Chat-Web-Oberfläche (Mercury Chat), IDE-Integrationen (u.a. Zed, Continue, VSCode) |
| Unterstützte Sprachen | Python, JavaScript, Java, TypeScript, Bash, SQL, C, C++, PHP, HTML u.a. |