

Trinity
#54 in Reasoning-ModelleArcee · 7× · zuletzt 30. Juni 2026
Trinity ist eine Familie offener Reasoning-/Agenten-Sprachmodelle von Arcee AI, bestehend aus Trinity Nano (6B), Trinity Mini (26B) und Trinity Large (ca. 400B, Sparse-MoE mit ~13B aktiven Parametern). Das aktuelle Flaggschiff "Trinity-Large-Thinking" (Release 1. April 2026) ist ein reasoning-optimiertes Modell, das vor der Antwort einen internen "Thinking"-Schritt durchführt, ähnlich wie zuvor Trinity-Mini. Die Modelle werden unter Apache-2.0-Lizenz mit offenen Gewichten auf Hugging Face bereitgestellt und sind zusätzlich über eine Arcee-eigene API sowie OpenRouter nutzbar; Schwerpunkte sind Tool-Use/Function-Calling, mehrstufige Agenten-Workflows und lange Kontextfenster (bis 262K/512K Token, je nach Deployment).
Features
| Key-Benchmark (%) | 91,9 % auf PinchBench (Agenten-Benchmark), Platz 2 hinter Claude Opus 4.6 (93,3 %) |
| Kontextfenster (Token) | 262.144 Token (Arcee API/OpenRouter-Serving), Architektur unterstützt bis zu 512K |
| Lizenz | Apache 2.0 (offene Gewichte, uneingeschränkte kommerzielle Nutzung) |
| Multimodalität | Nein, reines Text-Modell (kein Bild-/Audio-Input) |
| Plattform | Arcee API (OpenAI-kompatibel), OpenRouter, Hugging Face (Open Weights), self-hosted via vLLM/SGLang/llama.cpp auf AWS/GCP/Azure/on-prem |
| Preis pro 1M Token | $0,90 pro 1M Output-Token (Arcee API); OpenRouter: $0,25 Input / $0,80 Output pro 1M Token |
| Release-Datum | 1. April 2026 (Trinity-Large-Thinking); Vorgänger Trinity Mini/Nano: Dezember 2025 |