

Shieldstral
#14 in Multimodale ModelleMistral AI · 6× · zuletzt 05. Aug. 2026
Shieldstral ist ein von Mistral AI veröffentlichtes 3-Milliarden-Parameter-Modell für Content-Moderation, das als Open-Weight-Modell unter Apache-2.0-Lizenz verfügbar ist. Es basiert auf Ministral-3B und nutzt einen Pixtral-Vision-Encoder für multimodale Eingaben (Text und Bild). Statt fester Kategorien verarbeitet das Modell Moderationsrichtlinien als frei formulierte Sprachanfragen zur Laufzeit und liefert einen kalibrierten Sicherheits-Score, ohne dass ein Neutraining nötig ist. Laut technischem Report erreicht es auf Textsicherheits-Benchmarks ein Niveau vergleichbar mit bis zu 7-fach größeren Modellen und setzt neue Bestwerte bei multimodaler Moderation.
Features
| Key-Benchmark (%) | Durchschnittlicher F1-Score von 84,9% über 16 Safety-Benchmarks; 83,8% F1 auf multimodalen Safety-Benchmarks |
| Kontextfenster (Token) | 32.000 Token |
| Lizenz | Apache 2.0 (Open Weights) |
| Multimodalität | Text und Bild (Prompt, Antwort, Prompt-Antwort-Paar, Bild mit optionalem Text) über eine einheitliche Schnittstelle |
| Plattform | Läuft auf einer einzelnen 16GB NVIDIA-GPU, on-device-fähig; Weights via Hugging Face |
| Release-Datum | 4. August 2026 (Public Preview) |