

Cohere · v5 · 3× · zuletzt 31. Aug. 2026
25
Momentum
Parse 5 (Modell-ID: parse-v5.0) ist ein von Cohere am 27. August 2026 veröffentlichtes Vision-Language-Modell zur Dokumentenverarbeitung. Es wandelt PDFs, Präsentationsfolien und Bilder in strukturiertes Markdown um, inklusive Tabellen, Listen, Formularfeldern und Bounding-Boxes für visuelle Elemente, ohne separaten OCR-Schritt. Das Modell hat 2,3 Milliarden Parameter, basiert auf der Cohere-Labs-Architektur „North-Micro-Vision-Instruct" und ist auf Preis-Leistungs-Verhältnis statt Spitzengenauigkeit ausgelegt. Es ist über die Cohere Parse API, Microsoft Foundry, AWS SageMaker sowie im Single-Tenant-Modell Vault verfügbar.
Momentum-Verlauf
02.06.31.08.
Features
| Key-Benchmark (%) | ParseBench: 79,2 (Durchschnitt über Tabellen, Inhaltstreue, semantische Formatierung) |
| Kontextfenster (Token) | 8.192 Token |
| Multimodalität | Vision-Language-Modell: verarbeitet PDF-, PPT- und JPEG-Seiten (Bild-Input) und liefert Markdown/HTML-Output mit Text, Tabellen, Bildbeschreibungen und Bounding-Boxes |
| Plattform | Cohere Parse API, Microsoft Foundry, AWS SageMaker, Model Vault (Single-Tenant) |
| Preis pro 1M Token | $1,50 pro 1.000 Seiten (API-Preismodell, kein klassischer Token-Preis) |
| Release-Datum | 27. August 2026 |