

Mistral OCR
#7 in Transkription (STT)Mistral AI · seit 6. März 2025 (Original Mistral OCR); aktuelle Version OCR 4: 23. Juni 2026 · 2× · zuletzt 14. Aug. 2026
Mistral OCR ist ein spezialisiertes Dokumentenverarbeitungsmodell von Mistral AI, das Text, Tabellen, Formeln und eingebettete Bilder aus PDFs und Bildern extrahiert und in strukturiertes Markdown/HTML umwandelt. Ursprünglich am 6. März 2025 veröffentlicht, wurde es seither mehrfach weiterentwickelt (OCR 3 im Dezember 2025, OCR 4 im Juni 2026), wobei die aktuelle Version OCR 4 Bounding Boxes, Blockklassifizierung, Konfidenzwerte und Unterstützung für 170 Sprachen bietet. Das Modell ist über die Mistral-API, Le Chat/Vibe, Document AI sowie über Cloud-Partner wie Microsoft Foundry und AWS SageMaker verfügbar; es ist proprietär (closed-weight), kann aber für Enterprise-Kunden auch selbst gehostet werden.
Features
| Lizenz | Proprietär, Closed-Weight; API-Zugang über la Plateforme; Self-Hosting für Enterprise-Kunden auf Anfrage verfügbar |
| Plattform | Verfügbar via Mistral API (la Plateforme), Le Chat/Vibe, Document AI/Mistral Studio, Microsoft Foundry, Amazon SageMaker; Snowflake Parse Document geplant |
| Preis | OCR 4: $4 pro 1.000 Seiten (API), $2 mit Batch-API-Rabatt (50%), Document AI $5 pro 1.000 Seiten |
| Release-Datum | Original: 6. März 2025; OCR 3: Dezember 2025; OCR 4 (aktuell): 23. Juni 2026 |
| Sprachen | 170 Sprachen in 10 Sprachgruppen (OCR 4); ursprüngliche Version (2025) unterstützte 11 Sprachen |