

Cohere · v5 · 2× · zuletzt 01. Okt. 2026
Embed 5 ist Coheres neue Embedding-Modellfamilie für Enterprise-Suche, RAG und Agenten-Workflows, bestehend aus den Varianten Pro (höchste Retrieval-Qualität) und Fast (niedrige Latenz, hoher Durchsatz). Beide Modelle teilen sich einen gemeinsamen Vektorraum, sodass ein mit Pro indexierter Korpus mit Fast abgefragt werden kann. Die Modelle verarbeiten Text, Bilder sowie gemischte Text-Bild-Eingaben (z.B. PDF-Seiten) in über 100 Sprachen bei einem Kontextfenster von 128.000 Tokens und unterstützen Matryoshka-Embeddings in mehreren Dimensionen sowie float-, int8- und binäre Ausgabeformate. Verfügbar ist Embed 5 über die Cohere API, Model Vault (Single-Tenant), Microsoft Foundry und Amazon SageMaker sowie für private VPC-/On-Premises-Deployments über vLLM.
Features
| Deployment (Self-host/Cloud) | Cloud via API/Model Vault/Foundry/SageMaker; private VPC oder On-Premises via vLLM |
| Durchsatz/Latenz | Fast verarbeitet ca. 377 Dokumente/Sek. vs. ca. 160 Dokumente/Sek. bei Pro (ca. 2,4x höherer Durchsatz) |
| Lizenz | Proprietäres Modell; Gewichte nicht öffentlich verfügbar, Lizenz für private Deployments via vLLM |
| Plattform | Cohere API, Model Vault, Microsoft Foundry, Amazon SageMaker, North |
| Preis | Pro: $0,12/1M Tokens (Text), $0,40/1M Tokens (Bild); Fast: $0,08/1M Tokens (Text), $0,40/1M Tokens (Bild) |
| Protokoll-Kompatibilität | Kontextfenster 128k Tokens, Matryoshka-Embeddings in 256/512/768/1024/1536/2048 Dim., float/int8/binär |
| Release-Datum | 30. September 2026 |
| Unterstützte Modelle/Provider | Zwei Varianten: embed-v5.0-pro und embed-v5.0-fast, teilen gemeinsamen Embedding-Raum |