

Twelve Labs · seit 1. Dezember 2025 (Marengo 3.0, General Availability) · 2× · zuletzt 14. Sept. 2026
Marengo ist ein multimodales Embedding-Modell von TwelveLabs für Videoverständnis. Es analysiert Video, Bild, Audio und Text gemeinsam und erzeugt Vektor-Embeddings in einem gemeinsamen latenten Raum, was Any-to-Any-Suche (z.B. Text-zu-Video) ermöglicht. Die aktuelle Version Marengo 3.0 wurde im Dezember 2025 vorgestellt und bietet u.a. reduzierte Embedding-Dimensionen (512 statt 1024), Unterstützung für bis zu vier Stunden Videomaterial und 36 Sprachen. Das Modell wird sowohl über die TwelveLabs-eigene SaaS-API als auch über Amazon Bedrock (inkl. verwalteter Knowledge Bases) angeboten.
Features
| Deployment (Self-host/Cloud) | Cloud-only: TwelveLabs-eigene SaaS-API oder Amazon Bedrock (Standard-, Priority-, Flex-Service-Tier); kein Self-Hosting |
| Durchsatz/Latenz | Marengo 3.0: 50% kleinere Embeddings (512 statt 1024 Dimensionen), 2x schnellere Indexierung ggü. Vorgänger; Verarbeitung von bis zu 4 Std. Video/Audio, Dateien bis 6 GB |
| Plattform | Verfügbar über TwelveLabs SaaS (Search-, Embed-API) und Amazon Bedrock (inkl. Managed Knowledge Bases) |
| Preis | Video-Indexierung $0.042/Minute; Embed API Video $0.042/Min, Audio $0.008/Min, Bild $0.10/1000, Text $0.07/1000; Suche $4/1000 Queries; Infrastruktur $0.0015/Min |
| Protokoll-Kompatibilität | REST-API mit x-api-key-Auth (TwelveLabs SDKs für Python/Node.js); auf Bedrock via InvokeModel/StartAsyncInvoke, Input/Output über Amazon S3 |
| Release-Datum | Marengo 3.0: 1. Dezember 2025 (GA, angekündigt auf AWS re:Invent); Marengo 2.7: Dezember 2024 |
| Unterstützte Modelle/Provider | Aktuelle Modellversion: Marengo 3.0 (zuvor 2.7, 2.6); Bedrock-Modell-IDs: twelvelabs.marengo-embed-2-7-v1:0 bzw. twelvelabs.marengo-embed-3-0-v1:0 |