

Seedance 2.5
#18 in Text-zu-VideoSeedance · v2.5 · seit 31. Juli 2026 (Consumer-Launch auf Jimeng AI/Doubao Pro; API-Zugang über BytePlus ModelArk/Volcano Engine Ark ab Anfang · 2× · zuletzt 13. Aug. 2026
Seedance 2.5 ist ByteDances neues multimodales Text-zu-Video-Modell, das am 31. Juli 2026 offiziell vorgestellt wurde und zunächst über die Consumer-Apps Jimeng AI (即梦) und Dreamina/CapCut sowie Doubao Pro ausgerollt wurde. Kernmerkmal ist die Generierung von bis zu 30 Sekunden langen Video-mit-Audio-Clips in einem einzigen Durchgang (zuvor 15 Sekunden bei Version 2.0), mit optionaler Mehrfach-Erweiterung für längere Sequenzen. Das Modell unterstützt bis zu 50 multimodale Referenz-Inputs (Bilder, Videos, Audio, Text) und ermöglicht präzises, regionsbasiertes Editing. Der API-Zugang über BytePlus ModelArk (international) bzw. Volcano Engine Ark (China) folgte kurz nach dem Consumer-Launch mit tokenbasierter Abrechnung; native 4K-Ausgabe wurde zwar angekündigt, die veröffentlichte API deckt
Features
| Fine-tuning | Kein offizielles Fine-tuning dokumentiert; unterstützt bis zu 50 multimodale Referenz-Inputs (Bilder, Video, Audio) zur Steuerung statt Modell-Finetuning |
| Max-Auflösung | Offizielle API deckt aktuell 480p und 720p ab; natives 4K wurde angekündigt, ist aber in der ausgelieferten API nicht bestätigt/verfügbar |
| Max. Videolänge | Bis zu 30 Sekunden in einem Durchgang (mit Audio); Beta-Modus für Mehrfach-Erweiterung auf mehrere Minuten |
| Plattform | Jimeng AI, Doubao Pro, Dreamina/CapCut (Consumer); API via BytePlus ModelArk (international) und Volcano Engine Ark (China) |
| Preis | API: $10,70 / Mio. Token ohne Video-Input, $6,40 / Mio. Token mit Video-Input (BytePlus ModelArk); Beispiel: 5s/480p ≈ $0,51, 5s/720p ≈ $1,16 |
| Release-Datum | Offiziell gelauncht am 31. Juli 2026 (Ankündigung bereits am 23. Juni 2026 auf der Volcano Engine FORCE-Konferenz) |