

H3 Max Lip Sync
#3 in KI-Video-EditingFal · max · 3× · zuletzt 20. Sept. 2026
88
Momentum
H3 Max Lip Sync ist ein von fal gehosteter KI-Video-Endpoint, der aus einem Bild und einer bereitgestellten Audiodatei ein Video erzeugt und dabei die Mundbewegungen an den Ton anpasst. Das Modell basiert auf MiniMax H3, das fal post-trainiert und mit einer eigenen Inferenz-Engine für höheren Durchsatz optimiert hat. Es unterstützt optionale Transkriptions-Führung sowie Ausgabeauflösungen von 480p bis 2K. Das übergeordnete H3-Max-Modell wurde von fal als schnellstes und laut eigenen sowie unabhängigen Benchmarks (Artificial Analysis, Design Arena) qualitativ führendes Video-Modell positioniert.
Momentum-Verlauf
22.06.20.09.
Features
| Ausgabeformate | Video mit synchronisiertem Audio, Auflösungen 480p bis 2K |
| Basis-Modell | Post-trainierte Variante von MiniMax H3 (offene Gewichte), optimiert von fal Research |
| Integrationen | fal API (1 API, 100+ Modelle), Client-Bibliothek @fal-ai/client (npm) |
| Plattform | Gehostet auf fal.ai, zugänglich per API und Web-Sandbox (Playground) |
| Preis | Metered pay-per-second: $0,05/Sek. bei 480p, $0,08/Sek. bei 768p (H3 Max); H3 Max Turbo ab $0,04/Sek. bei 768p; Launch-Rabatt teils -50% bis -75% |
| Release-Datum | H3 Max (Basismodell) veröffentlicht am 1. September 2026 |