Wie es funktioniert
1
Ihre Assets an einer öffentlich zugänglichen URL hosten
Laden Sie Ihre Video-, Foto- und Audiodateien hoch, damit unsere Server diese abrufen können.
2
Senden Sie eine API-Anfrage mit den entsprechenden Parametern
Referenzieren Sie Ihre gehosteten Assets und geben Sie den gewünschten Modus an (Standard oder Präzision).
3
Warten oder Status abfragen
Verwenden Sie unseren Webhook-Callback oder poll die API mit Ihrer Job-ID, bis die Verarbeitung abgeschlossen ist.
4
Videoausgabe herunterladen
Rufen Sie das fertige sprechende Foto oder das lip-synced Video von der bereitgestellten URL ab.
Nutzungseinschränkungen:
- Sie können bis zu 10 gleichzeitige Jobs haben (einschließlich wartender Anfragen).
- Es werden nur Einzelgesicht-Videos oder -Fotos unterstützt.
- Geschätzte Wartezeit: 1–120 Minuten, abhängig von der Systemauslastung.
- Verarbeitungszeit im Standardmodus: ~10 Minuten.
- Verarbeitungszeit im Präzisionsmodus: ~20 Minuten.
Wenn ein Video oder Foto mehrere Gesichter enthält, wird nur das größte erkannte Gesicht synchronisiert.