Skip to main content

Wie es funktioniert

1

Ihre Assets an einer öffentlich zugänglichen URL hosten

Laden Sie Ihre Video-, Foto- und Audiodateien hoch, damit unsere Server diese abrufen können.
2

Senden Sie eine API-Anfrage mit den entsprechenden Parametern

Referenzieren Sie Ihre gehosteten Assets und geben Sie den gewünschten Modus an (Standard oder Präzision).
3

Warten oder Status abfragen

Verwenden Sie unseren Webhook-Callback oder poll die API mit Ihrer Job-ID, bis die Verarbeitung abgeschlossen ist.
4

Videoausgabe herunterladen

Rufen Sie das fertige sprechende Foto oder das lip-synced Video von der bereitgestellten URL ab.

Nutzungseinschränkungen:

  • Sie können bis zu 10 gleichzeitige Jobs haben (einschließlich wartender Anfragen).
  • Es werden nur Einzelgesicht-Videos oder -Fotos unterstützt.
  • Geschätzte Wartezeit: 1–120 Minuten, abhängig von der Systemauslastung.
  • Verarbeitungszeit im Standardmodus: ~10 Minuten.
  • Verarbeitungszeit im Präzisionsmodus: ~20 Minuten.
Wenn ein Video oder Foto mehrere Gesichter enthält, wird nur das größte erkannte Gesicht synchronisiert.

API-Fehlercodes

Job-Fehlercodes

Zuletzt geändert am 21. Mai 2026