Cómo funciona
1
Aloja tus activos en una URL accesible públicamente
Sube tus archivos de video, foto y audio para que nuestros servidores puedan recuperarlos.
2
Envía una solicitud API con los parámetros apropiados
Referencia tus activos alojados y especifica tu modo deseado (Estándar o Precisión).
3
Espera o consulta el estado
Utiliza nuestro webhook callback o consulta la API con tu ID de trabajo hasta que el procesamiento esté completo.
4
Descarga el video de salida
Recupera la foto parlante terminada o el video con lip sync desde la URL proporcionada.
Limitaciones de uso:
- Puedes tener hasta 10 trabajos concurrentes (incluyendo solicitudes en cola).
- Solo se admiten videos o fotos de una sola cara.
- Tiempo estimado de espera: 1–120 minutos, dependiendo de la carga del sistema.
- Tiempo de procesamiento en Modo Estándar: ~10 minutos.
- Tiempo de procesamiento en Modo Precisión: ~20 minutos.
Si un video o foto contiene múltiples rostros, solo el rostro más grande detectado será sincronizado labialmente.