Los modelos de cambiador de voz no se aceptan en estos endpoints. Convierte una grabación de origen con la API de Voice Changer en su lugar.
Elige un modelo
Explora los Modelos de música y efectos de sonido para conocer los IDs de modelo actuales, precios, límites de duración y funciones admitidas. También puedes descubrir las capacidades de los modelos en tiempo de ejecución:duration_seconds, lyrics_prompt, force_instrumental o loop. Los campos no admitidos provocan una respuesta HTTP 400.
Flujo de generación
1. Obtén una cotización de precio
Cotiza la solicitud antes de generar el audio. Incluye el mismo modelo y duración que planeas enviar al endpoint de cola.2. Encola la generación
model como queue_id; los endpoints de recuperación y finalización los requieren.
3. Consulta el estado y descarga
Llama a/audio/retrieve con los valores de la respuesta de la cola:
Content-Type de la respuesta:
Una respuesta en proceso se ve así:
Ejemplo completo
Este ejemplo en Python encola música instrumental, consulta el estado cada cinco segundos y guarda el resultado con una extensión basada en su tipo de contenido.El endpoint de cotización no requiere autenticación, pero las solicitudes a queue, retrieve y complete sí.
Consejos para prompts
- Para música, describe el género, los instrumentos, el estado de ánimo, el tempo, la estructura y si deseas voces.
- Para efectos de sonido, describe la fuente, el entorno, la intensidad, el tiempo y la perspectiva.
- Usa
lyrics_promptsolo cuando el modelo seleccionado admita letras. - Usa
force_instrumentaloloopsolo cuando los metadatos del modelo indiquen que están admitidos.