Skip to main content
La generación de música y efectos de sonido es asíncrona. Elige un modelo, solicita una cotización de precio, encola la generación y luego consulta el estado hasta que Venice devuelva el archivo de audio terminado.

Elige un modelo

Explora los Modelos de música y efectos de sonido para conocer los IDs de modelo actuales, precios, límites de duración y funciones admitidas. También puedes descubrir las capacidades de los modelos en tiempo de ejecución:
Consulta los metadatos de cada modelo antes de establecer campos opcionales como duration_seconds, lyrics_prompt, force_instrumental o loop. Los campos no admitidos provocan una respuesta HTTP 400.

Flujo de generación

1. Obtén una cotización de precio

Cotiza la solicitud antes de generar el audio. Incluye el mismo modelo y duración que planeas enviar al endpoint de cola.
La respuesta contiene el costo estimado en USD:

2. Encola la generación

Una solicitud correcta devuelve el modelo y un ID de cola:
Guarda tanto model como queue_id; los endpoints de recuperación y finalización los requieren.

3. Consulta el estado y descarga

Llama a /audio/retrieve con los valores de la respuesta de la cola:
Inspecciona el Content-Type de la respuesta: Una respuesta en proceso se ve así:
Ambos valores de tiempo están en milisegundos.

Ejemplo completo

Este ejemplo en Python encola música instrumental, consulta el estado cada cinco segundos y guarda el resultado con una extensión basada en su tipo de contenido.
El endpoint de cotización no requiere autenticación, pero las solicitudes a queue, retrieve y complete sí.

Consejos para prompts

  • Para música, describe el género, los instrumentos, el estado de ánimo, el tempo, la estructura y si deseas voces.
  • Para efectos de sonido, describe la fuente, el entorno, la intensidad, el tiempo y la perspectiva.
  • Usa lyrics_prompt solo cuando el modelo seleccionado admita letras.
  • Usa force_instrumental o loop solo cuando los metadatos del modelo indiquen que están admitidos.

Recursos relacionados