Utilisez la valeur
id comme paramètre model dans les requêtes API. 5 modèles actuellement disponibles.Utilisation
Les modèles de transcription convertissent l’audio parlé en texte écrit. Ils sont accessibles via l’API Audio Transcriptions.Formats audio pris en charge
wav, wave, flac, m4a, aac, mp4, mp3, ogg, oga, webm
Un fichier est accepté lorsque son type MIME ou son extension figure dans cette liste, et il doit également passer une vérification des octets magiques sur les octets téléversés. Renommer un fichier avec une extension prise en charge ne suffit pas.
Formats de réponse
Timestamps
Définisseztimestamps: true pour recevoir des données temporelles avec la transcription. La réponse ajoute un objet timestamps dont la granularité dépend du modèle :
Les entrées au niveau du mot sont
{ "word": "...", "start": 0.0, "end": 0.5 } et les entrées au niveau du segment sont { "text": "...", "start": 0.0, "end": 3.2 }, tous les temps étant en secondes.
La tarification est facturée par seconde d’audio en entrée. Voir l’API Audio Transcriptions pour des exemples de requête et des détails sur les paramètres.