/audio/speech، ثم احفظ استجابة الصوت الثنائية.
استخدم هذا الدليل لتوليد الأصوات القياسية. إذا كنت تريد إنشاء كلام من صوت مرجعي مخصص، فراجع استنساخ الصوت.
الاستخدام الأساسي
tts-kokoro حاليًا صيغة MP3 كإعداد افتراضي.
اختيار النموذج والصوت
الأصوات خاصة بكل نموذج. يجب أن تكون قيمةvoice صالحة لـ model الذي تختاره.
استخدم صفحة نماذج تحويل النص إلى كلام لتصفّح النماذج والأصوات المتاحة. يعرض منتقي الأصوات معرّفات الأصوات الدقيقة التي تُمرّرها في طلبك.
معرّفات الأصوات حسّاسة لحالة الأحرف. إذا بدّلت نموذج TTS، فحدِّث قيمة
voice في الوقت نفسه.بنية الطلب
صيغة الإخراج
يمكنك حذفresponse_format لاستخدام الإعداد الافتراضي للنموذج. قبل اختيار امتداد الملف أو تجاوز الصيغة، استعلم عن واجهة برمجة النماذج للحصول على قيمتَي default_format وsupported_formats الحاليتين للنموذج:
Content-Type في الاستجابة صيغة الصوت المُعادة. طلب صيغة لا يدعمها النموذج المُختار يُعيد الحالة HTTP 400.
نصائح الإنتاج
- خزّن الصوت المُولَّد مؤقتًا عند إعادة استخدام النص المصدر والصوت.
- طبِّع النص وراجعه قبل التوليد. تؤثر علامات الترقيم في الإيقاع والتنغيم.
- خزّن المخرجات بامتداد الملف الصحيح المطابق لصيغة استجابة النموذج.