Skip to main content
يحوّل تحويل النص إلى كلام النصَّ المكتوب إلى صوت منطوق. اختر نموذج TTS، وحدّد صوتًا يدعمه هذا النموذج، وأرسل النص إلى /audio/speech، ثم احفظ استجابة الصوت الثنائية. استخدم هذا الدليل لتوليد الأصوات القياسية. إذا كنت تريد إنشاء كلام من صوت مرجعي مخصص، فراجع استنساخ الصوت.

الاستخدام الأساسي

يكون جسم الاستجابة الناجحة صوتًا ثنائيًا بالصيغة الافتراضية للنموذج، وليس JSON. يستخدم tts-kokoro حاليًا صيغة MP3 كإعداد افتراضي.

اختيار النموذج والصوت

الأصوات خاصة بكل نموذج. يجب أن تكون قيمة voice صالحة لـ model الذي تختاره. استخدم صفحة نماذج تحويل النص إلى كلام لتصفّح النماذج والأصوات المتاحة. يعرض منتقي الأصوات معرّفات الأصوات الدقيقة التي تُمرّرها في طلبك.
معرّفات الأصوات حسّاسة لحالة الأحرف. إذا بدّلت نموذج TTS، فحدِّث قيمة voice في الوقت نفسه.

بنية الطلب

صيغة الإخراج

يمكنك حذف response_format لاستخدام الإعداد الافتراضي للنموذج. قبل اختيار امتداد الملف أو تجاوز الصيغة، استعلم عن واجهة برمجة النماذج للحصول على قيمتَي default_format وsupported_formats الحاليتين للنموذج:
يحدد Content-Type في الاستجابة صيغة الصوت المُعادة. طلب صيغة لا يدعمها النموذج المُختار يُعيد الحالة HTTP 400.

نصائح الإنتاج

  • خزّن الصوت المُولَّد مؤقتًا عند إعادة استخدام النص المصدر والصوت.
  • طبِّع النص وراجعه قبل التوليد. تؤثر علامات الترقيم في الإيقاع والتنغيم.
  • خزّن المخرجات بامتداد الملف الصحيح المطابق لصيغة استجابة النموذج.

موارد ذات صلة