Gemini 3.8 Flash-Lite TTS
نموذج Google الأقل تكلفة لتوليد الكلام، لميزات القراءة الصوتية وإنتاج الصوت بكميات كبيرة بـ101 لغة.
نموذج Google الأقل تكلفة لتوليد الكلام، لميزات القراءة الصوتية وإنتاج الصوت بكميات كبيرة بـ101 لغة.
نظرة عامة على اللغة الإنجليزية البسيطة
يحوّل Flash-Lite TTS النصوص إلى كلام باستخدام تنسيق الطلب نفسه في Flash TTS، بسعر أقل لإخراج الصوت. وهو خيار عملي للتعليق الصوتي المتكرر ولمكوّن النطق في المساعد الصوتي.
يدعم النموذجان تصميم أصوات مخصصة ونصوصًا لمتحدثين اثنين. وهما يولّدان الكلام لا الإجابات؛ لذا يحتاج المساعد الحواري إلى مكونات منفصلة للاستماع والاستدلال. ولا يستخدمان Gemini Live API.
مقارنة الفئة
هذه مواصفات منشورة من قبل الموفر، وليست درجات معيار Cody. اتبع المصادر المرتبطة للحدود الحالية والاستثناءات الخاصة بنقطة النهاية.
الوصول إلى واجهة برمجة التطبيقات والموفر
التوفر
متاح عبر Gemini API وGoogle AI Studio في المناطق المدعومة.
لا تتوفر محاكاة الصوت في AI Studio في إلينوي وتكساس والمنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا والهند. ولا يعني ذلك حظر تحويل النص إلى كلام عمومًا في تلك المناطق.
تحقق من التوفر المباشرالبيانات والتدريب
تقول شركة Google أن مطالبات واستجابات Gemini API المدفوعة لا تُستخدم لتحسين منتجاتها. يمكن عمومًا استخدام محتوى الخدمة غير المدفوعة، مع معاملة مختلفة للمستخدمين في المنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا؛ تحقق من الشروط الحالية لحسابك ومنطقتك.
هذه قراءة موجزة لمواد المزود المذكورة، وليست نصيحة قانونية. يمكن أن تحتوي بوابة الطرف الثالث على شروط تخزين وتوجيه وتدريب وإقامة مختلفة من واجهة برمجة التطبيقات المباشرة الخاصة بصانع النموذج.
اقرأ سياسة المزودالأسئلة المتداولة
نموذج Google الأقل تكلفة لتوليد الكلام، لميزات القراءة الصوتية وإنتاج الصوت بكميات كبيرة بـ101 لغة. يحوّل Flash-Lite TTS النصوص إلى كلام باستخدام تنسيق الطلب نفسه في Flash TTS، بسعر أقل لإخراج الصوت. وهو خيار عملي للتعليق الصوتي المتكرر ولمكوّن النطق في المساعد الصوتي.
تم إصدار Gemini 3.8 Flash-Lite TTS على 23 سبتمبر 2026 وفقًا لمواد الموفر المذكورة.
متاح عبر Gemini API وGoogle AI Studio في المناطق المدعومة. مسارات الوصول المدرجة في هذا الدليل هي Google.
0.50 دولار لإدخال النص · 6 دولارات لإخراج الصوت / مليون توكن. تسري أسعار Standard التمهيدية حتى 31 ديسمبر 2026، ويتضاعف السعران في 1 يناير 2027. يستخدم الصوت 25 توكن في الثانية. تختلف أسعار التخزين المؤقت ومستويات الخدمة الأخرى.
متاح عبر Gemini API وGoogle AI Studio في المناطق المدعومة. لا تتوفر محاكاة الصوت في AI Studio في إلينوي وتكساس والمنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا والهند. ولا يعني ذلك حظر تحويل النص إلى كلام عمومًا في تلك المناطق.
تقول شركة Google أن مطالبات واستجابات Gemini API المدفوعة لا تُستخدم لتحسين منتجاتها. يمكن عمومًا استخدام محتوى الخدمة غير المدفوعة، مع معاملة مختلفة للمستخدمين في المنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا؛ تحقق من الشروط الحالية لحسابك ومنطقتك. تنتمي السياسة إلى مسار الموفر وشروط الحساب، لذا تحقق منها مرة أخرى قبل استخدام الإنتاج.
المقارنات ذات الصلة
نموذج Google لتوليد السرد التعبيري وأصوات الشخصيات والحوار بـ130 لغة.
فتح المقارنة الكاملةنموذج ElevenLabs المعبّر لتحويل النص إلى كلام في الوقت الفعلي للحوار الطبيعي والتوصيل العاطفي والعلامات الصوتية وأكثر من 70 لغة.
فتح المقارنة الكاملةأحدث نموذج تعبيري لتحويل النص إلى كلام في العالم في الوقت الفعلي، مصمم لتذكر تسليم المحادثة والتحدث بأكثر من 100 لغة.
فتح المقارنة الكاملة