Gemini 3.8 Live
نموذج Google الصوتي الفوري لمحادثات سريعة الاستجابة باستخدام الصوت والنص والسياق المرئي.
نموذج Google الصوتي الفوري لمحادثات سريعة الاستجابة باستخدام الصوت والنص والسياق المرئي.
نظرة عامة على اللغة الإنجليزية البسيطة
يمكن لـ Gemini 3.8 Live مناقشة ما يقوله المستخدم أو يعرضه بالكاميرا واستدعاء الأدوات أثناء المحادثة. وبخلاف Gemini 3.8 Flash الذي يُرجع نصًا، صُمم Live للتفاعل الصوتي.
اختر هذا الإصدار للمساعدات الصوتية اليومية. يتداخل استدلاله مع المحادثة دون مستوى تفكير قابل للتعديل. أما Extended Thinking فهو نموذج منفصل للمهام الأكثر تعقيدًا.
مقارنة الفئة
هذه مواصفات منشورة من قبل الموفر، وليست درجات معيار Cody. اتبع المصادر المرتبطة للحدود الحالية والاستثناءات الخاصة بنقطة النهاية.
الوصول إلى واجهة برمجة التطبيقات والموفر
التوفر
متاح عبر Gemini Live API وGoogle AI Studio في المناطق المدعومة.
استخدم قائمة المناطق المتاحة المباشرة لـ Google وتحقق من قيود الميزات للمسار المحدد.
تحقق من التوفر المباشرالبيانات والتدريب
تقول شركة Google أن مطالبات واستجابات Gemini API المدفوعة لا تُستخدم لتحسين منتجاتها. يمكن عمومًا استخدام محتوى الخدمة غير المدفوعة، مع معاملة مختلفة للمستخدمين في المنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا؛ تحقق من الشروط الحالية لحسابك ومنطقتك.
هذه قراءة موجزة لمواد المزود المذكورة، وليست نصيحة قانونية. يمكن أن تحتوي بوابة الطرف الثالث على شروط تخزين وتوجيه وتدريب وإقامة مختلفة من واجهة برمجة التطبيقات المباشرة الخاصة بصانع النموذج.
اقرأ سياسة المزودالأسئلة المتداولة
نموذج Google الصوتي الفوري لمحادثات سريعة الاستجابة باستخدام الصوت والنص والسياق المرئي. يمكن لـ Gemini 3.8 Live مناقشة ما يقوله المستخدم أو يعرضه بالكاميرا واستدعاء الأدوات أثناء المحادثة. وبخلاف Gemini 3.8 Flash الذي يُرجع نصًا، صُمم Live للتفاعل الصوتي.
تم إصدار Gemini 3.8 Live على 15 سبتمبر 2026 وفقًا لمواد الموفر المذكورة.
متاح عبر Gemini Live API وGoogle AI Studio في المناطق المدعومة. مسارات الوصول المدرجة في هذا الدليل هي Google.
إدخال الصوت 0.005 دولار/الدقيقة · إخراج الصوت 0.018 دولار/الدقيقة. أسعار الفئة المدفوعة لكل مليون رمز: 3 دولارات لإدخال الصوت و12 دولارًا لإخراجه. النص: 0.75 دولار للإدخال و4.50 دولارات للإخراج؛ وإدخال الصور والفيديو بدولار واحد لكل مليون رمز. قد يضيف التفكير والبحث المدفوع تكاليف أخرى.
متاح عبر Gemini Live API وGoogle AI Studio في المناطق المدعومة. استخدم قائمة المناطق المتاحة المباشرة لـ Google وتحقق من قيود الميزات للمسار المحدد.
تقول شركة Google أن مطالبات واستجابات Gemini API المدفوعة لا تُستخدم لتحسين منتجاتها. يمكن عمومًا استخدام محتوى الخدمة غير المدفوعة، مع معاملة مختلفة للمستخدمين في المنطقة الاقتصادية الأوروبية والمملكة المتحدة وسويسرا؛ تحقق من الشروط الحالية لحسابك ومنطقتك. تنتمي السياسة إلى مسار الموفر وشروط الحساب، لذا تحقق منها مرة أخرى قبل استخدام الإنتاج.
المقارنات ذات الصلة
الواجهة الأمامية الصوتية مزدوجة الاتجاه OpenAI للمحادثة الطبيعية التي تقوم بتفويض التفكير والإجراءات الأعمق إلى وكيل الواجهة الخلفية المنفصل.
فتح المقارنة الكاملةنموذج صوتي منفصل من Gemini يعالج الطلبات المعقدة في الخلفية مع استمرار المحادثة.
فتح المقارنة الكاملةنموذج OpenAI للاستدلال المنطقي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء الصوت الذين يستخدمون الأدوات والذين يحتاجون أيضًا إلى سياق النص والصورة.
فتح المقارنة الكاملةنموذج معاينة الصوت إلى الصوت الخاص بـ Google للحوار منخفض زمن الوصول مع الوعي متعدد الوسائط والتفكير وتأريض البحث واستدعاء الوظائف.
فتح المقارنة الكاملةنموذج ElevenLabs المعبّر لتحويل النص إلى كلام في الوقت الفعلي للحوار الطبيعي والتوصيل العاطفي والعلامات الصوتية وأكثر من 70 لغة.
فتح المقارنة الكاملةأحدث نموذج تعبيري لتحويل النص إلى كلام في العالم في الوقت الفعلي، مصمم لتذكر تسليم المحادثة والتحدث بأكثر من 100 لغة.
فتح المقارنة الكاملةنموذج SpaceXAI الحالي لتحويل الكلام إلى كلام في الوقت الفعلي لوكلاء المحادثة دون الثانية مع إمكانية الوصول إلى الأداة.
فتح المقارنة الكاملة