Muse Voice Transcribe
نموذج Meta للتعرف على الكلام المتدفق للتسميات التوضيحية المباشرة والصوت الطويل والعديد من مكبرات الصوت وتبديل التعليمات البرمجية والنسخ المدرك للمجال.
نموذج Meta للتعرف على الكلام المتدفق للتسميات التوضيحية المباشرة والصوت الطويل والعديد من مكبرات الصوت وتبديل التعليمات البرمجية والنسخ المدرك للمجال.
نظرة عامة على اللغة الإنجليزية البسيطة
تم تصميم Muse Voice Transcribe للكلام الذي يصل بشكل مستمر وليس فقط كتحميل نهائي. يمكنه معالجة مقاطع صوتية صغيرة، وتحديد متى ينتهي الكلام، وتسمية العديد من المتحدثين، واستخدام اللغة والكلمات الرئيسية وتلميحات السياق لتحسين الأسماء أو المفردات المتخصصة.
تعلن Meta عن تدريب واسع النطاق متعدد اللغات مع تحديد مجموعة أصغر من اللغات التي تم التحقق منها بشكل خاص. يعد هذا التمييز مفيدًا في عمليات الشراء: اختبر اللهجات الدقيقة وأنماط تبديل التعليمات البرمجية والضوضاء وتداخل السماعات في مكالماتك الخاصة قبل التعامل مع مجموعة التدريب الأوسع كتغطية للإنتاج.
مقارنة الفئة
هذه مواصفات منشورة من قبل الموفر، وليست درجات معيار Cody. اتبع المصادر المرتبطة للحدود الحالية والاستثناءات الخاصة بنقطة النهاية.
الأسعار والمقارنات
حدّد استخدامك. يتحدّث التقدير أثناء الكتابة.
يستخدم مدة التسجيل بالساعات: 30 دقيقة = 0.5 ساعة. قد تغيّر الميزات الإضافية والحد الأدنى للرسوم الفاتورة.
Muse Voice Transcribe
Meta
الإجمالي التقديري (USD)
للاستخدام الموضح · دولار أمريكي · تسعير API وليس اشتراكًا
لا تشمل التقديرات الضرائب والأدوات وتخزين وكتابة الذاكرة المؤقتة والحصص المجانية والخصومات الخاصة. تشمل الصور تكلفة المخرجات فقط دون النص أو الصور المرجعية. تختلف أوضاع الجودة حسب النموذج. الإعدادات غير المدرجة ليست مجانية.
الوصول إلى واجهة برمجة التطبيقات والموفر
التوفر
متوفر من خلال Meta Model API وMeta AI لنظام التشغيل Mac وMuse Code أثناء المعاينة العامة لـ Model API.
لا يقوم Meta بتعداد بلد واحد خاص بنموذج معين أو قائمة منطقة معالجة في صفحة الإطلاق العامة؛ استخدم شروط حساب المطور الحالية.
تحقق من التوفر المباشرالبيانات والتدريب
تصف صفحة إطلاق Meta خصوصية العرض التوضيحي العام الخاص بها، وليس الالتزام الكامل بالاحتفاظ بـ Model API أو الالتزام باستخدام التدريب. قم بمراجعة شروط Model API الحالية وضوابط المؤسسة قبل إرسال الصوت الحساس.
هذه قراءة موجزة لمواد المزود المذكورة، وليست نصيحة قانونية. يمكن أن تحتوي بوابة الطرف الثالث على شروط تخزين وتوجيه وتدريب وإقامة مختلفة من واجهة برمجة التطبيقات المباشرة الخاصة بصانع النموذج.
اقرأ سياسة المزودالأسئلة المتداولة
نموذج Meta للتعرف على الكلام المتدفق للتسميات التوضيحية المباشرة والصوت الطويل والعديد من مكبرات الصوت وتبديل التعليمات البرمجية والنسخ المدرك للمجال. تم تصميم Muse Voice Transcribe للكلام الذي يصل بشكل مستمر وليس فقط كتحميل نهائي. يمكنه معالجة مقاطع صوتية صغيرة، وتحديد متى ينتهي الكلام، وتسمية العديد من المتحدثين، واستخدام اللغة والكلمات الرئيسية وتلميحات السياق لتحسين الأسماء أو المفردات المتخصصة.
تم إصدار Muse Voice Transcribe على 1 سبتمبر 2026 وفقًا لمواد الموفر المذكورة.
متوفر من خلال Meta Model API وMeta AI لنظام التشغيل Mac وMuse Code أثناء المعاينة العامة لـ Model API. مسارات الوصول المدرجة في هذا الدليل هي Meta Model API وMeta.
0.18 دولار / ساعة صوتية. يسرد Meta معدل API النموذجي هذا في الكتالوج الذي تمت مراجعته. يمكن أن تختلف حدود المنتج في Meta AI لنظام التشغيل Mac أو Muse Code.
متوفر من خلال Meta Model API وMeta AI لنظام التشغيل Mac وMuse Code أثناء المعاينة العامة لـ Model API. لا يقوم Meta بتعداد بلد واحد خاص بنموذج معين أو قائمة منطقة معالجة في صفحة الإطلاق العامة؛ استخدم شروط حساب المطور الحالية.
تصف صفحة إطلاق Meta خصوصية العرض التوضيحي العام الخاص بها، وليس الالتزام الكامل بالاحتفاظ بـ Model API أو الالتزام باستخدام التدريب. قم بمراجعة شروط Model API الحالية وضوابط المؤسسة قبل إرسال الصوت الحساس. تنتمي السياسة إلى مسار الموفر وشروط الحساب، لذا تحقق منها مرة أخرى قبل استخدام الإنتاج.
المقارنات ذات الصلة
نموذج النسخ الدفعي السريع Microsoft للتسجيلات الطويلة، وتسميات المتحدثين، وتوقيت الكلمات، وانحياز الكلمات الرئيسية، والنصوص النظيفة أو الحرفية.
فتح المقارنة الكاملةنموذج Google Cloud العام لتحويل الكلام إلى نص للبث والملفات والنسخ الديناميكي منخفض التكلفة عبر العديد من اللغات والمناطق.
فتح المقارنة الكاملةنموذج النسخ الذي يركز على الدقة في AssemblyAI للملفات والصوت المباشر، مع تبديل التعليمات البرمجية، وتسميات السماعات، والطوابع الزمنية، والمطالبة السياقية.
فتح المقارنة الكاملةنموذج تحويل الكلام إلى نص متعدد اللغات ElevenLabs للحصول على نصوص مفصلة مع العديد من المتحدثين، وتوقيت الكلمات، والأحداث الصوتية، وقوائم المفاتيح الرئيسية المخصصة الكبيرة.
فتح المقارنة الكاملة