Tous les modèles
Meta

Muse Voice Transcribe

Modèle de reconnaissance vocale en streaming de Meta pour les sous-titres en direct, l'audio long, de nombreux haut-parleurs, la commutation de code et la transcription sensible au domaine.

Présentation de l'anglais simple

Qu'est-ce que Muse Voice Transcribe ?

Muse Voice Transcribe est conçu pour la parole qui arrive en continu plutôt que uniquement sous forme de téléchargement terminé. Il peut traiter de petits morceaux audio, décider quand un énoncé est terminé, étiqueter de nombreux locuteurs et utiliser des indications de langue, de mots clés et de contexte pour améliorer les noms ou le vocabulaire spécialisé.

Meta propose une large formation multilingue tout en identifiant un ensemble plus restreint de langues spécifiquement vérifiées. Cette distinction est utile pour l'approvisionnement : testez les accents exacts, les modèles de commutation de code, le bruit et le chevauchement des haut-parleurs dans vos propres appels avant de traiter l'ensemble de formation plus large comme une couverture de production.

Bon ajustement pour

  • Sous-titres en direct et interfaces conversationnelles
  • Réunions multi-intervenants et longs enregistrements
  • Produits nécessitant une pondération des mots clés ou du contexte

Comparaison des catégories

Les faits importants pour les modèles transcription

Il s'agit de spécifications publiées par le fournisseur et non de scores de référence Cody. Suivez les sources liées pour connaître les limites actuelles et les exceptions spécifiques aux points de terminaison.

Prix des transcriptions
0,18 $/heure audioPrix ​​actuel du fournisseur par heure ou minute audio pour l'itinéraire de traitement indiqué.
En direct ou par lots
Streaming en temps réel et audio longue duréeSi le modèle gère les flux en temps réel, les enregistrements téléchargés ou les deux.
Langues
Formé sur plus de 70 langues ; 25 spécifiquement vérifiésCouverture linguistique publiée par le fournisseur, séparant la couverture formée ou annoncée des langues spécifiquement vérifiées si nécessaire.
Étiquettes des enceintes
Oui ; plus de 20 intervenants annoncésSi le modèle identifie qui a parlé et toute limite de locuteurs publiée.
Horodatages
Synchronisation et point de terminaison de la transcription en streamingInformations de synchronisation disponibles au niveau du mot, du segment ou de l'énoncé.
Contrôle du vocabulaire
Biais de langue, de mot-clé et de contexte ; commutation de codeAmélioration des mots clés, orthographe personnalisée, contexte, invites ou autres moyens d'améliorer les termes du domaine.
Où l'utiliser
Meta Model API, Meta IA pour Mac, Muse CodeAPI directe, catalogue cloud, application ou point de terminaison régional documenté par le fournisseur.

Tarifs et comparaisons

Estimez votre coût

Indiquez votre utilisation. L’estimation se met à jour à chaque modification.

Utilise la durée en heures : 30 minutes = 0,5 heure. Options et frais minimums peuvent modifier la facture.

Muse Voice Transcribe

Meta

Total estimé (USD)

Aucun tarif vérifié

Pour l’utilisation indiquée · USD · Tarif API, hors abonnement

Comprendre cette estimation

Les estimations excluent taxes, outils, stockage/écriture du cache, quotas gratuits et remises personnalisées. Pour les images, seule la sortie est incluse, pas le prompt ni les références. Les modes de qualité varient. Un paramètre non répertorié n’est pas gratuit.

Accès API et fournisseur

Où obtenir Muse Voice Transcribe

Disponibilité

Régions et étape d'accès

Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model.

Meta n'énumère pas une liste de pays ou de région de traitement spécifique au modèle sur la page de lancement publique ; utilisez les conditions actuelles du compte de développeur.

Vérifier la disponibilité en direct

Données et formation

L'itinéraire compte.

La page de lancement de Meta décrit la confidentialité de sa démo publique, et non un engagement complet de rétention de l'API modèle ou d'utilisation de la formation. Consultez les termes actuels de l’API Model et les contrôles de l’entreprise avant d’envoyer du contenu audio sensible.

Il s'agit d'une lecture concise du matériel du fournisseur cité, et non d'un avis juridique. Une passerelle tierce peut avoir des conditions de stockage, de routage, de formation et de résidence différentes de celles de l'API directe du modéliste.

Lire la politique du fournisseur

Questions fréquemment posées

FAQ Muse Voice Transcribe

Qu'est-ce que Muse Voice Transcribe ?

Modèle de reconnaissance vocale en streaming de Meta pour les sous-titres en direct, l'audio long, de nombreux haut-parleurs, la commutation de code et la transcription sensible au domaine. Muse Voice Transcribe est conçu pour la parole qui arrive en continu plutôt que uniquement sous forme de téléchargement terminé. Il peut traiter de petits morceaux audio, décider quand un énoncé est terminé, étiqueter de nombreux locuteurs et utiliser des indications de langue, de mots clés et de contexte pour améliorer les noms ou le vocabulaire spécialisé.

Quand Muse Voice Transcribe est-il sorti ?

Muse Voice Transcribe a été publié sur 1 septembre 2026 selon les documents du fournisseur cités.

Où puis-je accéder à Muse Voice Transcribe ?

Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model. Les voies d'accès répertoriées dans ce guide sont Meta Model API et Meta.

Combien coûte Muse Voice Transcribe ?

0,18 $/heure audio. Meta répertorie ce taux d'API de modèle dans le catalogue examiné. Les tolérances de produits dans Meta AI pour Mac ou Muse Code peuvent différer.

Où le Muse Voice Transcribe est-il disponible ?

Disponible via Meta Model API, Meta AI pour Mac et Muse Code lors de la préversion publique de l'API Model. Meta n'énumère pas une liste de pays ou de région de traitement spécifique au modèle sur la page de lancement publique ; utilisez les conditions actuelles du compte de développeur.

Mes données API Muse Voice Transcribe sont-elles utilisées pour la formation ?

La page de lancement de Meta décrit la confidentialité de sa démo publique, et non un engagement complet de rétention de l'API modèle ou d'utilisation de la formation. Consultez les termes actuels de l’API Model et les contrôles de l’entreprise avant d’envoyer du contenu audio sensible. La politique appartient à l'itinéraire du fournisseur et aux conditions du compte, vérifiez-la donc à nouveau avant de l'utiliser en production.