Muse Voice Transcribe
Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription.
Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription.
Übersicht in einfacher englischer Sprache
Muse Voice Transcribe ist für Sprache konzipiert, die kontinuierlich und nicht nur als fertiger Upload eintrifft. Es kann kleine Audioblöcke verarbeiten, entscheiden, wann eine Äußerung beendet ist, viele Sprecher kennzeichnen und Sprach-, Schlüsselwort- und Kontexthinweise verwenden, um Namen oder Fachvokabular zu verbessern.
Meta wirbt für eine umfassende mehrsprachige Schulung und identifiziert gleichzeitig eine kleinere Gruppe speziell verifizierter Sprachen. Diese Unterscheidung ist für die Beschaffung nützlich: Testen Sie die genauen Akzente, Codewechselmuster, Geräusche und Sprecherüberschneidungen in Ihren eigenen Anrufen, bevor Sie den breiteren Trainingssatz als Produktionsabdeckung behandeln.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
Preise und Vergleiche
Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.
Nutzt die Aufnahmedauer in Stunden: 30 Minuten = 0,5 Stunden. Zusatzfunktionen und Mindestgebühren können die Rechnung ändern.
Muse Voice Transcribe
Meta
Geschätzte Summe (USD)
Für die angegebene Nutzung · USD · API-Preis, kein Abonnement
Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.
API- und Provider-Zugriff
Verfügbarkeit
Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API.
Meta listet auf der öffentlichen Startseite keine modellspezifische Länder- oder Verarbeitungsregionenliste auf. Verwenden Sie die aktuellen Bedingungen für Entwicklerkonten.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
Auf der Startseite von Meta wird der Datenschutz für seine öffentliche Demo beschrieben, nicht eine vollständige Aufbewahrung der Modell-API oder eine Verpflichtung zur Schulungsnutzung. Lesen Sie die aktuellen Model-API-Bedingungen und Unternehmenskontrollen, bevor Sie vertrauliche Audiodaten senden.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription. Muse Voice Transcribe ist für Sprache konzipiert, die kontinuierlich und nicht nur als fertiger Upload eintrifft. Es kann kleine Audioblöcke verarbeiten, entscheiden, wann eine Äußerung beendet ist, viele Sprecher kennzeichnen und Sprach-, Schlüsselwort- und Kontexthinweise verwenden, um Namen oder Fachvokabular zu verbessern.
Muse Voice Transcribe wurde gemäß den zitierten Anbietermaterialien auf 1. September 2026 veröffentlicht.
Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API. Die in diesem Handbuch aufgeführten Zugriffsrouten sind Meta Model API und Meta.
0,18 $/Audiostunde. Meta listet diese Modell-API-Rate im überprüften Katalog auf. Die Produktkontingente in Meta AI für Mac oder Muse Code können unterschiedlich sein.
Verfügbar über Meta Model API, Meta AI für Mac und Muse Code während der öffentlichen Vorschau der Model API. Meta listet auf der öffentlichen Startseite keine modellspezifische Länder- oder Verarbeitungsregionenliste auf. Verwenden Sie die aktuellen Bedingungen für Entwicklerkonten.
Auf der Startseite von Meta wird der Datenschutz für seine öffentliche Demo beschrieben, nicht eine vollständige Aufbewahrung der Modell-API oder eine Verpflichtung zur Schulungsnutzung. Lesen Sie die aktuellen Model-API-Bedingungen und Unternehmenskontrollen, bevor Sie vertrauliche Audiodaten senden. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Verwandte Vergleiche
Das schnelle Batch-Transkriptionsmodell von Microsoft für lange Aufnahmen, Sprecherbezeichnungen, Wort-Timing, Keyword-Bias und saubere oder wörtliche Transkripte.
Vollständigen Vergleich öffnenDas allgemeine Sprach-zu-Text-Modell von Google Cloud für Streaming, Datei und kostengünstige dynamische Batch-Transkription in vielen Sprachen und Regionen.
Vollständigen Vergleich öffnenDas auf Genauigkeit ausgerichtete Transkriptionsmodell von AssemblyAI für Dateien und Live-Audio mit Code-Umschaltung, Sprecherbezeichnungen, Zeitstempeln und kontextbezogenen Eingabeaufforderungen.
Vollständigen Vergleich öffnenDas mehrsprachige Speech-to-Text-Modell von ElevenLabs für detaillierte Transkripte mit vielen Sprechern, Wortzeit, Audioereignissen und großen benutzerdefinierten Schlüsselbegriffslisten.
Vollständigen Vergleich öffnen