Scribe v2
Das mehrsprachige Speech-to-Text-Modell von ElevenLabs für detaillierte Transkripte mit vielen Sprechern, Wortzeit, Audioereignissen und großen benutzerdefinierten Schlüsselbegriffslisten.
Das mehrsprachige Speech-to-Text-Modell von ElevenLabs für detaillierte Transkripte mit vielen Sprechern, Wortzeit, Audioereignissen und großen benutzerdefinierten Schlüsselbegriffslisten.
Übersicht in einfacher englischer Sprache
Scribe v2 verwandelt lange Audio- oder Videodateien in strukturierte Transkripte mit Spracherkennung, Wortzeitstempeln, Sprechertagebüchern und Audio-Tags für Ereignisse, die über die Sprache hinausgehen. Schlüsselbegriffseingaben helfen Teams dabei, Namen, Produkte und Vokabeln beizubehalten, die bei allgemeinen Erkennungsmodellen häufig fehlen.
ElevenLabs bietet Dateitranskription und eine separat kostenpflichtige Echtzeitroute. Die breitere Plattform bietet auch Sprach- und Agentenprodukte, die Audio-Pipelines eines Anbieters vereinfachen können, obwohl jede Funktion über eigene Abrechnungs- und Datenkontrollen verfügt.
Kategorievergleich
Hierbei handelt es sich um vom Anbieter veröffentlichte Spezifikationen, nicht um Cody-Benchmark-Ergebnisse. Folgen Sie den verlinkten Quellen für aktuelle Grenzwerte und endpunktspezifische Ausnahmen.
Preise und Vergleiche
Geben Sie Ihre Nutzung ein. Die Schätzung wird sofort aktualisiert.
Nutzt die Aufnahmedauer in Stunden: 30 Minuten = 0,5 Stunden. Zusatzfunktionen und Mindestgebühren können die Rechnung ändern.
Scribe v2
ElevenLabs
Geschätzte Summe (USD)
Für die angegebene Nutzung · USD · API-Preis, kein Abonnement
Schätzungen ohne Steuern, Tools, Cache-Speicherung/-Schreiben, Freikontingente und individuelle Rabatte. Bei Bildern zählt nur die Ausgabe, nicht Prompt oder Referenzbilder. Qualitätsmodi unterscheiden sich. Nicht aufgeführte Einstellungen gelten nicht als kostenlos.
API- und Provider-Zugriff
Verfügbarkeit
Verfügbar über die ElevenLabs Speech-to-Text-API und Produktschnittstellen; Echtzeit verwendet eine separate Modellroute.
Globale Optionen und Datenresidenzoptionen hängen vom ElevenLabs-Plan, dem Endpunkt und der Unternehmenskonfiguration ab.
Überprüfen Sie die Live-VerfügbarkeitDaten und Schulung
Mit ElevenLabs können berechtigte API-Kunden ihre Datennutzungspräferenzen verwalten. Die Nulldatenaufbewahrung durch enable_logging=false ist auf qualifizierte Unternehmenskonfigurationen und unterstützte Modelle beschränkt, einschließlich Scribe v2; Überprüfen Sie den Live-Plan und den regionalen Endpunkt.
Hierbei handelt es sich um eine prägnante Lektüre des zitierten Anbietermaterials und nicht um eine Rechtsberatung. Ein Drittanbieter-Gateway kann andere Speicher-, Routing-, Schulungs- und Residenzbedingungen haben als die direkte API des Modellherstellers.
Lesen Sie die Richtlinien des AnbietersHäufig gestellte Fragen
Das mehrsprachige Speech-to-Text-Modell von ElevenLabs für detaillierte Transkripte mit vielen Sprechern, Wortzeit, Audioereignissen und großen benutzerdefinierten Schlüsselbegriffslisten. Scribe v2 verwandelt lange Audio- oder Videodateien in strukturierte Transkripte mit Spracherkennung, Wortzeitstempeln, Sprechertagebüchern und Audio-Tags für Ereignisse, die über die Sprache hinausgehen. Schlüsselbegriffseingaben helfen Teams dabei, Namen, Produkte und Vokabeln beizubehalten, die bei allgemeinen Erkennungsmodellen häufig fehlen.
Scribe v2 wurde gemäß den zitierten Anbietermaterialien auf 9. Januar 2026 veröffentlicht.
Verfügbar über die ElevenLabs Speech-to-Text-API und Produktschnittstellen; Echtzeit verwendet eine separate Modellroute. Die in diesem Handbuch aufgeführten Zugriffsrouten sind ElevenLabs und ElevenLabs API.
0,22 $/Audiostunde für Scribe v2. ElevenLabs listet separate Preise für Batch Scribe v2 und Scribe v2 Realtime auf. Die Erkennung und Schwärzung von Entitäten kann separat in Rechnung gestellt werden.
Verfügbar über die ElevenLabs Speech-to-Text-API und Produktschnittstellen; Echtzeit verwendet eine separate Modellroute. Globale Optionen und Datenresidenzoptionen hängen vom ElevenLabs-Plan, dem Endpunkt und der Unternehmenskonfiguration ab.
Mit ElevenLabs können berechtigte API-Kunden ihre Datennutzungspräferenzen verwalten. Die Nulldatenaufbewahrung durch enable_logging=false ist auf qualifizierte Unternehmenskonfigurationen und unterstützte Modelle beschränkt, einschließlich Scribe v2; Überprüfen Sie den Live-Plan und den regionalen Endpunkt. Die Richtlinie gehört zu den Routen- und Kontobedingungen des Anbieters. Überprüfen Sie sie daher vor der produktiven Nutzung erneut.
Verwandte Vergleiche
Das Streaming-Spracherkennungsmodell von Meta für Live-Untertitel, lange Audioinhalte, viele Sprecher, Code-Switching und domänenbezogene Transkription.
Vollständigen Vergleich öffnenDas schnelle Batch-Transkriptionsmodell von Microsoft für lange Aufnahmen, Sprecherbezeichnungen, Wort-Timing, Keyword-Bias und saubere oder wörtliche Transkripte.
Vollständigen Vergleich öffnenDas allgemeine Sprach-zu-Text-Modell von Google Cloud für Streaming, Datei und kostengünstige dynamische Batch-Transkription in vielen Sprachen und Regionen.
Vollständigen Vergleich öffnenDas auf Genauigkeit ausgerichtete Transkriptionsmodell von AssemblyAI für Dateien und Live-Audio mit Code-Umschaltung, Sprecherbezeichnungen, Zeitstempeln und kontextbezogenen Eingabeaufforderungen.
Vollständigen Vergleich öffnen