音声認識と文字起こし に戻る

機種比較

Muse Voice Transcribe vs Scribe v2

Compare Muse Voice Transcribe and Scribe v2 using the same provider-sourced 音声認識と文字起こし rubric.謎のスコアや発明されたベンチマークランキングはありません。

事実確認済み 2026年9月4日

コストを見積もる

利用量を入力すると、見積もりが自動で更新されます。

録音時間を時間単位で入力します。30分=0.5時間です。追加機能や最低料金で請求額が変わる場合があります。

見積もりの仕組み

税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。

コストを見積もる
モデル合計見積額(USD)
Muse Voice TranscribeMeta確認済み料金なし
Scribe v2ElevenLabs確認済み料金なし

クイックテイク

Muse Voice Transcribe

Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。

こんな方に最適

  • ライブキャプションと会話型インターフェース
  • 複数の講演者による会議と長時間の録音
  • キーワードまたはコンテキストのバイアスが必要な商品

気をつけてください

モデル API はパブリック プレビュー段階にあり、パブリック デモのプライバシー ステートメントは完全な API データ ポリシーではありません。起動前に、エンドポイントのリージョン、保持、トレーニングの使用、およびサポートされている正確な言語リストを確認してください。

Scribe v2

ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。

こんな方に最適

  • 多言語メディアの文字起こし
  • 多数のスピーカーまたはサウンドイベントによる録音
  • オーディオ スタックはすでに ElevenLabs を使用しています

気をつけてください

バッチとリアルタイムが同じルートまたは価格であると想定しないでください。ゼロデータ保持は自動ではなく条件付きであるため、機密オーディオを処理する前に、プラン、エンドポイント、リージョン、およびenable_loggingの動作を確認してください。

公表された事実を比較する

Muse Voice Transcribe vs Scribe v2

値には、各プロバイダーが独自に公開している単位と制限が使用されます。空白は、プロバイダーがレビューされた情報源で直接比較可能な値を公開していないことを意味します。

音声認識と文字起こしMuse Voice TranscribeScribe v2
転写価格リストされた処理ルートの音声時間または分あたりの現在のプロバイダーの料金。$0.18 / 音声時間$0.22/音声時間。リアルタイムは別途記載
ライブまたはバッチモデルがリアルタイム ストリーム、アップロードされた録画、またはその両方を処理するかどうか。リアルタイムストリーミングと長編オーディオバッチおよび長い音声。別のリアルタイムルート
言語プロバイダーが公開する言語のカバレッジ。必要に応じて、トレーニングまたは宣伝されたカバレッジを、特別に検証された言語から分離します。70 以上の言語についてトレーニングを受けています。 25具体的に検証済み90以上の言語
スピーカーラベルモデルが誰が発言したか、および公開されている発言者の制限を識別するかどうか。はい。 20名以上の講演者が宣伝されています最大 32 個のスピーカー
タイムスタンプ利用可能な単語、セグメント、または発話レベルのタイミング情報。ストリーミングトランスクリプトのタイミングとエンドポイントワードレベルのタイムスタンプ
語彙コントロールキーワードブースティング、カスタムスペル、コンテキスト、プロンプト、またはドメイン用語を改善するその他の方法。言語、キーワード、およびコンテキストのバイアス。コードスイッチング最大 1,000 個のキーワード。オーディオタグと言語検出
どこで使用するかプロバイダーによって文書化されたダイレクト API、クラウド カタログ、アプリケーション、または地域のエンドポイント。Meta Model API、Meta AI for Mac、Muse コードElevenLabs Speech-to-Text API

選び方

誇大宣伝ではなく、仕事を比較してください。

完了する必要があるジョブから始めて、正確なプロバイダー ルートのコスト、アクセス、ポリシーの詳細を検証します。

Muse Voice Transcribe

Meta の開始ページでは、完全なモデル API の保持やトレーニング使用の約束ではなく、公開デモのプライバシーについて説明しています。機密音声を送信する前に、現在の Model API 規約とエンタープライズ コントロールを確認してください。

Scribe v2

ElevenLabs を使用すると、対象となる API 顧客がデータ使用設定を管理できます。 Enable_logging=false によるゼロデータ保持は、Scribe v2 を含む、対象となるエンタープライズ構成およびサポートされているモデルに限定されます。ライブ プランとリージョン エンドポイントを確認します。

よくある質問

Muse Voice Transcribe と Scribe v2 のよくある質問

Muse Voice Transcribe と Scribe v2 の主な違いは何ですか?

Muse Voice Transcribe: Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。 Scribe v2: ElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。

Muse Voice Transcribe または Scribe v2 を選択する必要がありますか?

優先順位が ライブキャプションと会話型インターフェース の場合は、Muse Voice Transcribe を検討してください。優先順位が 多言語メディアの文字起こし の場合は、Scribe v2 を検討してください。 Test both with your own data and provider route before committing.

これは Muse Voice Transcribe と Scribe v2 の比較は Cody ベンチマークに基づいていますか?

いいえ。この比較は、プロバイダーが公開した 音声認識と文字起こし カテゴリの事実を一致させます。普遍的な勝者を主張したり、互換性のないサードパーティのベンチマーク スコアを組み合わせたりするものではありません。