Universal-3.5 Pro
コードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。
コードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。
平易な英語による概要
Universal-3.5 Pro は、広範なクラウド カタログではなく、焦点を絞った文字起こし API を必要とする製品チーム向けの音声モデルです。アップロードされた録画とリアルタイム ストリームを処理し、ネイティブ コード スイッチングをサポートし、コンテキストやキーワードを使用して会社名や専門用語を改善できます。
AssemblyAI は、基本トランスクリプトをオプションのインテリジェンス機能から分離し、米国および EU のエンドポイントを提供します。これにより、請求書とデータ状態が構成可能になりますが、チームは宣伝されている時間あたりの基本料金だけでなく、リクエスト全体を比較する必要があることも意味します。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
録音時間を時間単位で入力します。30分=0.5時間です。追加機能や最低料金で請求額が変わる場合があります。
Universal-3.5 Pro
AssemblyAI
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
AssemblyAI の米国および欧州の API を通じて、非同期ファイルとリアルタイム ストリーミングを利用できます。
米国と EU のエンドポイントは文書化されています。機能と保持の動作は、エンドポイントとアカウントの契約によって異なる場合があります。
ライブの空き状況を確認するデータとトレーニング
AssemblyAI の保持とモデル トレーニングの動作は、エンドポイント、契約、BAA ステータス、EU の処理、およびオプトアウト設定によって異なります。そのドキュメントでは、適格なリアルタイム使用のためのゼロデータ保持オプションについて説明しています。正確なアカウント構成を確認してください。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
コードスイッチング、スピーカーラベル、タイムスタンプ、コンテキストプロンプトを備えた、ファイルとライブオーディオ用の AssemblyAI の精度重視の文字起こしモデル。 Universal-3.5 Pro は、広範なクラウド カタログではなく、焦点を絞った文字起こし API を必要とする製品チーム向けの音声モデルです。アップロードされた録画とリアルタイム ストリームを処理し、ネイティブ コード スイッチングをサポートし、コンテキストやキーワードを使用して会社名や専門用語を改善できます。
引用されたプロバイダーの資料によると、Universal-3.5 Pro は 2026年7月7日 でリリースされました。
AssemblyAI の米国および欧州の API を通じて、非同期ファイルとリアルタイム ストリーミングを利用できます。 このガイドに記載されているアクセスルートは AssemblyAI です。
$0.21 / オーディオ時間非同期 · $0.45 / ストリーミング. 非同期とストリーミングでは、同じモデル ファミリが選択されている場合でも、異なるルートとレートが使用されます。オプションのインテリジェンス機能によりコストが増加する可能性があります。
AssemblyAI の米国および欧州の API を通じて、非同期ファイルとリアルタイム ストリーミングを利用できます。 米国と EU のエンドポイントは文書化されています。機能と保持の動作は、エンドポイントとアカウントの契約によって異なる場合があります。
AssemblyAI の保持とモデル トレーニングの動作は、エンドポイント、契約、BAA ステータス、EU の処理、およびオプトアウト設定によって異なります。そのドキュメントでは、適格なリアルタイム使用のためのゼロデータ保持オプションについて説明しています。正確なアカウント構成を確認してください。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
関連する比較
Meta のストリーミング音声認識モデルは、ライブ キャプション、長い音声、多数のスピーカー、コード スイッチング、ドメイン対応の文字起こしに対応します。
完全な比較を開くMicrosoft の高速バッチ文字起こしモデルは、長時間の録音、話者ラベル、単語のタイミング、キーワードのバイアス、クリーンなトランスクリプトまたは逐語的なトランスクリプトに対応します。
完全な比較を開くGoogle Cloud の一般的な音声テキスト変換モデル。多くの言語と地域にわたるストリーミング、ファイル、低コストの動的バッチ文字起こしに使用されます。
完全な比較を開くElevenLabs の多言語音声テキスト変換モデル。多数の話者、単語のタイミング、音声イベント、および大規模なカスタム キーターム リストによる詳細なトランスクリプトを作成します。
完全な比較を開く