全モデル
Inworld AI

Inworld Realtime TTS-2

Inworld の最新の表現力豊かなリアルタイム テキスト読み上げモデル。会話の内容を記憶し、100 以上の言語で話すように設計されています。

平易な英語による概要

Inworld Realtime TTS-2 とは実際には何ですか

Inworld Realtime TTS-2 は、キャラクターの配信の一貫性を保つために以前のオーディオ ターンを使用しながら、テキストをストリーミング音声に変換します。開発者は、希望する雰囲気や表現を自然言語で説明したり、言語を切り替えたり、権利やアカウント設定が許可する場合は音声クローンを使用したりできます。

価格はオーディオ トークンではなくキャラクターに基づいているため、スクリプトの見積もりが容易になります。 Inworld は、最初の音声までの時間の中央値が 200 ミリ秒未満であると報告していますが、ネットワークの距離、アプリケーションの動作、上流の言語モデルが依然として完全な応答時間に影響を与えます。

ぴったりフィット

  • リアルタイムの仲間とサポートボイス
  • 一貫した音声による多言語エクスペリエンス
  • クリエイティブな音声ディレクションと承認されたクローン作成

カテゴリ比較

声 モデルにとって重要な事実

これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。

価格ベース
オンデマンドで 25 ドル / 100 万文字。ボリュームディスカウントリストされたアクセス ルートのトークン、文字、または分ベースの価格。
インタラクションモード
事前音声コンテキストを備えたステアリング可能なリアルタイム TTS音声合成、音声合成、またはストリーミングされたテキスト読み上げの動作。
公表されたレイテンシ
TTFA 中央値 200 ミリ秒未満プロバイダーが公表した測定値と、明示された除外事項。 Cody テストではありません。
言語
100+(発話途中の切り替えあり)プロバイダーが文書化した言語範囲または明確な未公開マーカー。
ツールとコントロール
音声ディレクション、デザイン、クローン、非言語ネイティブ関数の呼び出し、推論、または音声制御機能。
コンテキストまたは入力制限
非公開意味のある場合は、トークンまたは文字制限を文書化します。

APIとプロバイダーへのアクセス

Inworld Realtime TTS-2の入手場所

可用性

地域とアクセス段階

Inworld の REST TTS API および OpenAI 互換の Realtime API を通じて一般的に利用可能です。

標準地域のカバー範囲はモデル ページには記載されていません。エンタープライズ プランでは、EU およびインドのデータ常駐オプションを宣伝しています。

ライブの空き状況を確認する

データとトレーニング

ルートは重要です。

Inworld はエンタープライズ アドオンとしてデータ保持ゼロを宣伝していますが、現在公開されている ZDR サポート ページでは TTS-1.5 Mini と Max のみが名前として挙げられています。規制されたテキストまたは機密テキストを送信する前に、TTS-2 の範囲を直接確認してください。

これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。

プロバイダーポリシーを読む

よくある質問

Inworld Realtime TTS-2 よくある質問

Inworld Realtime TTS-2とは何ですか?

Inworld の最新の表現力豊かなリアルタイム テキスト読み上げモデル。会話の内容を記憶し、100 以上の言語で話すように設計されています。 Inworld Realtime TTS-2 は、キャラクターの配信の一貫性を保つために以前のオーディオ ターンを使用しながら、テキストをストリーミング音声に変換します。開発者は、希望する雰囲気や表現を自然言語で説明したり、言語を切り替えたり、権利やアカウント設定が許可する場合は音声クローンを使用したりできます。

Inworld Realtime TTS-2 はいつリリースされましたか?

引用されたプロバイダーの資料によると、Inworld Realtime TTS-2 は 2026年8月31日 でリリースされました。

Inworld Realtime TTS-2 にはどこからアクセスできますか?

Inworld の REST TTS API および OpenAI 互換の Realtime API を通じて一般的に利用可能です。 このガイドに記載されているアクセスルートは Inworld AI です。

Inworld Realtime TTS-2の価格はいくらですか?

オンデマンドで 100 万文字あたり 25 ドル. 公開されているサブスクリプション料金は、ティアごとに 100 万文字あたり 20 ドル、17.50 ドル、15 ドル、12.50 ドルに下がり、エンタープライズ価格は 5 ドルという低価格で宣伝されています。

Inworld Realtime TTS-2 はどこで入手できますか?

Inworld の REST TTS API および OpenAI 互換の Realtime API を通じて一般的に利用可能です。 標準地域のカバー範囲はモデル ページには記載されていません。エンタープライズ プランでは、EU およびインドのデータ常駐オプションを宣伝しています。

私の Inworld Realtime TTS-2 API データはトレーニングに使用されますか?

Inworld はエンタープライズ アドオンとしてデータ保持ゼロを宣伝していますが、現在公開されている ZDR サポート ページでは TTS-1.5 Mini と Max のみが名前として挙げられています。規制されたテキストまたは機密テキストを送信する前に、TTS-2 の範囲を直接確認してください。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。

関連する比較

モデル別の詳細比較

  1. Inworld Realtime TTS-2 vs Gemini 3.8 Flash TTS

    表現豊かなナレーション、キャラクターボイス、対話を130言語で生成するGoogleの音声モデルです。

    完全な比較を開く
  2. Inworld Realtime TTS-2 vs Gemini 3.8 Flash-Lite TTS

    101言語での読み上げ機能や大量の音声制作に向けた、Googleの低コスト音声生成モデルです。

    完全な比較を開く
  3. Inworld Realtime TTS-2 vs GPT-Live 1

    OpenAI の全二重音声フロントエンドは、自然な会話を実現し、より深い推論とアクションを別のバックエンド エージェントに委任します。

    完全な比較を開く
  4. Inworld Realtime TTS-2 vs Gemini 3.8 Live

    音声・テキスト・視覚情報を使った応答性の高い会話向けのGoogleのリアルタイム音声モデル。

    完全な比較を開く
  5. Inworld Realtime TTS-2 vs Gemini 3.8 Live Extended Thinking

    会話を続けながら複雑なリクエストをバックグラウンドで処理する、独立したGemini音声モデル。

    完全な比較を開く
  6. Inworld Realtime TTS-2 vs GPT-Realtime-2.1

    OpenAI のリアルタイム音声合成推論モデルは、テキストと画像のコンテキストも必要とするツールを使用する音声エージェント向けです。

    完全な比較を開く
  7. Inworld Realtime TTS-2 vs Gemini 3.1 Flash Live Preview

    Google のプレビュー オーディオツーオーディオ モデル。マルチモーダルな認識、思考、検索グラウンディング、機能呼び出しを備えた低遅延対話を実現します。

    完全な比較を開く
  8. Inworld Realtime TTS-2 vs Eleven v3 Conversational

    ElevenLabs の表現力豊かなリアルタイム テキスト読み上げモデルは、自然な対話、感情表現、オーディオ タグ、および 70 以上の言語に対応します。

    完全な比較を開く
  9. Inworld Realtime TTS-2 vs Grok Voice Think Fast 2.0

    SpaceXAI の現在のリアルタイム音声合成モデルは、ツールにアクセスできる 1 秒未満の会話エージェント向けです。

    完全な比較を開く