Cara-4
Anam の表現力豊かなリアルタイム デジタル パーソン モデルは、画像ベースのアバター、感情の方向性、持ち込み AI コンポーネントとのライブ会話を実現します。
Anam の表現力豊かなリアルタイム デジタル パーソン モデルは、画像ベースのアバター、感情の方向性、持ち込み AI コンポーネントとのライブ会話を実現します。
平易な英語による概要
Cara-4 は、完全なビデオのレンダリングを待つのではなく、ライブ ビジュアル パフォーマンスを生成します。チームは、現実的な、3D、またはイラスト付きのアイデンティティから始めて、自然言語メモで直接表現し、Anam のスタックを使用するか、独自の言語および音声システムから音声を取り込むことができます。
Anam は、ポートレートおよびランドスケープの出力サイズとサーバー側のアバターの遅延を公開しており、インターフェイスの計画に役立ちます。実際の導入では、ターンテイキング、接続時間、デバイスのパフォーマンス、接続されているすべての AI サービスの遅延についてエンドツーエンドのテストが必要です。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
APIとプロバイダーへのアクセス
可用性
Anam の API とラボで利用でき、Web アプリケーションと主要なビデオ会議製品との統合が可能です。
Anam にはサービスと企業の管理が記載されていますが、開始ページにはモデル固有の国リストが 1 つも網羅されていません。
ライブの空き状況を確認するデータとトレーニング
Anam は、別途合意がない限り、顧客セッションのコンテンツはトレーニングに使用されないと述べています。デフォルトの録画は最大 30 日間保持できますが、エンタープライズによるゼロデータ保持も利用できます。正確なワークスペース設定を確認してください。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
Anam の表現力豊かなリアルタイム デジタル パーソン モデルは、画像ベースのアバター、感情の方向性、持ち込み AI コンポーネントとのライブ会話を実現します。 Cara-4 は、完全なビデオのレンダリングを待つのではなく、ライブ ビジュアル パフォーマンスを生成します。チームは、現実的な、3D、またはイラスト付きのアイデンティティから始めて、自然言語メモで直接表現し、Anam のスタックを使用するか、独自の言語および音声システムから音声を取り込むことができます。
引用されたプロバイダーの資料によると、Cara-4 は 2026年7月14日 でリリースされました。
Anam の API とラボで利用でき、Web アプリケーションと主要なビデオ会議製品との統合が可能です。 このガイドに記載されているアクセスルートは Anam です。
30 分間無料。超過料金はおよそ $0.11 ~ $0.16/分. 実効レートは、Anam のプランと含まれる分数によって異なります。エンタープライズ キャパシティとゼロ保持制御は個別にネゴシエートされます。
Anam の API とラボで利用でき、Web アプリケーションと主要なビデオ会議製品との統合が可能です。 Anam にはサービスと企業の管理が記載されていますが、開始ページにはモデル固有の国リストが 1 つも網羅されていません。
Anam は、別途合意がない限り、顧客セッションのコンテンツはトレーニングに使用されないと述べています。デフォルトの録画は最大 30 日間保持できますが、エンタープライズによるゼロデータ保持も利用できます。正確なワークスペース設定を確認してください。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
関連する比較
1 つの画像から人物、イラスト、または人間以外のキャラクターをアニメーション化し、既存の音声エージェント スタックに接続できるリアルタイム アバター モデル。
完全な比較を開くHeyGen のレンダリングされたアバター モデルは、短いアイデンティティ記録、スクリプト、または提供されたオーディオから洗練されたプレゼンター ビデオを作成します。
完全な比較を開くHedra のオーディオ駆動型キャラクター モデルは、1 つの画像、1 ~ 4 人のスピーカー、およびオプションのパフォーマンスの方向からトーキング ビデオを作成します。
完全な比較を開くSynthesia のビジネス ビデオ アバター モデルは、完全なエディター内でスクリプト対応の音声、ジェスチャー、体の動作、多言語プレゼンター コンテンツを実現します。
完全な比較を開く