全モデル

AIモデル会社

Google AI モデル

Google は、Google DeepMind および Google Cloud の専門メディア、ドキュメント、音声、ワールド モデルとともに Gemini ファミリを開発します。アクセスは、Gemini API、Vertex AI、Google Cloud 製品、およびリサーチ プレビューの間で異なります。

11モデル9 モデルのカテゴリー公式ウェブサイト

Googleについて

Google のモデル

Google のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。

0.75 ドルのインプット · 3.75 ドルのアウトプット / 100 万トークン

ガイドを読む

Google の多用途画像主力製品は、高速生成、会話型編集、複数の参照、根拠のある画像、および最大 4K の出力を実現します。

$0.067 / 1K 画像

ガイドを読む

Google のプレビュー ビデオ モデルは、最大 4K のネイティブ オーディオおよび出力オプションを備えたテキスト、画像、およびビデオのガイド付き生成を可能にします。

720p または 1080p で 0.40 ドル/秒

ガイドを読む

Google の低コスト版 Veo 3.1 は、ネイティブ オーディオと最大 4K の出力オプションを備えた短いビデオ クリップを迅速に作成します。

$0.10 ~ $0.30 / 生成された秒数

ガイドを読む

Google のフラッグシップ音楽モデル。より豊かなアレンジ、表現力豊かなボーカル、構造化された歌詞、詳細なクリエイティブ コントロールを備えた、完成度の高い忠実度の高い曲を実現します。

$0.08 / フル曲

ガイドを読む

Google のプレビュー オーディオツーオーディオ モデル。マルチモーダルな認識、思考、検索グラウンディング、機能呼び出しを備えた低遅延対話を実現します。

$0.005/分オーディオ入力 · $0.018/分オーディオ出力

ガイドを読む

Google DeepMind の研究ワールド モデルは、テキストの説明からリアルタイムで探索できる、写真のようにリアルで制御可能な環境を生成します。

テキスト、画像、ビデオ、オーディオ、PDF を 1 つの検索可能なベクトル空間に配置するための Google のマルチモーダル埋め込みモデル。

テキスト $0.20 / 100 万トークン

ガイドを読む

Google Cloud の一般的な音声テキスト変換モデル。多くの言語と地域にわたるストリーミング、ファイル、低コストの動的バッチ文字起こしに使用されます。

標準 $0.016/分 · 動的バッチ $0.003/分

ガイドを読む