Mistral Small 4
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
平易な英語による概要
Mistral Small 4 は、6.5B のアクティブ パラメータを備えた 119B の専門家混合アーキテクチャを使用します。これは、開発者が個別の指示、推論、コーディング モデルを切り替えることなく、日常のアシスタント作業とより深い推論をカバーできるように設計されています。
このモデルは 256K のコンテキスト ウィンドウを維持しながら、Mistral のホスト型 API での料金は Medium 3.5 より大幅に低くなります。 Apache-2.0 の重みは、チームがローカル制御、カスタム提供、またはオフライン開発ルートを必要とする場合にも魅力的です。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。
1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。
Mistral Small 4
Mistral AI
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。
ホストされた地域推論は、サポートされている EU および米国のエンドポイントを通じて 10% の追加料金で提供されます。セルフホスティングにより、オペレータは直接領域を制御できます。
ライブの空き状況を確認するデータとトレーニング
Mistral の商業条件では、顧客がオプトインするか、指定されたラボまたはプレビュー モデルを使用する場合を除き、デフォルトでモデル トレーニングが除外されます。セルフホスティングは、推論データをオペレーターの制御下に保ちます。ホスト型 API の保持期間は、ゼロ データ保持が有効になっていない限り、通常 30 日間です。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
Mistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。 Mistral Small 4 は、6.5B のアクティブ パラメータを備えた 119B の専門家混合アーキテクチャを使用します。これは、開発者が個別の指示、推論、コーディング モデルを切り替えることなく、日常のアシスタント作業とより深い推論をカバーできるように設計されています。
引用されたプロバイダーの資料によると、Mistral Small 4 は 2026年3月16日 でリリースされました。
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。 このガイドに記載されているアクセスルートは Mistral AI、Mistral Studio です。
0.15 ドルのインプット · 0.60 ドルのアウトプット / 100 万トークン. ミストラルの標準ホスト型定価。重みは Apache 2.0 です。セルフホスト型のコストはインフラストラクチャによって異なります。
Mistral API および Studio を通じて、またセルフホスティング用の Apache-2.0 オープン ウェイトとして利用できます。 ホストされた地域推論は、サポートされている EU および米国のエンドポイントを通じて 10% の追加料金で提供されます。セルフホスティングにより、オペレータは直接領域を制御できます。
Mistral の商業条件では、顧客がオプトインするか、指定されたラボまたはプレビュー モデルを使用する場合を除き、デフォルトでモデル トレーニングが除外されます。セルフホスティングは、推論データをオペレーターの制御下に保ちます。ホスト型 API の保持期間は、ゼロ データ保持が有効になっていない限り、通常 30 日間です。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
全モデルに同じ入出力比率を適用します。合計100万トークンに占める割合で各API料金を加重し、確認済みの対応するアクセス先から最安のものを使用します。比較用の単価であり、タスクごとの費用や品質スコアではありません。トークンの分割方法、キャッシュ、推論、長いコンテキストによって実際の請求額は変わります。
入力75%+出力25%・キャッシュ割引なし
OpenAI
Mistral AI
このモデル
OpenAI
Anthropic
OpenAI
Anthropic
OpenAI
OpenAI
Anthropic
OpenAI
Anthropic
Anthropic
OpenAI
Anthropic
関連する比較
情報抽出、分類、短い返信など、特定のタスクを大量に繰り返す用途向けの低コストなOpenAIモデルです。
完全な比較を開く大規模なコード変更、詳細な調査、多段階の業務向けのClaudeモデル。
完全な比較を開くコーディング、分析、ツールを使うアシスタント向けの低価格なGPT-5.6モデル。
完全な比較を開く短い定型タスクを大量に処理するための低価格なGPT-5.6モデル。
完全な比較を開く複雑なコーディングや多段階の作業に対応する初代Fableモデル。既存の連携向けに引き続き提供されています。
完全な比較を開く大規模なコード変更、推論、多段階の業務フロー向けのClaudeモデル。
完全な比較を開く日常的なコーディング、文章作成、ツールを使った作業向けの低価格なClaudeモデル。
完全な比較を開く素早い応答、分類、用途を絞ったアシスタント向けのコンパクトなClaudeモデル。
完全な比較を開くOpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。
完全な比較を開くOpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。
完全な比較を開くAnthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。
完全な比較を開くGoogle のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。
完全な比較を開くダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。
完全な比較を開く複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。
完全な比較を開くカスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
完全な比較を開く256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。
完全な比較を開くロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。
完全な比較を開くMiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。
完全な比較を開くZ.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。
完全な比較を開くMoonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。
完全な比較を開くテキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
完全な比較を開く多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。
完全な比較を開く長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。
完全な比較を開くCeleris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。
完全な比較を開く複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。
完全な比較を開くNVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。
完全な比較を開くAlibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。
完全な比較を開くDeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。
完全な比較を開く大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。
完全な比較を開く