Falcon-H1R-7B
テキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
テキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
平易な英語による概要
Falcon-H1R-7B は、理論的に調整されたトランスフォーマーとマンバのハイブリッド モデルです。パラメータが 70 億あるため、フロンティアスケールのオープンモデルよりもテストとデプロイがはるかに簡単であり、文書化されたサービス設定は長いコンテキストと実質的な推論出力をサポートします。
モデル カードには、一般的なオープン推論ランタイムと関数呼び出しの例が含まれています。チームは依然としてサービス層を所有しているため、プロンプト テンプレート、ツール解析、量子化、ハードウェア、および安全制御が実装の一部です。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。
1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。
Falcon-H1R-7B
Technology Innovation Institute
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
一般的なオープン モデル ランタイムを通じてセルフホスト推論用のダウンロード可能な重みとして利用できます。
セルフホスティングによって処理領域が決まります。すべての管理対象ホストには、別の国およびデータ条件が適用されます。
ライブの空き状況を確認するデータとトレーニング
自己ホスト型推論は、リクエストをオペレーター自身のインフラストラクチャとデータ制御下に保ちます。サードパーティのホストは、個別のログ記録、保存、トレーニング条件を導入することができます。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
テキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。 Falcon-H1R-7B は、理論的に調整されたトランスフォーマーとマンバのハイブリッド モデルです。パラメータが 70 億あるため、フロンティアスケールのオープンモデルよりもテストとデプロイがはるかに簡単であり、文書化されたサービス設定は長いコンテキストと実質的な推論出力をサポートします。
引用されたプロバイダーの資料によると、Falcon-H1R-7B は 2026年1月5日 でリリースされました。
一般的なオープン モデル ランタイムを通じてセルフホスト推論用のダウンロード可能な重みとして利用できます。 このガイドに記載されているアクセスルートは Hugging Face です。
オープンウェイト。インフラストラクチャのコストはさまざまです. チェックポイントは Falcon LLM ライセンスを使用します。ホスティングのコストは、ハードウェア、コンテキスト、量子化、トラフィック、およびサードパーティの推論プロバイダーによって異なります。
一般的なオープン モデル ランタイムを通じてセルフホスト推論用のダウンロード可能な重みとして利用できます。 セルフホスティングによって処理領域が決まります。すべての管理対象ホストには、別の国およびデータ条件が適用されます。
自己ホスト型推論は、リクエストをオペレーター自身のインフラストラクチャとデータ制御下に保ちます。サードパーティのホストは、個別のログ記録、保存、トレーニング条件を導入することができます。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
表示APIの標準コンテキスト長での100万トークンあたりの米ドル料金。キャッシュや長いコンテキストの料金は異なる場合があります。対応する確認済み料金がないモデルは省略しています。安さは品質の高さを意味しません。
Mistral AI
OpenAI
OpenAI
Anthropic
Mistral AI
OpenAI
OpenAI
Anthropic
関連する比較
OpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。
完全な比較を開くOpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。
完全な比較を開くAnthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。
完全な比較を開くGoogle のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。
完全な比較を開くダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。
完全な比較を開く複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。
完全な比較を開くカスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
完全な比較を開く256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。
完全な比較を開くMistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
完全な比較を開くロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。
完全な比較を開くMiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。
完全な比較を開くZ.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。
完全な比較を開くMoonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。
完全な比較を開く多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。
完全な比較を開く長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。
完全な比較を開くCeleris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。
完全な比較を開く複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。
完全な比較を開くNVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。
完全な比較を開くAlibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。
完全な比較を開くDeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。
完全な比較を開く大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。
完全な比較を開く