Inkling
カスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
カスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。
平易な英語による概要
Inkling は 9,750 億パラメータの専門家混合モデルですが、トークンごとに 410 億パラメータをアクティブにします。テキスト、画像、音声を推論したり、ツールを使用したり、タスクに費やす思考量を変更したりできます。
その主な魅力はコントロールです。 Apache-2.0 重みはインフラストラクチャ上で実行でき、Tinker はプレイグラウンドと微調整ワークフローを提供します。ホスト型パートナーを使用すると簡単に開始できますが、ルートごとに価格設定、プライバシー、ハードウェア、コンテキストの制限が異なります。
カテゴリ比較
これらはプロバイダーが公開した仕様であり、Cody ベンチマーク スコアではありません。現在の制限とエンドポイント固有の例外については、リンクされたソースに従ってください。
料金と比較
利用量を入力すると、見積もりが自動で更新されます。
例:10ページで入力6,000トークン、要約で出力500トークン。ページの長さに合わせて調整してください。
1回の実行で入力をモデルに送信し、回答を受け取ります。 トークンはテキストの小さな単位です。入力は送信する内容、出力は受け取る回答です。
Inkling
Thinking Machines Lab
合計見積額(USD)
上記の利用量に対する概算 · 米ドル · API料金(サブスクリプションではありません)
税金、ツール、キャッシュ保存・書き込み、無料枠、個別割引は含みません。画像は出力料金のみで、プロンプトや参照画像の料金は含みません。品質モードはモデルごとに異なります。未掲載の設定を無料とは扱いません。
APIとプロバイダーへのアクセス
可用性
Hugging Face のオープンウェイト、Tinker による微調整とプレイグラウンド、さらにホストされたパートナーおよびセルフホストの推論ルート。
セルフホスティングによって処理領域が決まります。 Tinker とパートナーの可用性は、各プロバイダーのアカウントと地域の規約に従います。
ライブの空き状況を確認するデータとトレーニング
オープンウェイトは自己ホストできるため、リクエストデータは管理するインフラストラクチャに留まります。 Tinker およびパートナーがホストするルートには、選択したプロバイダーに確認する必要がある個別の保持条件とトレーニング使用条件があります。
これは、引用された提供者の資料を簡潔にまとめたものであり、法的アドバイスではありません。サードパーティのゲートウェイには、モデル メーカーの直接 API とは異なるストレージ、ルーティング、トレーニング、常駐条件が適用される場合があります。
プロバイダーポリシーを読むよくある質問
カスタマイズ可能な推論、コーディング、ツール、ビジョン、オーディオ ワークフローのための Thinking Machines Lab の大型オープンウェイト モデル。 Inkling は 9,750 億パラメータの専門家混合モデルですが、トークンごとに 410 億パラメータをアクティブにします。テキスト、画像、音声を推論したり、ツールを使用したり、タスクに費やす思考量を変更したりできます。
引用されたプロバイダーの資料によると、Inkling は 2026年7月15日 でリリースされました。
Hugging Face のオープンウェイト、Tinker による微調整とプレイグラウンド、さらにホストされたパートナーおよびセルフホストの推論ルート。 このガイドに記載されているアクセスルートは Thinking Machines Lab、Hugging Face、Tinker です。
オープンウェイト。ホスト型の価格は異なります. モデルはApache2.0です。 Tinker、パートナー推論、セルフホスト型展開にはそれぞれ独自のコンピューティング コストと使用コストがかかります。
Hugging Face のオープンウェイト、Tinker による微調整とプレイグラウンド、さらにホストされたパートナーおよびセルフホストの推論ルート。 セルフホスティングによって処理領域が決まります。 Tinker とパートナーの可用性は、各プロバイダーのアカウントと地域の規約に従います。
オープンウェイトは自己ホストできるため、リクエストデータは管理するインフラストラクチャに留まります。 Tinker およびパートナーがホストするルートには、選択したプロバイダーに確認する必要がある個別の保持条件とトレーニング使用条件があります。 このポリシーはプロバイダーのルートとアカウントの条件に属しているため、運用環境で使用する前に再度確認してください。
表示APIの標準コンテキスト長での100万トークンあたりの米ドル料金。キャッシュや長いコンテキストの料金は異なる場合があります。対応する確認済み料金がないモデルは省略しています。安さは品質の高さを意味しません。
Mistral AI
OpenAI
OpenAI
Anthropic
Mistral AI
OpenAI
OpenAI
Anthropic
関連する比較
OpenAI の最も有能なモデルは、フロンティア推論と 100 万トークンのコンテキスト ウィンドウおよび幅広いエージェント ツール セットを組み合わせた、困難なエンドツーエンド作業に対応します。
完全な比較を開くOpenAI の主力汎用モデルは、非常に大きなコンテキスト ウィンドウと広範なネイティブ ツール セットを備え、難しいコーディング、分析、専門的な作業に対応します。
完全な比較を開くAnthropic のフロンティア モデルは、強力なビジョンとエンタープライズ マーケットプレイスの可用性を備えた、野心的で長期にわたるエージェントおよびコーディング作業向けです。
完全な比較を開くGoogle のエージェント、ソフトウェア作業、および大規模な混合メディア入力向けの安定した高効率のマルチモーダル モデルを、フラッシュ層のお試し価格で提供します。
完全な比較を開くダイレクト Web、X、およびコード ツールを使用した、コーディング、エージェント タスク、ナレッジ ワークのための SpaceXAI の最先端のテキストと画像モデル。
完全な比較を開く複数の AI エージェントを送信して難しい質問を並行して調査し、その作業を 1 つの調査済みの回答に結合する専門の Grok モデル。
完全な比較を開く256K のコンテキスト ウィンドウを備えた、要求の厳しいマルチモーダル、コーディング、推論、およびエージェントのワークフロー向けの Mistral のオープンウェイト フロンティア モデル。
完全な比較を開くMistral の低コストのオープン モデルで、通常の指示に従って、推論、コーディング、ビジョン、エージェント ツールを 1 つのエンドポイントに組み合わせています。
完全な比較を開くロングコンテキスト推論、コーディング、ツール、およびテキスト、画像、ビデオの理解のための Alibaba のフロンティア Qwen モデル。
完全な比較を開くMiniMax のコーディング、エージェント、コンピューター使用、長期プロジェクト向けの 100 万トークンのマルチモーダル モデルを、低価格の直接 API 価格で提供します。
完全な比較を開くZ.ai のオープンウェイト ロングコンテキスト推論モデルは、自己ホスト型および管理型ルートにわたるコーディング、ツール、およびエージェント作業用です。
完全な比較を開くMoonshot AI の 100 万トークンのコーディング、推論、ナレッジ ワーク、ツール駆動型エージェント向けのフロンティア マルチモーダル モデル。
完全な比較を開くテキスト タスク、長いコンテキスト、およびセルフホスト関数呼び出しワークフロー用の TII のコンパクトなオープン推論モデル。
完全な比較を開く多言語テキスト、コーディング、および制御されたセルフホスト アプリケーション向けの TII の 34B オープン命令モデル。
完全な比較を開く長期実行エージェント、コーディング、ツール、および複雑なユーザー コラボレーションのための Meta の最新のマルチモーダル推論モデル。
完全な比較を開くCeleris は、高速推論、ツール ループ、構造化アクション、および OpenAI 互換の統合を実現するエージェント中心の拡散言語モデルです。
完全な比較を開く複雑なエージェント、コーディング、計画、ツール、RAG、および百万トークン分析のための NVIDIA 最大の Nemotron 3 推論モデル。
完全な比較を開くNVIDIA のコンパクトな 30B 専門家混合モデルは、効率的な専門エージェントと大量のテキスト ワークフローを実現します。
完全な比較を開くAlibaba の効率的な 100 万コンテキスト マルチモーダル モデルは、高速エージェント、コーディング、文書作業、ビジョン、ビデオ理解、およびツールの使用を目的としています。
完全な比較を開くDeepSeek の主力の百万コンテキスト テキスト モデル。難しい推論、コーディング、長時間実行されるエージェント、ツール、および非常に大規模な出力に対応します。
完全な比較を開く大量の推論、コーディング、エージェント、および 100 万トークンのテキスト ワークロード向けの DeepSeek の低コスト V4 モデル。
完全な比較を開く