Large 3 との比較

Mistral Large 4 と Mistral Large 3 の比較

Mistral Large 4 は単なるマイナーアップデートではありません。総パラメータは675Bから1.05兆へ増え、Large 3 になかった切り替え式の推論モードを搭載し、提供コンテキストは2倍の524,288トークンに、学習言語は160以上に広がりました。その分、通常価格は Large 3 の約2.7倍です(現在の50%オフ期間中は約1.4倍)。

2026-10-06 更新・執筆:suifeng

Mistral Large 4 の基本データ

開発元
Mistral AI(フランス・パリ)
リリース
2026年10月6日(パブリックプレビュー)
パラメータ数
総数1.05兆、1トークンあたり49Bがアクティブ(Mixture of Experts)
コンテキスト長
API で524,288トークン
最大出力
262,144トークン
入力/出力
テキストと画像を入力、テキストを出力
API 料金(セール中)
100万トークンあたり入力$0.68/出力$2.09(通常価格 $1.36/$4.18)
API モデル名
mistral-large-4
推論モード
reasoning_effort: "high" または "none"
オープンウェイト
2026年10月末に公開予定

出典:Mistral AI の発表と料金ページ、OpenRouter のモデル掲載情報、Hugging Face のモデルページ(2026年10月6日確認)。

Large 3 から Large 4 で変わったこと

2つのリリースの間は10か月です。Mistral Large 3(2512)は2025年12月2日に登場し、Mistral Large 4 は2026年10月6日にパブリックプレビューとして公開されました。主な変化は、規模、推論、コンテキストの3点です。

  • 規模:総パラメータ1.05兆、1トークンあたりのアクティブ49B。Large 3 の総数675B、アクティブ41Bから増加しています(総数+56%、アクティブ+20%)。
  • 推論:Large 4 は reasoning_effort("high" または "none")で制御する、指示応答と推論のハイブリッドモデルです。Large 3 のモデルカードでは、推論専用モデルではないとされています。
  • コンテキスト:API で提供されるのは524,288トークン(Mistral のドキュメント上は1M)で、Large 3 の256Kから拡大しました。
  • 言語:学習データは EU の全公用語を含む160以上の言語をカバーしています。Large 3 のカードに記載されている言語は数十です。
  • 画像:どちらも画像を読み取れます。Large 4 は1.6B、Large 3 は2.5Bのビジョンエンコーダーを使っています。
  • ライセンス:Large 3 は Apache 2.0 です。Large 4 のライセンスはまだ発表されていません。

スペック比較表

ビジョンエンコーダーのサイズを除くすべての性能面の数値で Large 4 が上回っていますが、今すぐ重みを使えるという点では Large 3 に分があります。

スペックMistral Large 4Mistral Large 3(2512)
リリース2026年10月6日(パブリックプレビュー)2025年12月2日
総パラメータ/アクティブ1.05兆 / 49B(埋め込み込みで52B)675B / 41B
ビジョンエンコーダー1.6Bパラメータ2.5Bパラメータ
コンテキスト長524,288トークンで提供(ドキュメント上は1M)256K(262,144トークン)
最大出力262,144トークン209,715トークン(OpenRouter)
推論モードあり、reasoning_effort は high または none推論専用モデルではない
言語学習データで160以上数十
重み2026年10月末に公開予定公開済み:FP8、NVFP4、BF16
ライセンスまだ発表されていませんApache 2.0
出典:Mistral Docs、Mistral Large 4 のリリース記事、Hugging Face のモデルカード、OpenRouter(2026年10月6日確認)。

100万トークンあたりの価格差

通常価格では Mistral Large 4 は Mistral Large 3 の約2.7〜2.8倍ですが、Mistral の期間限定50%オフの間は約1.4倍にとどまります。倍率は「Large 4 の価格 ÷ Large 3 の価格」です。

100万トークンあたり(米ドル)Large 4 通常Large 4 セールLarge 3通常価格での倍率セール価格での倍率
入力$1.36$0.68$0.502.72×1.36×
キャッシュ入力$0.14$0.07$0.052.80×1.40×
出力$4.18$2.09$1.502.79×1.39×
バッチ 入力/出力$0.68 / $2.09$0.34 / $1.045$0.25 / $0.752.72× / 2.79×1.36× / 1.39×
出典:Mistral Docs の料金ページ。倍率は当サイトで計算(2026年10月6日確認)。

一般的な1か月の費用を比較

月に入力3,000万トークン、出力1,000万トークンのワークロードなら、Large 3 で$30.00、Large 4 のセール価格で$41.30、Large 4 の通常価格で$82.60です。

計算式は次のとおりです。Large 3 = 30 × $0.50 + 10 × $1.50 = $30.00、Large 4 セール = 30 × $0.68 + 10 × $2.09 = $41.30、Large 4 通常 = 30 × $1.36 + 10 × $4.18 = $82.60。推論の出力も出力トークンとして数えられるため、単純なプロンプトで reasoning_effort を "high" のままにしておくと Large 4 の請求額はさらに増えます。Artificial Analysis は Large 4 を「非常に冗長」と評価しています(インデックスでの出力2億トークン、中央値は8,100万)。

チャットで使うだけなら、トークン計算そのものが不要です。当サイトの Pro プランは月額$39.90または年額$199.90で毎月3,000クレジット使え、1クレジットは短い回答およそ1件分です。

この内容について質問がありますか?

Mistral Large 4 に直接聞いてみましょう。無料アカウントなら毎日15クレジット使えます。

今すぐ質問する

性能はどれだけ上がった?公表データから見る

Mistral は Large 4 のリリース時グラフに Large 3 を載せておらず、現在の44モデルの Vals Index にも Large 3 は含まれていないため、両者を同じベンチマークで比べた行はありません。Mistral が公表しているのは、現行のもう1つのモデルである Mistral Medium 3.5 と Large 4 の比較で、その差は大きく開いています。

通常価格で比べても、Large 4 は Medium 3.5 より安く、100万トークンあたり$1.36/$4.18に対して Medium 3.5 は$1.50/$7.50です。

ベンチマークMistral Large 4Mistral Medium 3.5
AutomationBench(657ワークフロー)59.9%6.3%
Finance Agent v254.732.1
Finch(FinWorkBench)67.436.7
SciCode-Verified pass@191.870
ChartQA Pro63.155.4
出典:Mistral Large 4 のリリース記事(メーカー公表値、2026年10月6日確認)。

セルフホスト:Large 3 は今すぐ、Large 4 はより多くのメモリが必要

Large 3 の FP8 の重みは約675GBで、H200 8基の1ノード(1,128GB)に約453GBの余裕を残して収まります。Large 4 の FP8 の重みは約1,050GBで、同じノードでは残りが約78GBしかありません。4ビットなら Large 3 は約338GB、Large 4 は約525GBで、どちらも H100 8基(640GB)に収まります。

Large 3 は現在 vLLM 1.12.0 以降で動きます。Large 4 への対応を発表した推論エンジンはまだありません。メモリの詳しい内訳は「ローカル実行」ガイドにまとめています。

Large 3 から API 呼び出しを切り替える

Large 4 への移行は、基本的に同じ chat completions エンドポイントでモデル名を mistral-large-4(エイリアス mistral-large-4-0)に変えるだけです。コード変更が必要なのは2点で、reasoning_effort が "high" のときはメッセージの content が文字列ではなく思考チャンクとテキストチャンクのリストになること、そして Mistral のドキュメントでは、複数ターンの履歴に思考チャンクを含むアシスタントメッセージ全体を送り返すよう求めていることです。

reasoning_effort を "none" にすれば、Large 3 のコードがすでに処理しているプレーンな文字列のレスポンスのまま使えます。

# Set API_KEY to your Mistral API key first
curl https://api.mistral.ai/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $API_KEY" \
  -d '{"model":"mistral-large-4","messages":[{"role":"user","content":"Summarize this contract clause."}],"reasoning_effort":"none"}'

出典

FAQ

Large 3 との比較のよくある質問

あわせて読みたい

Mistral Large 4 についてもっと見る

Mistral Large 4 に、実際の課題を聞いてみましょう

バグのあるコード、契約書の条文、ごちゃごちゃした表のメモなどを貼り付けるだけ。無料アカウントなら毎日15クレジット使えます。

無料で始める