API 价格

Mistral Large 4 API 价格(2026 年 10 月 6 日核对)

Mistral Large 4 API 的原价是每百万输入 token $1.36、每百万输出 token $4.18、每百万缓存输入 token $0.14。Mistral AI 目前限时五折:输入 $0.68、输出 $2.09、缓存 $0.07。用下面的计算器,把这些单价换算成你自己业务量下的月度账单。

更新于 2026 年 10 月 7 日 · 作者 suifeng

Mistral Large 4 的费用为 $92.80 / 月(每次请求 $0.0019)

模型输入 $/百万输出 $/百万每月
Mistral Large 3$0.50$1.50$67.50
DeepSeek V4 Pro(闲时)$0.66$1.98$89.10
Mistral Large 4$0.68$2.09$92.80
DeepSeek V4 Pro(高峰)$1.32$3.96$178
Mistral Large 4(原价)$1.36$4.18$186
GLM-5.3$1.40$4.40$193
Qwen3.8 Max$2.00$6.00$270
Claude Sonnet 5.5$2.00$10.00$350
GPT-6.1 Sol$2.00$10.00$350
Claude Opus 5.5$4.00$20.00$700
GPT-6 Astra$10.00$50.00$1,750

每百万 token 价格取自各家定价页和 OpenRouter,核对于 2026 年 10 月 6 日。Mistral Large 4 正在首发五折。

Mistral Large 4 关键数据

开发方
Mistral AI(法国巴黎)
发布时间
2026 年 10 月 6 日(公开预览)
参数量
总参数 1.05 万亿,每个 token 激活 49B(混合专家 MoE)
上下文窗口
API 提供 524,288 token
最大输出
262,144 token
输入 / 输出
输入文本和图片,输出文本
API 价格(限时价)
每百万 token 输入 $0.68 / 输出 $2.09(原价 $1.36 / $4.18)
API 模型名
mistral-large-4
推理模式
reasoning_effort: "high" 或 "none"
开放权重
计划 2026 年 10 月底发布

来源:Mistral AI 发布公告和定价页、OpenRouter 模型页、Hugging Face 模型页,核对于 2026 年 10 月 6 日。

Mistral Large 4 每百万 token 价格

现在付的是原价的一半。Mistral 定价页把 $1.36 / $4.18 划掉,标注 $0.68 / $2.09 为限时促销价。每一项都正好打五折:0.68 ÷ 1.36、2.09 ÷ 4.18、0.07 ÷ 0.14 都等于 0.50。

缓存输入是账单上最便宜的一项。缓存 token 的价格大约是普通输入 token 的十分之一(促销价下 $0.07 对 $0.68),所以长系统提示词、反复引用的文档,从第二次调用开始会便宜很多。

token 类型原价(每百万)当前促销价(每百万)
输入$1.36$0.68
缓存输入$0.14$0.07
输出$4.18$2.09
来源:Mistral Docs 定价页和 Mistral Large 4 模型卡,核对于 2026 年 10 月 6 日。

Batch、优先和区域推理档位

Batch(批处理)是跑 Large 4 最便宜的方式:在现价基础上再打五折,按当前促销价,每百万输入 token $0.34、每百万输出 token $1.045。优先处理加价 75%,换来更快的专属算力;区域推理(例如 Mistral 自营的欧洲部署)加价 10%。

四个档位都同样享受这次限时五折,所以不管你看到这页时执行的是哪个价格,档位之间的差距都不变。

档位输入 原价 / 促销价缓存 原价 / 促销价输出 原价 / 促销价
标准$1.36 / $0.68$0.14 / $0.07$4.18 / $2.09
Batch(−50%)$0.68 / $0.34$0.07 / $0.035$2.09 / $1.045
优先(+75%)$2.38 / $1.19$0.245 / $0.1225$7.315 / $3.6575
区域推理(+10%)$1.496 / $0.748$0.154 / $0.077$4.598 / $2.299
来源:Mistral Docs 定价页(每百万 token,美元),核对于 2026 年 10 月 6 日。

为什么 OpenRouter 和 Vercel 也是 $0.68 / $2.09

OpenRouter 和 Vercel AI Gateway 直接沿用 Mistral 自己的促销价,所以三家的单价完全一样。OpenRouter 上 mistralai/mistral-large-4-0 的接口数据带有 0.5 的折扣值,而且目前只有 Mistral 一家在提供这个模型。

Mistral 没有公布促销什么时候结束。有些文章说折扣只持续头两周,但 Mistral 的页面上没有写任何日期。Artificial Analysis、Vals AI 等评测网站都按 $1.36 / $4.18 原价计算成本,所以做下个月以后的预算,建议按原价算。

购买渠道模型 ID输入 / 输出(每百万)缓存输入(每百万)
Mistral Studio APImistral-large-4$0.68 / $2.09(原价 $1.36 / $4.18)$0.07
OpenRoutermistralai/mistral-large-4-0$0.68 / $2.09$0.07
Vercel AI Gatewaymistral/mistral-large-4$0.68 / $2.09未列出
来源:Mistral Docs、OpenRouter 接口数据、Vercel AI Gateway 模型页,核对于 2026 年 10 月 6 日。

真实业务量要花多少钱

账单的大头是输出 token,因为输出单价差不多是输入的三倍。下面的例子按“token 数 ÷ 1,000,000 × 单价”计算,每月按 30 天算;想要更准的估算,把你自己的数字填进上面的计算器。

开启推理会让输出变长。reasoning_effort 设为 "high" 时,模型会先返回思考内容再给答案。Artificial Analysis 跑完整套测试时记录到 Large 4 用了 200M 输出 token,而各模型的中位数是 81M,因此把它评为“非常啰嗦”。简单任务把 reasoning_effort 设为 "none",输出就能保持简短。

业务场景按促销价按原价
单次调用:10K 输入 + 2K 输出$0.011$0.022
一次长文档摘要:100K 输入 + 2K 输出$0.072$0.144
把 524,288 token 上下文一次填满(只算输入)$0.36$0.71
一条 262,144 token 的最长回答(只算输出)$0.55$1.10
聊天机器人:每天 1,000 次请求,每次 2K 输入 + 500 输出,无缓存$72.15 / 月$144.30 / 月
同一个聊天机器人,70% 的输入命中缓存$46.53 / 月$93.06 / 月
编程智能体:每天 200 次调用,每次 50K 输入 + 5K 输出$266.70 / 月$533.40 / 月
通过 Batch 处理 10M 输入 + 2M 输出$5.49$10.98
来源:按 Mistral Docs 定价(每百万 token)计算,核对于 2026 年 10 月 6 日。

对这部分有疑问?

直接问 Mistral Large 4。免费账号每天送 15 积分。

马上提问

Mistral Large 4 和 DeepSeek V4、GPT-6、Claude 等模型比价

按促销价,Large 4 和闲时的 DeepSeek V4 Pro 价格差不多,比美国的旗舰模型便宜得多。按原价算,它的输入比 Claude Opus 5.5 便宜 2.9 倍、输出便宜 4.8 倍;比 GPT-6 Astra 分别便宜 7.4 倍和 12 倍。在 Mistral 自家产品线里,它比 Mistral Large 3($0.50 / $1.50)贵,但每个输出 token 比 Mistral Medium 3.5($7.50)便宜。

最后一列把同一份固定业务量(1000 万输入 + 200 万输出 token)套到每个模型上,差距一眼就能看出来。想按跑分逐项对比,可以看本站的跑分页,以及 DeepSeek V4、Mistral Large 3 两篇对比文章。

模型输入(每百万)输出(每百万)10M 输入 + 2M 输出的费用
Large 4(促销价)$0.68$2.09$10.98
Large 4(原价)$1.36$4.18$21.96
Mistral Large 3$0.50$1.50$8.00
Mistral Medium 3.5$1.50$7.50$30.00
Mistral Small 4$0.15$0.60$2.70
DeepSeek V4 Pro 0813(闲时)$0.66$1.98$10.56
DeepSeek V4 Pro 0813(高峰)$1.32$3.96$21.12
GLM-5.3(Z.AI)$1.40$4.40$22.80
Qwen3.8 Max$2.00$6.00$32.00
GPT-6.1 Sol(短上下文)$2.00$10.00$40.00
Claude Sonnet 5.5$2.00$10.00$40.00
Gemini 3.1 Pro Preview(≤200K)$2.00$12.00$44.00
Kimi K3$3.00$15.00$60.00
Claude Opus 5.5$4.00$20.00$80.00
GPT-6 Astra(短上下文)$10.00$50.00$200.00
来源:Mistral、DeepSeek、OpenAI、Anthropic、Google 定价页和 OpenRouter 模型接口;最后一列为计算值,核对于 2026 年 10 月 6 日。

按评测任务算的成本

独立评测机构算的是完成整个任务要花多少钱,而不只是 token 单价。按原价计算,Artificial Analysis 给出的 Large 4 智能指数单题成本是 $1.13,Vals AI 给出的 Vals Index 单次测试成本是 $13.78。两者都包含推理带来的额外输出,可以当作复杂多步骤任务的实际成本上限。

评测机构指标Mistral Large 4 结果
Artificial Analysis智能指数单题成本(原价)$1.13
Artificial Analysis跑完整个指数用掉的输出 token200M(中位数 81M)
Vals AIVals Index v2.1 单次测试成本$13.78
来源:Artificial Analysis 和 Vals AI 模型页,核对于 2026 年 10 月 6 日。

降低 Mistral Large 4 账单的五个办法

省得最多的是批处理和缓存,其余靠控制输出长度。

  • 离线任务(评测、批量分类、文档回填)交给 Batch 接口 /v1/batch,每种 token 都打五折。
  • 让长系统提示词和共享文档在每次请求开头保持完全一致,这样就能按缓存价计费:每百万 $0.07,而不是 $0.68。
  • 查询、改写、信息抽取用 reasoning_effort "none";写代码、算数学、多步骤智能体这类值得思考的任务再用 "high"。
  • 只需要短回答的接口,给 max_tokens 设上限,因为按促销价每百万输出 token 要 $2.09。
  • 简单请求分流给 Mistral Small 4($0.15 / $0.60),Large 4 留给真正需要它的编程、法律和视觉能力的请求。

想要固定月费?

如果你想直接用 Mistral Large 4,不想折腾 API Key 和 token 计算,可以在本站首页和它聊天。免费账号每天 15 积分;Pro 会员 $39.90/月或 $199.90/年,每月 3,000 积分,1 积分大约是一条简短回复。方案详情见价格页,免费试用的所有途径见“免费使用”一文。

资料来源

FAQ

API 价格常见问题

继续阅读

更多 Mistral Large 4 资料

问 Mistral Large 4 一个真问题

贴一段报错代码、一条合同条款,或者一份乱糟糟的表格备注都行。免费账号每天送 15 积分。

开始聊天