Mistral Small 4 简调
Mistral 发布的开放模型,将推理、多模态理解和 Agent 编程能力合并到同一 Small 系列模型中。
Mistral Small 4 mistral moe multimodal apache-2.0 Mistral 发布的开放模型,将推理、多模态理解和 Agent 编程能力合并到同一 Small 系列模型中。
Mistral Small 4
1. 调研缘由
Mistral Small 4 在 2026 年 3 月发布,把 Mistral 此前分散在推理、视觉和编码模型线中的能力合并进一个开放模型,是小型通用模型产品化的一次更新。[S1]
2. 简介与产品工作流
官方称 Mistral Small 4 同时覆盖通用聊天、编码、Agent 任务、复杂推理和文本/图像输入;使用者可通过 Mistral API、AI Studio、Hugging Face 或自建推理栈接入。[S1]
对于日常任务,调用方可把 reasoning_effort 设为 none;复杂任务可设为 high。这使同一模型在低延迟与更深推理之间切换。[S1]
3. 团队与资本背景
Mistral Small 4 由 Mistral AI 发布,属于其 Small 模型产品线,而非独立融资项目。[S1][S2]
4. 技术基础与生态位
Mistral 公布其为 MoE 架构:128 个专家、每 token 激活 4 个专家;总参数 119B,每 token 活跃参数 6B(含 embedding 与输出层时为 8B),上下文窗口为 256K。[S1]
该模型采用 Apache 2.0 许可证,官方列出 vLLM、llama.cpp、SGLang 和 Transformers 等生态支持。[S1]
5. 市场与外部信号
Mistral 将 Small 4 同时放入 API、AI Studio、Hugging Face 与 NVIDIA NIM 等入口,并给出按百万 token 计的 API 价格。这使它既是托管模型,也面向微调和自部署使用者。[S1]
其官方治理页面将 Mistral Small 4 标记为 2026-03-16 发布、状态为 Active 的通用 AI 模型。[S2]
6. 公开评价与主要分歧
正面评价(官方):
官方称 Small 4 用可配置推理把 Magistral、Pixtral 和 Devstral 的能力合到一个模型,并公布与 Small 3 的内部延迟和吞吐对比。[S1]
主要批评/质疑(独立来源):
本次调研未纳入可复现的独立评测汇总;官方内部基准与吞吐数字应按其测试条件理解。
存在分歧之处:
开放许可证不等于低硬件门槛。官方列出的最低与推荐部署配置均为多张高端 GPU 或 DGX 系统。[S1]
7. 同类对比(与头部/高知名度同类项目)
主要对标项目: Mistral Small 3、GPT-OSS 120B、Qwen 开放模型。
| 维度 | Mistral Small 4 | Mistral Small 3 | GPT-OSS / Qwen 等开放模型 |
|---|---|---|---|
| 能力组合 | 推理、视觉、编码与 Agent。[S1] | 前代 Small 系列。 | 具体能力随模型而定。 |
| 上下文 | 256K。[S1] | 需以各自文档为准。 | 需以各自文档为准。 |
| 许可证 | Apache 2.0。[S1] | 需以各自发布条款为准。 | 条款各异。 |
| 部署 | API 与自托管。[S1] | 视前代支持而定。 | 通常可 API 或自托管。 |
8. 信息缺口与后续观察
- 不同推理强度下的质量、延迟和成本需要实测。
- 多语言、多模态和 Agent 任务的第三方复现仍值得跟踪。
- 高端 GPU 部署条件对实际自托管成本的影响需要单独核算。
9. 归纳洞察 ★
Mistral Small 4 的重点不是增加一个单项模型,而是把推理、视觉和 Agent 编程压进统一接口,再用运行时参数区分轻量与深度任务。开放模型的比较也因此要同时看许可证、硬件门槛和托管入口。
10. 来源与更新时间
- 信息截至(as_of): 2026-07-31
- 最后复查(last_checked): 2026-07-31
- 最后更新(last_updated): null
可追溯来源
- [S1]Tier1Mistral AI:Introducing Mistral Small 4访问日期:2026-07-31
- [S2]Tier1Mistral AI Governance Hub:Mistral Small 4访问日期:2026-07-31