Mistral Medium 3.5 简调
Mistral AI 发布的 128B dense 开放权重旗舰模型,统一覆盖 instruction-following、reasoning、coding、multimodal 和 agentic use cases。
Mistral Medium 3.5 open-weight-models mistral-medium coding-agent agentic-workflows Mistral AI 发布的 128B dense 开放权重旗舰模型,统一覆盖 instruction-following、reasoning、coding、multimodal 和 agentic use cases。
Mistral Medium 3.5
1. 调研缘由
Mistral Medium 3.5 是 Mistral AI 近一年里最值得记录的模型之一。官方模型卡把它称为 Mistral 的 first flagship merged model:一个 128B dense 模型,用同一套权重处理 instruction-following、reasoning 和 coding。[S1][S2]
这和早期“一个模型做一种能力”的路线不一样。Mistral 明确表示,Medium 3.5 替代了此前的 Medium 3.1、Magistral 和 Devstral 2 的部分产品位置,说明它是一次模型线整合。[S1]
2. 简介与产品工作流
Hugging Face 模型卡显示,Mistral Medium 3.5 是 128B dense 模型,256K context window,面向 instruction-following、reasoning 和 coding。Mistral Docs 还把它描述为 frontier-class multimodal model,优化 agentic 和 coding use cases,并以 Modified MIT license 开放权重。[S1][S2]
典型工作流可以拆成四步:
- 开发者通过 Hugging Face、Mistral API 或 Mistral 产品入口选择 Medium 3.5。[S1][S2][S3]
- 把代码、长文、多模态输入或 agent 任务交给模型。
- 模型执行指令、推理、代码修改、工具调用或多步骤任务。
- 结果进入 Le Chat、Vibe coding agent、企业应用或自托管服务。[S3]
3. 团队与资本背景
Mistral Medium 3.5 来自法国 Mistral AI,不是独立融资项目。它延续 Mistral “开放权重 + API + 企业部署 + 欧洲 AI 公司”这条路线。
从产品动作看,Medium 3.5 不只是一个模型仓库,而是进入 Le Chat、Vibe 和 Mistral 平台的统一模型底座。[S1][S3]
4. 技术基础与生态位
Mistral Docs 的模型卡说明 Medium 3.5 是开放权重、Modified MIT license、256K context、multimodal、agentic 和 coding use cases。[S2]
Hugging Face 模型卡进一步说明它是 dense 128B 模型,并替代了 Mistral Medium 3.1、Magistral 和 Devstral 2 在相关产品里的位置。[S1]
生态位上,Mistral Medium 3.5 对标的是 GPT/Claude 的代码和 agent 能力、Gemma/Qwen/Llama 的开放模型生态,以及企业自托管模型需求。
5. 市场与外部信号
Mistral 官方关于 Vibe remote agents 的文章说明,Mistral Medium 3.5 被用来驱动远程 agents、Le Chat Work mode 和跨工具工作流,定位已经从纯聊天走向生产力和代码代理。[S3]
NVIDIA NIM 也提供了 Mistral Medium 3.5 的模型卡,说明它已经进入云端推理和企业部署生态。[S4]
6. 公开评价与主要分歧
正面评价:
它的优势是能力整合:一个开放权重模型同时覆盖 instruction、reasoning、coding、multimodal 和 agentic tasks,减少了模型选择和路由复杂度。[S1][S2]
主要分歧:
第一是许可边界。Modified MIT 并不等于完全无限制,需要看具体条款。
第二是部署成本。128B dense 模型比小模型更吃资源,即使开放权重,也需要算力预算。
第三是和闭源模型的差距。它适合自托管和企业控制,但是否替代 GPT/Claude 仍取决于具体任务。
7. 同类对比(与头部/高知名度同类项目)
主要对标项目: gpt-oss-120b、Gemma 4、Qwen3-Coder-Next、Claude Sonnet 5、GPT-5.6。
| 维度 | Mistral Medium 3.5 | gpt-oss-120b | Claude / GPT |
|---|---|---|---|
| 开放方式 | 开放权重,Modified MIT。[S2] | Apache 2.0 开放权重。 | 闭源 API。 |
| 模型形态 | 128B dense,256K context。[S1] | MoE 开放权重推理模型。 | 托管前沿模型。 |
| 重点能力 | 指令、推理、代码、多模态、agent。[S1][S2] | 推理、工具调用、自托管。 | 高复杂任务和产品集成。 |
| 主要风险 | 部署成本、许可边界。 | GPU 成本、安全自担。 | 成本、闭源、额度。 |
Mistral Medium 3.5 的差异点,是用一个统一开放权重模型覆盖原本分散在多个模型线里的能力。
8. 信息缺口与后续观察
- Modified MIT 许可对不同商业场景的具体影响需要逐条看。
- 大模型自托管成本、量化质量和推理速度需要实测。
- Vibe remote agents 的长期用户反馈和企业采用情况值得观察。
- 与 Claude/GPT 在代码修复、事实审核和中文内容任务上的差距,需要任务级比较。
9. 归纳洞察 ★
Mistral Medium 3.5 的核心看点,是“模型线合并”。
当一个模型可以同时承担推理、代码、指令、多模态和 agent 任务,工作流就不必为每个小环节设计复杂路由。它未必每项都赢闭源前沿模型,但作为开放权重企业底座,会明显降低模型选择和私有化部署的复杂度。
10. 来源与更新时间
- 信息截至(as_of): 2026-07-30
- 最后复查(last_checked): 2026-07-30
- 最后更新(last_updated): null
可追溯来源
- [S1]Tier1mistralai/Mistral-Medium-3.5-128B 模型卡访问日期:2026-07-30
- [S2]Tier1Mistral Docs:Mistral Medium 3.5 model card访问日期:2026-07-30
- [S3]Tier1Mistral AI:Remote agents in Vibe访问日期:2026-07-30
- [S4]Tier1NVIDIA NIM:Mistral Medium 3.5 model card访问日期:2026-07-30
- [S5]Tier1Mistral Docs:Models Overview访问日期:2026-07-30