Mistral 面向 Lean 4 形式化证明与代码验证的开放模型,可通过权重或免费 API 试用。
Tag
reasoning-models
包含该标签的简调共 15 篇。
Mistral 在 2025 年推出的双版本推理模型家族,开放权重的小型版与托管的企业版共同验证多语言分步推理路线。
Qwen3 是 Qwen 团队发布的开放权重模型系列,通过思考与非思考模式切换覆盖推理、通用对话、工具调用和本地部署场景。
OpenAI o1 是 OpenAI 在 2024 年推出的推理模型系列,公开材料强调其在回答前投入更多推理,并通过 ChatGPT 与 API 提供。
OpenAI 推理模型的任务评估与受控工具协同实践,适合从可复核场景开始验证。
Anthropic Opus 档位的新一代模型,定位为日常可用的高能力模型,强调 coding、agent、knowledge work、computer use 和更高的成本效率。
DeepSeek 在 V3 之后发布的混合推理模型版本,同时支持 thinking 与 non-thinking 模式,并强化工具调用和多步 agent 任务。
DeepSeek V4 系列中的 Pro 档模型,官方资料披露 1.6T 总参数、49B 激活参数、1M 上下文,并通过 API 与开源仓库分发。
Google DeepMind 在 2026 年 7 月发布的 Flash-tier Gemini 模型,定位为高效率 workhorse model,强调 coding、knowledge work、多模态和 token efficiency。
Google DeepMind 发布的新一代 Gemma 开放模型家族,面向高级推理、agentic workflows、本地部署和多模态能力。
OpenAI 在 2026 年 7 月发布的 GPT-5 系列增强模型,主打更强推理、代码、长上下文与 agentic tool use,并通过 API 与 ChatGPT 入口提供。
OpenAI 发布的开放权重推理模型之一,gpt-oss-120b 面向复杂推理、agentic tasks 和本地/自托管部署,并以 Apache 2.0 许可开放。
OpenAI gpt-oss 系列中的较小开放权重推理模型,官方资料强调可在 16GB 内存内运行,适合本地、边缘和快速迭代场景。
MiniMax 在 2026 年 6 月发布的 M 系列模型,官方资料强调 coding、agentic tasks、1M context、原生多模态和 MSA 架构,并提供 API 与开放模型相关入口。
中国基础模型公司,提供网页与 App 对话、开发者 API,以及可下载并本地部署的模型权重;当前公开旗舰模型为 DeepSeek-V4-Pro 与 DeepSeek-V4-Flash。