Ai2 的 fully-open 语言模型家族,公开权重、训练数据、代码、配方、评测与中间检查点,适合重视可复现研究和模型供应链透明度的团队。
Category
模型
该分类当前有 69 篇简调。
Anthropic 面向一般用户开放的 Mythos 级模型,强调长时程编码、知识工作与视觉能力,并以分类器和 Opus 4.8 回退控制高风险请求。
Claude Opus 4.7 是 Anthropic 面向复杂编码、智能体、视觉和多步骤专业工作的闭源模型,适合用真实长任务评估质量、成本与安全控制。
Cohere 发布的 20 亿参数开放语音识别模型,支持 14 种语言与 API、自托管、Model Vault 交付;导入时应实测口音、噪声、专有名词和未内置的时间戳与说话人分离需求。
Cohere 发布的 Apache 2.0 混合专家模型,面向多语言、多模态和智能体企业任务,可下载权重或在私有环境部署。
Google DeepMind 提出的动态 4D 重建与跟踪模型,用统一查询接口处理点跟踪、点云重建和相机位姿估计。
Lightricks 的开放视频生成模型家族,从 LTX-Video 延伸到同步音视频的 LTX-2,同时提供自托管与产品化入口。
Liquid AI 面向端侧部署的第二代基础模型家族,以卷积与注意力混合架构、较小参数规模和开放权重为核心。
腾讯混元团队开放的视频生成基础模型,提供代码、模型权重与多种推理路径,适合有 GPU 工程能力的团队评估本地视频生成。
Google 基于 Gemma 4 推出的实验性开放权重文本扩散模型,以并行去噪生成换取本地低并发场景的更低时延。
Google DeepMind 的多模态视频生成与编辑模型,可接收文本、图像或视频输入,并通过多轮自然语言保持场景连续地调整输出。
Google 面向手机、平板与笔记本推出的开放权重多模态模型,以嵌套架构和低内存设计支持端侧文本、视觉与音频任务。
Genie 3 是 Google DeepMind 的通用世界模型,可从文本生成能随用户操作实时展开的可导航互动环境。
GPT-Live 为 ChatGPT Voice 提供自然语音轮替、任务发起、进度检查与持续调整能力。
IBM 推出的开放权重语言模型家族,以 Mamba-2 与 Transformer 混合架构降低长上下文和并发推理的内存压力。
Meta Superintelligence Labs 推出的多模态推理模型系列,支持工具调用、视觉推理和多智能体编排,并通过 Meta AI 与预览 API 提供能力。
NVIDIA Cosmos 3 系列的 4B 边缘世界模型,面向本地视觉理解、物理推理与机器人策略工作流。
SAM 3.1 是 Meta 面向图像与视频检测、分割和跟踪的模型更新,重点优化多对象视频处理。
Mistral 在 2025 年推出的双版本推理模型家族,开放权重的小型版与托管的企业版共同验证多语言分步推理路线。
Qwen3 是 Qwen 团队发布的开放权重模型系列,通过思考与非思考模式切换覆盖推理、通用对话、工具调用和本地部署场景。
Llama 3.2 是 Meta 于 2024 年发布的模型家族,包含面向端侧文本任务的 1B、3B 模型,以及支持图像理解的 11B、90B 视觉模型。
Llama 3.3 70B Instruct 是 Meta 于 2024 年 12 月发布的 70B 文本指令模型,提供开放权重与长上下文能力,但使用者需遵守专用许可证并自行承担部署与安全治理。
Gemma 3 是 Google DeepMind 推出的开放权重模型家族,提供多种参数规模,并在较大版本中支持图文输入、长上下文和多语言。
Anthropic 于 2025 年发布、现已从自营 API 退役的混合推理模型,适合作为模型迁移与评测样本。
Anthropic 于 2025 年推出的 Opus 4 与 Sonnet 4 模型家族,支持即时响应、扩展思考和工具调用。
Gemini 2.0 是 Google 于 2024 年底发布、面向智能体时代的多模态模型家族,强调原生工具调用与低延迟 Flash 路线;其 Gemini API 端点已于 2026-06-01 停用,现更适合作为架构演进案例而非新项目选型。
Gemini 2.5 Pro 是 Google 的思考型多模态模型,适合复杂代码、文档与长上下文分析,但上线前仍需按真实任务验证质量、延迟和成本。
Claude 3.5 Haiku 曾面向低延迟、高吞吐任务提供轻量模型选择,现已进入历史生命周期,存量系统应以迁移与回归验证为重点。
GPT-4.1 系列曾以长上下文、编码和指令遵循进入 OpenAI API,当前选型必须结合官方模型状态与替代路径重新评测。
GPT-4.5 曾以更自然的通用对话与知识能力进入预览,但现阶段更适合作为模型选型和退役迁移案例,而不是新系统依赖。
OpenAI o1 是 OpenAI 在 2024 年推出的推理模型系列,公开材料强调其在回答前投入更多推理,并通过 ChatGPT 与 API 提供。
OpenAI 的推理模型,适合在受控评测、工具权限和人工复核框架中评估。
OpenAI 推理模型的任务评估与受控工具协同实践,适合从可复核场景开始验证。
OpenAI 的 o4-mini 推理模型,应在固定评测、工具控制和人工复核框架中使用。
DeepSeek 在 API 中于 2025 年末部署的 V3.2 模型版本,分为非思考与思考模式,并已被 V4 系列替代。
Google 在 Gemini API 中提供的 Gemini 3 系列 Pro 预览模型,面向复杂推理、代码和多模态理解任务。
Z.ai 开源的多模态模型系列,覆盖文本、图像、视频和文件输入,并加入原生函数调用能力。
Z.ai 面向编程 Agent、工具使用和复杂推理更新的开放权重模型,可通过 API 或本地推理框架使用。
Mistral 的文档理解模型,输出文本、位置框、区块类别和置信度,面向企业检索与文档自动化。
Mistral 发布的开放模型,将推理、多模态理解和 Agent 编程能力合并到同一 Small 系列模型中。
Mistral 面向具身导航的 8B 模型,以单个 RGB 摄像头和自然语言指令驱动机器人移动。
Anthropic Opus 档位的新一代模型,定位为日常可用的高能力模型,强调 coding、agent、knowledge work、computer use 和更高的成本效率。
Anthropic 在 2026 年 6 月发布的 Claude Sonnet 系列新模型,定位于兼顾前沿能力、成本和速度,重点覆盖代码、agent、长任务与企业工作流。
DeepSeek 在 V3 之后发布的混合推理模型版本,同时支持 thinking 与 non-thinking 模式,并强化工具调用和多步 agent 任务。
DeepSeek V4 系列中的 Pro 档模型,官方资料披露 1.6T 总参数、49B 激活参数、1M 上下文,并通过 API 与开源仓库分发。
Google DeepMind 在 2026 年 7 月发布的 Flash-tier Gemini 模型,定位为高效率 workhorse model,强调 coding、knowledge work、多模态和 token efficiency。
Google DeepMind 发布的新一代 Gemma 开放模型家族,面向高级推理、agentic workflows、本地部署和多模态能力。
OpenAI 在 2026 年 7 月发布的 GPT-5 系列增强模型,主打更强推理、代码、长上下文与 agentic tool use,并通过 API 与 ChatGPT 入口提供。
OpenAI 发布的开放权重推理模型之一,gpt-oss-120b 面向复杂推理、agentic tasks 和本地/自托管部署,并以 Apache 2.0 许可开放。
OpenAI gpt-oss 系列中的较小开放权重推理模型,官方资料强调可在 16GB 内存内运行,适合本地、边缘和快速迭代场景。
SpaceXAI / xAI 的新一代 Grok 模型,定位为面向 coding、agentic tasks 和 knowledge work 的 frontier model,并进入 API、Grok Build、Web、移动端和 X。
Moonshot AI 的 Kimi K2 / K2.x 模型线,主打长上下文、代码、工具调用和 agentic 任务,并同时提供 API 与开放权重入口。
Moonshot AI 的 Kimi K2.6 模型,官方强调编码、长程执行、agent swarm、多模态输入和 256K 上下文,是 Kimi 工作流能力的核心模型之一。
Moonshot AI 发布的开放权重原生多模态 agentic 模型,官方模型卡标注 2.8T 参数、1M-token 上下文,并面向长周期代码、知识工作与推理任务。
Meta 发布的开放权重基础模型系列,Llama 4 引入原生多模态和 MoE 架构,形成了全球最重要的开源权重模型生态之一。
Google DeepMind 的音乐生成模型,Lyria 3.5 可从文本生成高质量音乐音频和歌词,并在 Google Flow Music 中分发。
MiniMax 在 2026 年 6 月发布的 M 系列模型,官方资料强调 coding、agentic tasks、1M context、原生多模态和 MSA 架构,并提供 API 与开放模型相关入口。
法国 AI 公司,提供开源权重与商业模型、Le Chat、La Plateforme,以及面向企业的 AI agents、应用开发和部署能力。
Mistral AI 发布的 128B dense 开放权重旗舰模型,统一覆盖 instruction-following、reasoning、coding、multimodal 和 agentic use cases。
Microsoft Phi 系列的小语言模型之一,Phi-4 以 14B 参数规模强调复杂推理、数学、代码和低成本/低延迟场景。
Qwen 团队发布的开放权重代码模型,面向 coding agents 和本地开发,在 Qwen3-Next 架构基础上做 agentic coding 训练。
ByteDance Seed 团队发布的 36B 开放权重模型系列中的指令版本,强调长上下文、推理、agent 能力和开发者友好部署。
OpenAI 的旗舰视频与音频生成模型,和新的 Sora 应用一起发布,重点从单次视频生成扩展到角色、社交创作和安全治理。
Google DeepMind 的高效率视频生成模型,基于 Veo 3,可从文本或图像生成带音频的高质量高分辨率视频,并通过 Gemini API、AI Studio、Vertex AI 和 Flow 分发。
Mistral AI 发布的 4B 参数文本转语音模型,支持 9 种语言、低延迟 streaming、zero-shot voice cloning,并面向企业 voice agent 工作流。
SpaceXAI/xAI 推出的通用 AI 模型与助手产品,覆盖网页和移动端对话、X 与网页检索、开发者 API,以及图像、视频和语音能力。
中国基础模型公司,提供网页与 App 对话、开发者 API,以及可下载并本地部署的模型权重;当前公开旗舰模型为 DeepSeek-V4-Pro 与 DeepSeek-V4-Flash。
MiniMax 是一家以自研多模态基础模型为底座,同时经营开发者 API、Agent、视频、音频与角色互动产品的中国 AI 公司。
Nous Research 基于 ByteDance Seed-OSS-36B-Base 后训练的 36B 开放权重文本模型,提供可切换推理、函数调用和本地部署入口,并作为 Psyche 去中心化后训练的公开案例。