Claude Opus 4.7 是 Anthropic 面向复杂编码、智能体、视觉和多步骤专业工作的闭源模型,适合用真实长任务评估质量、成本与安全控制。
Tag
coding-agent
包含该标签的简调共 24 篇。
Cohere 的开放权重代理式编码模型,以较小激活参数支持仓库级修改、终端任务和本地部署,但工程采用仍需独立验证正确性与工具权限。
Factory 面向工程团队推出的软件开发代理,通过命令行和工程系统连接支持代码库理解、代码修改、审查与自动化。
Mistral 面向 Lean 4 形式化证明与代码验证的开放模型,可通过权重或免费 API 试用。
Charm 维护的源码可见终端编程智能体,可连接多类模型、代码上下文、语言服务器和 MCP 工具,在命令行中协助开发。
Kilo Code 是开放源码的编程智能体平台,可在 IDE、终端及其他入口中生成和修改代码、执行命令、检查结果,并连接多种模型与工具。
Devin 2.0 将编码代理组织为可并行委派和集中检查的软件任务工作区,适合边界清楚的工程工作,但合并责任仍需由人承担。
Goose 是提供桌面端、命令行和 API 的本机开源智能体,可连接多种模型与 MCP 扩展执行工作流,但必须通过权限隔离和任务级验收控制风险。
GitHub Copilot coding agent 可将已定义任务转为代码改动和拉取请求;应由仓库规则、持续集成和人工合并共同约束。
JetBrains Junie 在 IDE 与 CLI 中规划、修改和验证代码任务,适合重视项目上下文与人工审阅控制的软件团队。
Kiro 用规格、任务拆解和自动化 hooks 把 AI 编程从即时对话推进到可追踪的工程流程,适合重视需求与实现一致性的团队。
OpenAI o1 是 OpenAI 在 2024 年推出的推理模型系列,公开材料强调其在回答前投入更多推理,并通过 ChatGPT 与 API 提供。
SWE-Lancer 用真实自由职业软件工程任务和经济价值衡量模型表现,适合研究编码能力,但不能替代企业代码库中的安全与维护验收。
OpenHands 是面向软件开发任务的开源 AI agent 平台。
Roo Code 是面向 IDE 的开源编码 Agent。
Cline 是一个可在 IDE 和终端中运行的开源编码 Agent,并提供 SDK。
Z.ai 面向编程 Agent、工具使用和复杂推理更新的开放权重模型,可通过 API 或本地推理框架使用。
Anthropic 在 2026 年 6 月发布的 Claude Sonnet 系列新模型,定位于兼顾前沿能力、成本和速度,重点覆盖代码、agent、长任务与企业工作流。
OpenAI 在 2026 年 7 月发布的 GPT-5 系列增强模型,主打更强推理、代码、长上下文与 agentic tool use,并通过 API 与 ChatGPT 入口提供。
Moonshot AI 的 Kimi K2 / K2.x 模型线,主打长上下文、代码、工具调用和 agentic 任务,并同时提供 API 与开放权重入口。
Moonshot AI 发布的开放权重原生多模态 agentic 模型,官方模型卡标注 2.8T 参数、1M-token 上下文,并面向长周期代码、知识工作与推理任务。
Mistral AI 发布的 128B dense 开放权重旗舰模型,统一覆盖 instruction-following、reasoning、coding、multimodal 和 agentic use cases。
Qwen 团队发布的开放权重代码模型,面向 coding agents 和本地开发,在 Qwen3-Next 架构基础上做 agentic coding 训练。
GitHub Copilot 是 GitHub/Microsoft 面向开发者的 AI 编程助手,已从编辑器代码补全扩展到 IDE、CLI、GitHub PR/Issue、代码审查与云端 coding agent 工作流。