模型

Grok 简调

SpaceXAI/xAI 推出的通用 AI 模型与助手产品,覆盖网页和移动端对话、X 与网页检索、开发者 API,以及图像、视频和语音能力。

Grok foundation-model AI助手 real-time-search SpaceXAI/xAI 推出的通用 AI 模型与助手产品,覆盖网页和移动端对话、X 与网页检索、开发者 API,以及图像、视频和语音能力。

Frontmatter

结构化元信息

实体类型
模型
主分类
模型
产品状态
已上线
开放状态
部分开源
产品形态
saasapiagent
能力标签
文本代码图像视频语音多模态检索自动化
目标用户
消费者开发者企业
交付方式
SaaSAPI
区域
us
模型策略
自研模型
部署方式
云端SaaS
技术披露
有限公开
是否实测
未测试
融资阶段
Series E
信息截至
2026-07-22
最后复查
2026-07-22

Grok

1. 调研缘由

Grok 最早是 X 平台里的对话助手,现在已经铺开到了独立网页、移动端、X 内入口、开发者 API、企业版,还接上了图像、视频和语音。[S1][S2] 2026 年 7 月发布的 Grok 4.5 把重点放到了软件工程和长时间 agent 任务上,这反映出一个趋势:它正在从消费端聊天产品扩展为模型与工具平台。[S3]

这篇简调主要想回答三个问题:Grok 和 X 的实时信息入口到底构成了什么差异;Grok 作为模型、助手和多模态 API 的边界在哪里;以及它在快速扩张的同时,安全治理与公开可验证性还存在哪些缺口。

2. 简介与产品工作流

Grok 是 xAI 开发、现归入 SpaceXAI 体系的通用 AI 模型与助手。个人用户可以在 grok.com、iOS、Android 和 X 中使用;开发者则通过 xAI API 调用文本、图像、视频和语音能力。[S1][S2]

典型使用路径大致分成四类:

  1. 问答与检索:用户在网页、移动端或 X 中提问,Grok 可以结合网页和 X 搜索处理实时信息。xAI 在最初发布时就把经由 X 获取实时知识列为产品特点,当前定价页仍列出“实时网页 + X 搜索”。[S4][S5]
  2. 复杂任务与代码:Grok 4.5 面向软件工程和 agent 任务,官方提供 Responses API 调用示例;Grok Build 则把模型用于构建和执行更长的开发任务。[S3][S5]
  3. 多模态生成与交互:产品线包含 Imagine 图像和视频生成、语音对话,以及单独的语音转文字、文字转语音和 Voice Agent API。[S2]
  4. 企业接入:Business 和 Enterprise 计划提供团队席位、统一计费、角色权限、单点登录、目录同步、审计和数据保留等管理能力,企业也可以通过 API 把 Grok 接进自己的应用。[S5]

因此,Grok 不是单一聊天机器人。它同时指向一组基础模型、面向个人的助手、面向开发者的 API,以及与 X 数据和分发入口结合的产品体系。

3. 团队与资本背景

xAI 由 Elon Musk 在 2023 年创立,同年 11 月推出 Grok 1。官方在 Grok 3 发布时回顾了这一时间线,并称 Grok 3 使用 Colossus 超级计算集群训练。[S6]

2026 年 1 月,xAI 宣布完成 200 亿美元 Series E 融资;同年 2 月,SpaceX 宣布收购 xAI。此后官网品牌逐步使用 SpaceXAI,但 Grok 仍是面向用户和开发者的产品名称。[S7][S8]

这组变化意味着,Grok 背后的资源不只来自一家独立模型公司,也与 SpaceX 的资本、算力和工程体系发生了组织层面的结合。不过,收购后的财务分拆、资源分配和产品治理细节没有在公开材料中完整披露。

4. 技术基础与生态位

Grok 采用自研基础模型路线。xAI 为早期 Grok-1 公布过模型卡,并在 2024 年开放过 Grok-1 的模型权重与网络架构;当前主力 Grok 4.5 并未以同样方式开放权重,所以 open_status 记为 partial,不能理解成整个 Grok 产品线都是开源模型。[S9][S10]

Grok 4.5 的官方说明称,模型在数万张 NVIDIA GB300 GPU 上训练,训练数据经过去重、质量评分和领域筛选;强化学习覆盖数十万项任务,重点包括多步骤软件工程和其他技术工作。[S3] 这些信息来自厂商披露,公开资料没有给出完整训练数据、训练计算量、参数规模或可独立复现实验所需的细节。

Grok 的生态位横跨几个层级:

  • 在模型层,它与 GPT、Claude、Gemini 等通用前沿模型竞争文本、推理、代码和多模态能力。
  • 在消费产品层,它利用 X 内入口和实时 X 搜索形成分发与信息源差异。[S4][S5]
  • 在开发平台层,它通过与 OpenAI SDK 兼容的 API 形态降低迁移门槛,并向图像、视频、语音和 agent 工具扩展。[S2][S11]
  • 在企业层,它补齐身份、权限、审计、数据保留和专属基础设施等采购要素。[S5]

这也带来一个边界问题:X 上的实时内容能提高时效性,但实时信息源并不会自动等于经过验证的事实,模型仍需要处理来源质量、上下文和错误信息。

5. 市场与外部信号

个人计划中,xAI 定价页列出的 SuperGrok 为每月 30 美元,包含 Grok 4.5、连接器、较高额度、Expert 以及图像和视频生成;Free、Lite、Heavy、Business 和 Enterprise 的具体额度与价格并未全部在同一公开页面中给出。[S5]

企业和政府方向已经出现多个公开信号。xAI 在 2025 年末推出 Grok Business 和 Grok Enterprise;官方还公布了与沙特 HUMAIN 的框架协议,以及美国国防体系相关合作。[S2][S12] 2026 年 1 月,美联社报道 Grok 将进入五角大楼网络,同时指出这一部署发生在图像生成争议引发多国监管关注的背景下。[S13]

模型更新节奏也很快:从 Grok 4.1、Grok 4 Fast、语音与 Imagine API,到 2026 年 7 月的 Grok 4.5,文本、代码、语音和视觉产品持续并行更新。[S2][S3] 快速发布本身是产品活跃度信号,但不能直接替代稳定性、安全性和长期客户留存数据。

6. 公开评价与主要分歧

能力方面的正面信号:

xAI 公布的 Grok 4.5 结果显示,它在 Terminal Bench 2.1、SWE Bench Pro、SWE Marathon 等软件工程基准上进入前列。[S3] 这些结果有助于观察模型定位,但页面同时说明部分竞品数字来自各厂商系统卡或排行榜,测试工具和设置并不完全统一,因此不适合据此做永久的整体排名。

安全与治理方面的争议:

2026 年 1 月,Grok 的图像编辑和生成能力因被用于制作真人的非自愿性化图像而受到监管与媒体关注。美联社报道,xAI 随后表示会在违法地区进行地理限制,并限制部分图像能力的使用,但美联社的现场复核仍发现部分入口可以生成相关内容。[S14] 一份针对 2025 年末至 2026 年初 43 个事件的独立审计也记录了安全过滤被绕过的情况。[S15]

此外,2026 年一项覆盖 Grok 4.1 Fast 等多个模型的独立安全研究说明,多模型安全比较仍在推进,但单一版本的结果不能直接外推到后续模型和所有产品入口。[S16]

主要分歧:

Grok 的实时 X 信息入口可以让模型更快接触正在发生的事件,同时也把 X 上内容质量、操纵风险和审核机制带入了回答链路。另一个分歧在开放性:早期 Grok-1 开放过权重,但当前旗舰模型、训练数据和完整安全评估的披露程度有限。[S3][S9][S10]

7. 同类对比(与头部/高知名度同类项目)

主要对标项目: ChatGPT、Claude、Gemini。

维度GrokChatGPTClaudeGemini
主要入口grok.com、移动端、X 与 API。[S1][S5]ChatGPT 网页、桌面和移动端及 OpenAI API。[S17]Claude 网页、桌面和移动端、Claude Code 及 API。[S18]Gemini 网页、移动端、Google 产品与 Gemini API。[S19]
实时信息官方突出网页与 X 搜索。[S4][S5]提供网页搜索与连接器,具体能力随计划和入口变化。[S17]提供网页搜索、连接器和研究能力,具体能力随计划变化。[S18]与 Google 搜索及 Google 服务结合,具体能力随产品入口变化。[S19]
模态覆盖文本、代码、图像、视频、语音和 agent API。[S2][S3]文本、代码、图像、视频、语音及 agent 工具。[S17]文本、代码、图像输入、语音和 agent/编码工具;产品覆盖随计划变化。[S18]文本、代码、图像、视频、音频及多模态 API。[S19]
开放状态早期 Grok-1 开放过权重;当前旗舰模型闭源。[S9][S10]主力模型闭源,另有开放权重模型产品。[S17]主力模型闭源。[S18]主力模型闭源,另有 Gemma 开放模型系列。[S19]

这四类产品都在向多模态、工具调用和长任务扩展。Grok 当前最清楚的产品差异是 X 内分发和 X 搜索;ChatGPT、Claude、Gemini 则分别依托 OpenAI 应用生态、Anthropic 的编码与企业工具、Google 的搜索和办公生态。最终效果仍要按具体模型版本、任务、地区、计划和评测设置单独验证。

8. 信息缺口与后续观察

公开资料没有给出 Grok 4.5 的参数规模、完整训练数据构成、总训练计算量和可复现的第三方评测配置。官方基准也缺少覆盖全部地区、时段和产品入口的长期稳定性数据。

收购后 xAI 与 SpaceXAI 的组织、财务和治理边界仍不清晰;Series E 资金、SpaceX 资源与 Grok 产品之间如何分配也没有完整公开。

企业版的实际席位价格、额度、数据保留默认值、可用区域和专属基础设施采购条件,需要以合同和账户配置为准。

后续值得观察的包括:Grok 4.5 的独立复测、安全评估是否持续更新、图像和视频能力的防滥用措施、X 实时搜索的来源透明度,以及 SpaceXAI 体系内的企业采用数据。

9. 归纳洞察 ★

Grok 的路线已经从“X 里的聊天助手”扩展为模型、消费应用、实时信息入口、多模态 API 和企业产品的组合。X 同时承担了分发渠道和信息源角色,这是它相对其他通用助手最直接的结构差异。

这项差异同时带来两面性:实时内容让产品更贴近正在发生的事件,也要求模型和平台承担更复杂的来源筛选与内容治理责任。2026 年的图像争议说明,多模态能力扩张和安全机制必须放在同一条产品链路里考察。

早期 Grok-1 的开放权重没有延续到当前旗舰模型,因此判断 Grok 的开放性时,需要把历史模型权重、当前商业产品和 API 服务分开看。

10. 来源与更新时间

  • 信息截至(as_of): 2026-07-22
  • 最后复查(last_checked): 2026-07-22
  • 最后更新(last_updated): null
来源索引

可追溯来源

  1. [S1]Tier1SpaceXAI Docs:Welcome to Grok访问 2026-07-22
  2. [S2]Tier1SpaceXAI:News访问 2026-07-22
  3. [S3]Tier1SpaceXAI:Introducing Grok 4.5访问 2026-07-22
  4. [S4]Tier1xAI:Announcing Grok访问 2026-07-22
  5. [S5]Tier1SpaceXAI:Pricing访问 2026-07-22
  6. [S6]Tier1xAI:Grok 3 Beta — The Age of Reasoning Agents访问 2026-07-22
  7. [S7]Tier1xAI:xAI Raises $20B Series E访问 2026-07-22
  8. [S8]Tier1SpaceXAI:xAI joins SpaceX访问 2026-07-22
  9. [S9]Tier1xAI:Grok-1 Model Card访问 2026-07-22
  10. [S10]Tier1xAI:Announcing Grok-1.5访问 2026-07-22
  11. [S11]Tier1xAI:API Public Beta访问 2026-07-22
  12. [S12]Tier1xAI:Grok goes Global with KSA访问 2026-07-22
  13. [S13]Tier2Associated Press:Pentagon is embracing Musk's Grok AI chatbot访问 2026-07-22
  14. [S14]Tier2Associated Press:Grok blocked from undressing images in places where it's illegal, X says访问 2026-07-22
  15. [S15]Tier2SSRN:Grok Image Generation Governance Audit访问 2026-07-22
  16. [S16]Tier2arXiv:A Safety Report on GPT-5.2, Gemini 3 Pro, Qwen3-VL, Doubao 1.8, Grok 4.1 Fast, Nano Banana Pro, and Seedream 4.5访问 2026-07-22
  17. [S17]Tier1OpenAI:ChatGPT Overview;API Platform访问 2026-07-22
  18. [S18]Tier1Anthropic:Claude Pricing;Claude Code Overview访问 2026-07-22
  19. [S19]Tier1Google:Gemini Overview;Gemini API Docs访问 2026-07-22