2026 年 7 月 8 日,SpaceXAI 公开发布 Grok 4.5。这是它"第一款专门为 coding 和 agents 训练的模型"(官方原话),也是 Cursor 被收购后、两家数据真正合流的第一款产物。两个数字最抓眼球:1.5 万亿参数、与 Cursor 联训。但这两个数字都得带口径看--1.5T 是第三方报道转述的马斯克披露值,SpaceXAI 官方并未正式确认;"联训 Cursor"也不是简单的"喂了 Cursor 的代码",而是把 Cursor 的真实开发数据放进了一个全新预训练的 V9 底座。要把这次发布看明白,得把事实、规格、能力边界和它真正站的位置分开说。
一、发布事实与规格:1.5T、V9、500K 上下文
先说能确认的。Grok 4.5 于 2026 年 7 月 8 日公开发布,此前在 SpaceX 和 Tesla 内部跑了约十天的私有 beta(马斯克 6 月 28 日在 X 上首次披露)。它在 Cursor 编辑器、Grok Build(SpaceXAI 自家 coding agent 环境)和 SpaceXAI 控制台三处上线,Cursor 头一周还给了双倍用量。EU 区延后到 7 月晚些时候才开放。
规格上,Grok 4.5 跑在新的 V9 底座上。多家第三方报道引述马斯克的说法,称参数量约 1.5 万亿,是上一代 V8 的近 3 倍--但要注意,SpaceXAI 官方从没正式确认这个 1.5T 数字,它目前是"厂商口径 + 媒体转述",不是独立核验过的数。能确认的是定价和上下文:输入 $2/百万 token、输出 $6/百万 token,缓存命中再打二五折到 $0.5/百万;超过 20 万 token 的长输入翻倍计费。上下文窗口 50 万 token,比 Grok 4.3 的 100 万缩了一半,但保留了视觉输入和可配置推理;马斯克在 X 上说后续会升回 100 万。一个容易被忽略的细节:xAI 已并入 SpaceXAI,所以这次发布的产品实体和品牌都是 SpaceXAI,但官方推文仍从原 xAI 账号发出--读新闻时把"xAI"和"SpaceXAI"当成同一家即可。
二、coding+agent 能力:Cursor 联训到底意味着什么
"第一款专为 coding 和 agents 训练"这句官方话术,分量在于"训练阶段"而不是"推理阶段"。Cursor 是当下最主流的 AI 编程编辑器,其母公司 Anysphere 已被 SpaceX 以约 600 亿美元收购(交易预计 2026 年 Q3 监管放行后完成)。Grok 4.5 把 Cursor 在真实开发场景里产生的数据--多文件改写、调试、长链工程任务--加进了 V9 的补充训练阶段。SpaceXAI 的说法是这给了它"在 coding 重活上别的模型目前匹配不了的结构性优势"。Cursor 官方则称之为"迄今最强大的模型",并强调这是它第一款"不只是为软件工程"打造的模型。
但要诚实:截至目前没有独立第三方 benchmark(SWE-Bench、Terminal-Bench 等)放出 Grok 4.5 的公开分数。马斯克在内部的口径是"大致和 Opus 4.7 相当,但快得多"--注意是 Opus 4.7,不是 7 月 24 日才发布的 Opus 5。也就是说,Grok 4.5 发布时的对标对象是上一代 Opus,它的卖点是"用一半的 token、不到一半的价格,跑出接近 Opus 的活,还更快",而不是"刷榜第一"。这和 Anthropic、OpenAI 追跑分的路子不同,SpaceXAI 选择的是"对 SpaceX/Tesla 工程师有用"这条更功利的标尺。所以别拿它去和 Opus 5 比 SWE-Bench 分--它压根没公开跑。
还有一点常被混过去:官方说的是"coding 和 agents",不是只有 coding。Cursor 自己的原话是"第一款不只是为软件工程打造的模型",暗示它的 agent 能力(在编辑器里自己跑多步、改多文件、跑测试再回头修)才是真正的卖点,而不仅仅是补全代码。但"agent 能力"目前也没有公开的 Agentic Index 或 Terminal-Bench 分可比对,所以这条同样只能信厂商口径、自己实测。
三、竞争位置:和 Opus 5 / GPT-5.6 / Claude Code 怎么错位
把 Grok 4.5 放回 7 月底的格局里,它的位置是"便宜的 Opus 级平替,但跑分未公开"。定价上,$2/$6 比 Anthropic Opus 4.8 的 $5/$25 便宜一大截;和 7 月 24 日新发的 Opus 5(同为 $5/$25)比,输入便宜 60%、输出便宜 76%。和 GPT-5.6 Sol 比,输入持平(都 $2),输出 $6 对 $8 略低。但要分清:Opus 5 在 Artificial Analysis 上智能指数 61、Agent 指数 55.3 双榜登顶,GPT-5.6 Sol 智能指数 59、配 Codex 在 Coding Agent Index 以 80 分独自领先--这些 Grok 4.5 都没有可对照的公开分。换句话说,比"每百万 token 单价"它最便宜,比"跑分排名"它根本没进榜。而且 token 单价便宜不等于单任务便宜--Opus 5 那篇已经说过,max effort 下它一个任务能烧 8 倍 token;Grok 4.5 号称"用一半 token 干同样的活",如果属实,单任务成本会更低,但这是厂商口径,没第三方核过,仍要自己测"完成一个真实任务的总花费"再下结论。
真正的错位点在 Cursor 这条线。Opus 5 和 GPT-5.6 的 coding 能力是配 Claude Code、配 Codex 体现的;而 Grok 4.5 是"原生长在 Cursor 里"--它训练时就吃了 Cursor 的数据,发布即进 Cursor 编辑器。对已经把 Cursor 当主力 IDE 的团队,切到 Grok 4.5 几乎无摩擦;对用 Claude Code 的人,迁移成本不在这里。所以这不是"Grok 4.5 比 Opus 5 强",而是"如果你本来就在 Cursor 生态,它是最顺的那条路"。SpaceXAI 的赌注也很明显:用 Cursor 的数据飞轮锁住开发者,下一款模型(据报道已在跑、约 2T 参数、从预训练阶段就接入 Cursor 数据)会把这个护城河挖得更深。
四、对开发者的实际影响
对开发者,Grok 4.5 的意义是"coding agent 多了一个便宜、且和编辑器原生融合的选项"。如果你的活是高并发的多文件改写、长链调试,$2/$6 的价位加缓存二五折,跑批量任务时成本优势会被放大;50 万上下文虽比上一代缩水,但多数单任务够用,长上下文场景等它升回 100 万。三个提醒:第一,它没有公开跑分,别拿榜单分当决策依据,要在自己的真实工作负载上测"单任务成本"和"出错率";第二,长输入超 20 万 token 会翻倍计费,长上下文任务先把成本算清;第三,EU 区和 API 通道的开放节奏要等官方,目前最稳的入口是 Cursor 和 Grok Build。还有一条要心里有数:把主力 workflow 绑死在 Cursor + Grok 4.5 上,等于把数据飞轮交给了 SpaceXAI--下一款模型更强、你更离不开,这是它收购 Cursor的本意。对中小团队,先用着、但别把全部工程数据只喂这一条链。
对普通人,这次发布更像是"AI 编程工具这一轮军备竞赛又加了一名选手"。Cursor 里多一个模型可选,对订阅用户是净利好;但对不写代码的人,Grok 4.5 的 coding 专精和日常问答关系不大。判断标准很简单:你平时是不是在 Cursor 或类似的 agent 环境里干活?是,值得切上去试一周;不是,等它把能力外溢到通用对话再看不迟。新模型"又快又便宜"听着诱人,但落地只看一件事:它能不能在你最费劲的那个 coding 活上,比现在用的模型少出几次错、少来回几轮。能做到,这次切换就值。
参考来源
- Enterprise DNA《Grok 4.5 Launches Tomorrow as SpaceXAI's Claude Rival》(2026-07,1.5T / Cursor 联训 / 定价对标 Opus):https://enterprisedna.co/resources/news/spacexai-grok-4-5-public-launch-enterprise-coding-july-2026
- Latent.Space《SpaceXAI launches Grok 4.5, first Opus-class model post Cursor acquisition》(定价 $2/$6、500K 上下文、Opus 4.7 对标口径):https://www.latent.space/p/ainews-spacexai-launches-grok-45
- Basenor《Grok 4.5 Enters Private Beta at Tesla and SpaceX》(7 月 8 日公开发布、Anysphere 600 亿收购、EU 延后):https://www.basenor.com/blogs/news/grok-4-5-enters-private-beta-at-tesla-and-spacex-1
- Digital Applied《Grok 4.5: SpaceX's 1.5T V9 Model Trained on Cursor》(1.5T 为厂商口径未官方确认、2T 后续模型):https://www.digitalapplied.com/blog/grok-4-5-cursor-data-flywheel-spacex-private-beta-2026
- CometAPI《Grok 4.5 released: Architecture, release date, and other we know》(V9 架构、RLHF、月度迭代节奏):https://www.cometapi.com/grok-4-5-leak-xai-s-1-5t-v9-model-in-private-beta