AI前沿 | 2026年9月22日:xAI Grok 4.7 正式发布 + 2.1 万亿参数 + 编程与知识工作
📖首屏导读 · 本教程配套付费专栏:《大模型工程师修炼手记》
19.9 元(AI 编程 · Agent 实战 · 本文同主题系统课程)· 《AI时代程序员的自我提升》49.9 元(AI 时代成长方法论)单篇不过瘾?订阅解锁全量源码、实战与答疑;文末附资料包领取方式 ↓
📊本期导读:9 月 21 日,xAI 正式发布Grok 4.7——一次延期 5 次才落地的发布,定位「目前最强大的编程与知识工作模型」。规格上,总参数约 2.1 万亿(较 Grok 4.6 的 1.5 万亿增加约 40%),API 定价为输入 2 美元 / 输出 6 美元(每百万 Token,缓存输入 0.50 美元),与 Grok 4.6 持平,官方直接打出「同级别约一半的价格」。训练数据最大变量是引入 SpaceX 补充数据:Starlink 卫星遥测、制造记录与工程故障日志——把物理世界的真实系统日志喂给了推理栈。基准上,DeepSWE v1.1 从 65.2 涨到71.0,超 Claude Fable 5.1 max(70.0),逼近 GPT-5.6 Sol max(72.7);AA 综合智能指数 46 分、进入全球前四。本期拆五讲:事件、数据、基准、价格与安全、给创业者的判断。
一、事件:延期 5 次的发布,最终以「编程与知识工作」为定位落地
Grok 4.7 的发布一路磕绊:从早前传闻推迟至今,部分渠道统计经历了 5 次延期,直到 9 月 21 日才在 x.ai 官网正式官宣。与上一代 Grok 4.6(8 月发布)把「Chat 对话 + 知识问答」作为核心叙事不同,Grok 4.7 把定位钉在『编程与知识工作』——这也是 xAI 第一次把「coding agent / 知识密集型办公」抬到官方首页的位置。随发布同步上线的接入面非常宽:Grok 应用、Cursor、Grok Build、xAI API、OpenRouter、Vercel 与 Cloudflare 均可用,等于把「模型即服务的最后一公里」全部铺开。
| 关键项 | Grok 4.7 | Grok 4.6 |
|---|---|---|
| 总参数 | 约 2.1T(MoE 稀疏激活) | 1.5T |
| 上下文窗口 | 50 万 Token | — |
| 输入 / 输出价格 | $2 / $6(每百万 Token) | $2 / $6 |
| 缓存输入价格 | $0.50(<200K 提示) | — |
| 知识截止 | 2026 年 5 月 | — |
二、数据:把 SpaceX 的「物理世界日志」塞进训练集
Grok 4.7 最不卷基准、最卷数据的点在于:训练集引入了 SpaceX 的补充数据——Starlink 卫星遥测、制造记录与工程故障日志。这意味着: -遥测数据教会模型识别真实系统状态变化与异常序列,而非只是模仿人类语料; -制造记录 / 工程故障日志把「循环、状态机、故障归因」这类工程思维直接内化进权重; - 这也是 xAI 把「地球 - 火星」的软硬一体叙事落到模型层面的最直接体现——别人用网页文本训练,它用真实太空工程系统日志训练,样本分布的结构性差异,就是所谓『同价格一半能力』之外看不见的护城河。
三、基准:DeepSWE 71.0 逼近 GPT-5.6 Sol,AA 指数 46 分进全球前四
逐项看 Grok 4.7 相对 4.6 的提升(图:Grok 4.6 为 65.2 / 53.0 / 40.4 / 20.3):
| 基准 | Grok 4.7 | 备注 |
|---|---|---|
| DeepSWE v1.1 | 71.0% | 超 Fable 5.1 max(70.0)· 逼近 GPT-5.6 Sol max(72.7) |
| EEBench | 64.0 | 从 53.0 提升 |
| CursorBench 4.0 | 46.3% | 从 40.4% 提升 |
| Terminal-Bench 4.0 | 38.0% | 从 20.3% 翻近一倍 |
| AA-Briefcase | 1546 →1657 | 知识工作类显著进步 |
| AA 综合智能指数 | 46 | 全球前四;Coding Agent 项超过 GPT-5.6 Sol |
| GDPval | 1695 | 落后 Fable 5.1(1735),仍属第一梯队 |
四、价格与安全:「同级一半价格」vs 「3.3% 高风险放行率」
价格上,Grok 4.7 以$2/$6 每百万 Token与 4.6 持平,官方口径直指「同级别约一半的价格」——在 DeepSWE 71.0 这个编程硬指标上,它已经是市场上『性能 ÷ 价格』最锋利的存在之一。安全侧则是一组反差数据:xAI 称 Grok 4.7 在 HackerBench 0.3 上仅放行约 3.3% 的高风险提示(HackerBench 把代理抽象为「高风险代理套件」评测越狱/攻击能力),同时公开开放安全红队合作。一面把编程与知识工作的上限拉满,一面把自己最激进的安全垫也亮出来——这种「硬核能力 + 硬核安全声明」的组合,是前沿模型厂商在 2026 下半年统一的话术。
五、给创业者的判断清单
- 编程生产力选型:DeepSWE 71.0 + CursorBench 46.3,Grok 4.7 进 Cursor 意味着编码 Agent 的『默认旗舰』不再是单一寡头——做代码生成/自动化测试/AI 辅助开发的团队,立即把它与 GPT-6 Sol、Claude 做一次同任务横评,谁的每任务成本低就锁谁。
- 定价抄作业:$2/$6 + 缓存 $0.50 的旧价维持 + 「同级一半」话术,说明头部厂商已把『价格战』做成常态化供给——你对外卖 token/转售时,价格锚定直接以 Grok 为基准即可。
- 数据红利观察:SpaceX 日志进训练集,『真实工业系统日志』成为新的高质量语料矿——做数据公司的团队,可以去谈工业遥测/运维日志类数据的授权与清洗机会。
- 安全采购参考:HackerBench 3.3% 放行率给「愿意买更安全模型」的企业客户一个可量化指标——做安全评测/AI 红队的服务商,HackerBench 类基准的合规交付会成为 2027 年公开招标的硬门槛。
💡启示:Grok 4.7 用『一半价格 + 同档编程能力』告诉我们:当模型能力逼近时,竞争的胜负手已经从『基准分』移到『每任务成本 ÷ 可接入生态』。对创业者:① 60%-70% 的编程/知识任务,Grok 4.7 的性价比足以重塑你的 API 成本结构——别再默认 Claude/GPT 是唯一选项;② xAI 的登录即 Cursor/OpenRouter/Cloudflare 联动,提醒你模型的『分发面』和它的分数同样决定胜负——接入面越宽的模型,越容易被选为默认底座;③ 但红利期窗口很短:Grok 4.8(约 2.5T、用 C++ 重写训练栈)已在路线图上,趁当前定价把『多模型路由』铺好,让每一次新模型发布都变成你的套利窗口。
来源:x.ai 官方(2026-09-21)/ cnBeta(2026-09-22)/ datastudios 综述(2026-09-21)/ Gate News(2026-09-21)。本文为 AI 辅助整理的前沿解读,事实以官方与权威媒体口径为准,不构成任何投资建议。
📚 延伸阅读 · 我的付费专栏
觉得这篇文章对你有帮助?我把同类主题的系统化内容沉淀成了付费专栏,欢迎订阅支持持续输出:
| 专栏 | 定价 | 内容 |
|---|---|---|
| 大模型工程师修炼手记 | 19.9 元 | AI 编程 / Agent 深度实战 |
| AI时代程序员的自我提升 | 49.9 元 | AI 时代成长方法论 |
👍觉得有用?请一键三连:点个收藏方便随时查,转发给需要的同事朋友,有问题评论区见—— 收藏的人越多,越能帮到更多同路人;你的每个赞都在为原创内容投票。
💬本文配套代码 / 资料包:欢迎在评论区留言「求代码」,我会私信发送完整资源!