各厂语言模型

Grok 4.7 发布:xAI 主打「长任务更耐心」,价格不涨

2026年9月22日4 次阅读
Grok 4.7 发布:xAI 主打"长任务更耐心",价格不涨

Grok 4.7 发布:xAI 主打"长任务更耐心",价格不涨

9月21日,xAI 正式发布了新模型 Grok 4.7。这次升级的关键词不是"更聪明"那么简单,而是"更能熬":官方说它专门针对那些要跑好几个小时的多步任务,比如长链路的编程、Agent 自动化工作。价格上,标准版维持 Grok 4.6 的水平——每百万输入 token 2 美元、输出 6 美元,没有涨价。

它到底改了什么?

Grok 4.7 用了一个比 Grok 4.6 更大的底座模型,并做了更长时间的强化学习(RL)训练,而且训练题目刻意偏向那些"几个小时才能完成"的复杂任务。

xAI 点名要解决的是一个很常见的 Agent 失败模式:干到一半就停,不检查结果对不对。官方称新模型在自我校验(self-verification)和长上下文管理上明显更强,并且原生理解自家的 Grok Bot 运行框架。

成绩单:官方数字好看,第三方有分歧

xAI 公布的成绩表(xHigh 档)包括:

  • CursorBench 4.0:46.3%
  • DeepSWE v1.1(high effort):71.0%
  • Terminal-Bench 4.0:38.0%

不过要注意,独立测试机构给出的数字和官方有出入。比如 The Decoder 转述的 Artificial Analysis 测评中,Grok 4.7 在 Terminal-Bench 4.0 上只拿到 26%,综合指数也低于 Claude Fable 5.1 和 GPT-6。两边测试配置不完全一致,数字不能直接画等号——但也说明官方成绩需要打个问号,建议在自己的任务上实测再下结论。

价格:明面不涨,暗处可能更贵

标准版价格不变($2/$6 每百万 token),对已经在用 Grok 4.6 的团队来说升级门槛很低。但有个隐藏账:模型推理时间更长、思考更多,消耗的 token 也会变多,同样的任务总花费可能不降反升。另有一个更快的版本,价格是标准版的两倍。

在哪能用?

Grok 4.7 已上线 Grok API、Cursor、Grok Build,以及多家第三方模型路由和云平台。跑长链路 coding / Agent 工作流的开发者,可以在 Cursor 这类工具里低成本先试起来。

---

*本文基于多家媒体转述整理(Superpower Daily、SiliconANGLE、llm-stats 等)及 xAI 官方公告,官方与第三方基准成绩存在差异,请以实测为准。*

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...