Grok 4.7 发布核验:API 价格、跑分与接入指南
Grok 4.7 确已发布,但宣传标题省略了不少前提。本文核对模型 ID、50 万上下文、分档 API 价格、完整跑分、安全数据与独立评测,帮助你判断是否值得迁移。
核验说明: 发布日期、模型规格、可用渠道、价格、评测设置和安全数据均已对照 SpaceXAI 官方公告与文档核验。除非特别注明独立来源,发布表中的跑分与安全数据均为厂商自测。
模型 ID 为 grok-4.7;接入生产流量前,请再次核对官方实时价格。
核验结论:发布是真的,标题没有讲全
SpaceXAI 于 2026 年 9 月 21 日发布 Grok 4.7。官方公告确认,这一代换用了更大的基础模型,并在更难的多小时任务上进行了更长时间的强化学习;回答自检、长上下文、文档与演示文稿处理、对 Grok Bot 工具链的理解和安全防护也有更新。
网传文章的大部分数据来自官方发布,但有两处容易误读。第一,Grok 4.7 是在官方表格的每一项都超过 Grok 4.6,并非每一项都超过所有竞品。第二,输入 $2、输出 $6 只是短上下文基础价;当输入达到 20 万 token 后,整次请求会按更高的长上下文费率计价。
- 已确认:9 月 21 日发布,模型 ID 为 grok-4.7,上下文窗口 50 万 token
- 已确认:输入少于 20 万 token 时,输入 $2/百万、输出 $6/百万
- 需要补充前提:发布表主要是厂商自测,而且各模型的推理档位不同
- 不能泛化:Grok 4.7 并未在所有列出的评测中击败每个竞品
- 属于营销表述:速度两倍、价格一半是相对未明确列出的“同类模型”而言
Grok 4.7 规格与 API 可用性
公开 API 的模型 ID 是 grok-4.7。它支持文本和图片输入、文本输出,上下文窗口为 50 万 token,知识截止时间为 2026 年 5 月。推理强度可选 low、medium、high 和 xhigh,文档中的默认值是 high。
SpaceXAI 同时支持 Responses API 和 Chat Completions API。Grok 4.7 可调用函数、网页搜索、X 搜索与代码执行工具。Cursor 和 Grok Build 也已接入,但这些产品可能使用不同的上下文限制和 Agent 工具链。
| 项目 | Grok 4.7 |
|---|---|
| API 模型 ID | grok-4.7 |
| 上下文窗口 | 500,000 token |
| 知识截止时间 | 2026 年 5 月 |
| 模态 | 文本与图片输入;文本输出 |
| 推理强度 | low / medium / high / xhigh |
| 接口 | Responses 与 Chat Completions |
相比 Grok 4.6,具体改了什么
按照 SpaceXAI 的说明,Grok 4.7 不是一次小修小补,而是换用了更大的基础模型。训练重点放在耗时数小时的编程和知识工作上,同时增加强化学习训练,并专门改善答案验证。文档、演示文稿和 Grok Bot 内的原生协作也是这次更新的重点。
这些改动更可能体现在长链路 Agent 任务中:规划、调用工具、发现中间步骤出错后继续修正,往往比一次问答的分数更重要。不过,官方描述不能代替业务回归。迁移时应测试完整工作流,而不是只比较几条提示词。
官方跑分:全面超过 4.6,但没有全面超过竞品
在 SpaceXAI 公布的七项成绩中,Grok 4.7 全部高于 Grok 4.6。若看另外两列竞品,结果就不是“全胜”:Fable 5.1 在 CursorBench、AA Briefcase、Terminal-Bench 和 HealthBench 更高;GPT-5.6 Sol 在 DeepSWE 更高;Grok 4.7 则在法律和电气工程两项同时领先二者。
这张表也不是完全同条件的纯模型对比。Grok 4.7 多数项目使用 xHigh,Grok 4.6 使用 High,两款竞品使用 Max;DeepSWE 中的 Grok 4.7 则是 High。Agent 框架、工具权限、输出预算和推理强度都会改变成绩。
| 评测 | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%(High) | 65.2% | 72.7% | 70.0% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
独立评测补充了哪些信息
Artificial Analysis 的独立测试中,Grok 4.7 xhigh 的 Intelligence Index 为 46,比 Grok 4.6 high 高 2 分。配合 Grok Build 时,Coding Agent Index 为 56,在当时的榜单中排第四,位于 Fable 5.1、GPT-6 Astra 和 Opus 5 之后。这说明提升确实存在,但还不足以把它说成所有任务的第一名。
同一测试也发现,它在 Intelligence Index 每个任务上平均输出约 8.1 万 token,Grok 4.6 high 约为 3.6 万;Agent 知识工作以外的项目既有上涨,也有回退。XBOW 的攻防安全测试结果较为混合,而 Grok Build 内的提升更明显。这意味着评估时不能只换模型,还要连同工具链一起测试。
Grok 4.7 价格:网传表格漏掉了长上下文档
当 API 请求的输入少于 20 万 token 时,Grok 4.7 每百万 token 的价格为:输入 $2、缓存输入 $0.50、输出 $6。输入达到 20 万 token 后,整次请求都按长上下文档计费:输入 $4、缓存输入 $1、输出 $12。
Fast 版本提供约两倍吞吐量,价格也更高,但目前只在 Cursor 和 Grok Build 提供,不开放给 SpaceXAI 公共 API。美国区域 API 端点另加 10%。工具调用和第三方平台还可能单独收费。
| 计费档位 | 输入 | 缓存输入 | 输出 |
|---|---|---|---|
| 标准版,输入少于 20 万 | $2 | $0.50 | $6 |
| 标准版,输入达到 20 万 | $4 | $1 | $12 |
| Fast,输入少于 20 万 | $4 | $1 | $12 |
| Fast,输入达到 20 万 | $6 | $1.50 | $18 |
用 OpenAI JavaScript SDK 调用 Grok 4.7
SpaceXAI 提供 OpenAI 兼容接口。将 base URL 设为 https://api.x.ai/v1,把密钥放在环境变量中,并把模型名设为 grok-4.7。新做 Agent 接入时,可优先使用 Responses API。
import OpenAI from "openai";
const client = new OpenAI({
apiKey: process.env.XAI_API_KEY,
baseURL: "https://api.x.ai/v1",
});
const response = await client.responses.create({
model: "grok-4.7",
input: "Review this migration plan and identify the two highest risks.",
});
console.log(response.output_text);使用 Responses API 发起最小 Grok 4.7 请求。
安全数据值得关注,但仍是厂商自测
SpaceXAI 公布的数据是:LatchBio 生物安全评测 62.4%;HackerBench v0.3 中,只有 3.3% 的高风险双重用途提示被放行。公司称这是目前最能拒绝危险请求、同时较少拦截合法网络安全工作的 Grok,并向部分安全合作伙伴开放邀请制红队测试。
这些数字描述的是厂商评测,不代表每一种部署都能得到相同结果。涉及网络安全、医疗、法律或生物信息的应用,仍需要权限控制、日志、人工复核和针对自身流程的红队测试。
哪些团队值得先测 Grok 4.7
长时间运行的代码 Agent、全仓库分析、文档与演示文稿生成,以及工具调用密集的研究流程,最值得先测 Grok 4.7。可以先用 high 档位,再只对确实需要的难题测试 xhigh,观察额外 token 和等待时间是否换来了更多验收通过的结果。
不要只比较标价,应统计每个验收通过任务的总成本:输入、输出、缓存命中、重试、工具费、延迟和人工复核都算在内。在代表性回归集通过前保留旧模型,尤其是当前流程深度依赖某个 Agent 工具链时。
常见问题
Grok 4.7 的 API 模型 ID 是什么?
在 SpaceXAI 的 Responses API 或 Chat Completions API 中使用 grok-4.7。
Grok 4.7 API 多少钱?
输入少于 20 万 token 时,每百万 token 为输入 $2、缓存输入 $0.50、输出 $6;达到 20 万后分别为 $4、$1 和 $12。生产使用前请核对官方实时价格。
Grok 4.7 支持 50 万 token 上下文吗?
支持。SpaceXAI 公共 API 文档标注为 50 万 token;Cursor 自己的接入则标注标准上下文 25.6 万、长上下文 50 万。
公共 API 能调用 Grok 4.7 Fast 吗?
不能。SpaceXAI 文档说明,Fast 版本目前只在 Cursor 和 Grok Build 提供。
Grok 4.7 比 GPT-5.6 Sol 或 Fable 5.1 更强吗?
不能一概而论。SpaceXAI 的表格中,Grok 4.7 在法律和电气工程测试领先二者,但竞品在多项编程、终端、办公和临床推理项目更高。应按自己的工作流和总成本测试。
Grok 4.7 支持图片输入吗?
支持。它可以接收文本和图片,并输出文本。
本系列相关
相关供应商
参考来源
- Introducing Grok 4.7SpaceXAI · 核验日期 2026-09-22
- Grok 4.7 model documentationSpaceXAI Docs · 核验日期 2026-09-22
- SpaceXAI API pricingSpaceXAI Docs · 核验日期 2026-09-22
- Grok 4.7 in CursorCursor · 核验日期 2026-09-22
- Benchmarking Grok 4.7Artificial Analysis · 核验日期 2026-09-22
- Grok 4.7 offensive security evaluationXBOW · 核验日期 2026-09-22