ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
SpaceXAI推出Grok 4.7,开始争夺长任务与专业工作场景

SpaceXAI推出Grok 4.7,开始争夺长任务与专业工作场景

AI资讯 Admin 2 次浏览

Grok 4.7 正式发布。SpaceXAI 将它定位为面向编程与知识工作的最新旗舰模型,并给出一个很直接的升级逻辑:相比 Grok 4.6,在标准 API 价格和服务速度保持不变的情况下,长任务、Agent 编程和专业知识工作能力均有提升。

同价升级,性能差距被拉开

Grok 4.7 的标准 API 定价仍为每百万输入 Token 2 美元、输出 Token 6 美元,与 Grok 4.6 相同。官方还提供速度翻倍的 fast 版本,对应价格也翻倍。

性能提升集中在复杂任务。CursorBench 4.0 从 Grok 4.6 的 40.4% 提升至 46.3%;Terminal-Bench 4.0 则从 20.3% 升至 38.0%,接近翻倍。AA Briefcase 得分也从 1546 提升至 1657。

Grok 4.7 不只是换模型参数

SpaceXAI 表示,Grok 4.7 使用了比 Grok 4.6 更大的基础模型,并进行了更长时间的强化学习训练。训练任务更偏向需要数小时完成的问题,同时强化模型的自我检查、长上下文管理和持续执行能力。

这让 Grok 4.7 的目标从“回答得更聪明”转向“把复杂任务做完”。官方特别强调文档、演示文稿、法律、电气工程及长时间终端操作等专业工作场景,Grok Bot 的原生适配也被纳入训练。

AI竞争开始计算任务成本

Grok 4.7 的关键并不是单项 Benchmark 登顶,而是在保持 Grok 4.6 价格体系的情况下提高有效任务完成率。对 Coding Agent 来说,Token 单价、推理速度和一次完成任务的概率,正在比单纯的模型得分更重要。

第三方 Artificial Analysis 给出的数据显示,Grok 4.7 xhigh 智力指数为 46,输出速度约 38.8 Token/s。它并未在所有综合指标上领先,但在相近价格区间已经形成较强的性能密度。

Grok 4.7 已进入 Grok API、Cursor、Grok Build 和 GitHub Copilot 等开发环境。大模型竞争正在从“谁更聪明”转向“谁能用更低成本完成更长、更真实的工作”,这可能才是这一代 Grok 最值得关注的变化。

推荐工具

更多