ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
Grok 4.7 被马斯克亲承不及 Opus 5.5:xAI 押注现实世界工程数据

Grok 4.7 被马斯克亲承不及 Opus 5.5:xAI 押注现实世界工程数据

AI资讯 • Admin • • 11 次浏览

Grok 4.7 的最新评价,来自一个最不可能回避问题的人。9 月 27 日,xAI 创始人马斯克在接受中国媒体集团(CMG)旗下央视财经频道专访时,亲口承认 Grok 4.7 不如 Anthropic 刚发布的 Opus 5.5——他的原话是“a solid workhorse of a model”,可靠耐用的主力,但“不如刚发布的 Opus 5.5”。这场在特斯拉全球工程总部进行的访谈中,马斯克罕见地公开量化了 xAI 与对手的差距:xAI 真正投入 AI 约 3 年,Anthropic 约 6 年,他预计 xAI“明年某个时候”能追上前沿水平。

他具体说了什么

除了承认差距,马斯克在这次专访里放出了几条此前没公开过的业务信号:

  • Grok Bot 增长迅猛:xAI 的个人数字助理 Grok Bot“每月增长约 100%”,是他点名提到的增长最快的产品线之一。
  • 数据战略转向现实世界:xAI 目前只用了“一小部分”SpaceX 的训练数据,未来还计划引入特斯拉的训练数据,目标是让 AI 擅长“现实世界工程”(real world engineering);相比之下,Anthropic 的强项是让 AI 擅长软件工程。
  • 评价中国模型:他称中国 AI 模型表现优秀,单位算力性能比全球最佳,并预计中国将在 2 到 3 年内解决光刻与芯片算力限制。

专访还谈到 Cybercab 已在得州进入商业运营、10 年内人形机器人数量可能超过 10 亿,以及“普遍高收入”(universal high income)的长期判断——这些属于马斯克一贯的远景表述,信息增量不如上面三条实在。

和他以往的口径有什么不同

马斯克以往谈 Grok,多是“超越一切”的进攻姿态。这次亲承“不如 Opus 5.5”,并把追赶时间点明确放到“明年”,本质上是一次预期管理:先把短期落后的事实摆到台面上,再把故事讲到 xAI 独有的数据护城河上。

时间线也值得注意。Opus 5.5 于 9 月 22 日发布,随即登顶 Text Arena 榜首(见本栏目9 月 27 日 AI 简报);Grok 4.7 则是 7 月底加速发布周期后的主力版本,此前评测显示它在智能体编码上能冲进前四,但代价是每个任务消耗约 8 万 token。马斯克的“solid workhorse”评价,与这份评测画像基本吻合:能干、可靠,但不是最强。

认怂背后的三层信号

第一,竞争焦点正在从“谁的模型更聪明”转向“谁的数据别人拿不到”。 Anthropic 把 AI 做成软件工程专家,xAI 则想把火箭、工厂、自动驾驶沉淀的真实物理数据变成护城河。问题在于,马斯克自己也承认 SpaceX 的数据“目前只用了一小部分”——这套叙事还处在蓝图阶段,Grok 4.5 进入 SpaceX 与特斯拉私测时埋下的伏笔,能否兑现还要看后续投入。

第二,Grok Bot 月增 100% 说明 xAI 的重心在向消费级个人助理倾斜。 前沿实验室都在找“模型之外”的增长曲线:Meta 近期也在为个人智能体配硬件。对普通用户来说,Grok 未来的体验增量可能更多来自 Bot 这类产品形态,而非基座模型本身。

第三,对开发者的选型提示很直接。 现阶段需要前沿能力的任务,Opus 5.5 仍是更稳妥的选择;Grok 4.7 的定位是“可靠的主力”,适合对成本和稳定性敏感、对极限能力要求不高的场景。只有当 xAI 真正把现实世界工程数据用起来,这个判断才可能改写。

推荐工具

更多