马斯克动态简报|Grok 4.5声称攻克30年图论猜想,速度与成本让步于Fable

马斯克动态简报|Grok 4.5声称攻克30年图论猜想,速度与成本让步于Fable

7月23日北京时间13:38-14:04,马斯克连续为Grok 4.5背书:称其解决开放约30年的图论猜想,并承认不如Fable但更快、更省;目前数学结论和商业指标都待独立验证。

今日判断

7 月 23 日北京时间 13:38-14:04,马斯克连续发出三条围绕 Grok 4.5 的信息:先称模型解决了一个开放约 30 年的图论猜想,随后承认它「不如 Fable」,但速度快、成本低,最后把读者导向已由 Grok 4.5 驱动的 Grok Build。前两条是能力与定位信号,第三条是产品落地信号;数学结论和商业指标都还没有走完验证链。

重点推文

1. 「解决 30 年图论猜想」仍是一项待复核主张

北京时间 13:38,马斯克写道:
Grok 4.5 just solved a graph theory conjecture that has been open for ~30 years
中文翻译:Grok 4.5 刚刚解决了一个开放约 30 年的图论猜想。1
详情页检索时,这条帖约有 214 万浏览、9988 个赞、1188 次转发和 1099 条回复。它的传播量足够高,但原文没有给出猜想名称、形式化证明、实验材料或数学家复核意见。
正在加载内容卡片…
搜索到的独立页面没有把这件事写成已经成立的数学事实。一篇当天发布的报道明确把结论限定为「如果经同行评审成立」,而一个专门公开模型推理过程的图论项目则把相关报道标为 disputed,直接写着「a headline is not a proof and verification is still underway」。该项目还规定每一步必须标为 established、derived 或 conjectural,说明公开模型输出与可接受的证明之间仍有距离。2 3
评论区有人提到「8 分钟」,也有人指出推翻猜想只需要一个反例,而证明猜想需要排除所有反例。这些评论能说明争议焦点,不能替代证明。因此,今天能确认的事实只有「马斯克发布了一项重大数学能力主张」,还不能写成「Grok 4.5 已完成数学突破」。

2. 马斯克承认不如 Fable,强调速度和成本

北京时间 13:50,他把比较说得更直白:
Grok 4.5 is not quite as good as Fable, but it is very fast, cost-effective and gets the job done
中文翻译:Grok 4.5 没有 Fable 那么好,但速度很快,成本效益高,而且能把工作做完。4
详情页检索时,这条帖约有 241 万浏览、8019 个赞、734 次转发和 1218 条回复。这里最有用的不是「第一名」叙事,而是马斯克主动承认能力差距,并把竞争维度换成速度、成本和任务完成度。不过他没有给出价格、延迟、token 节省比例或任务基准,cost-effective 仍是定性判断。
一篇 7 月 20 日发布的 The New Stack 实测,在 Cursor Agent 中用三个 Rust 任务比较 Grok 4.5 和 Claude Opus 4.8。文章记录的总消耗是 Grok 约 101 万 tokens、成本 1 美元,Opus 约 433 万 tokens、成本 5.14 美元;最小的 bug 修复任务中,Opus 反而更快。这是单个作者、三个任务的样本,能支持「成本和速度可能是 Grok 的卖点」,不能推成所有任务的通用排名。5
正在加载内容卡片…

3. Grok Build 把 Grok 4.5 放进开发入口

北京时间 13:56,马斯克发帖「Grok Build gets better every day」,并链接到产品页。推文详情卡片写明,Grok Build 已由 Grok 4.5 驱动;官方页面列出 Plan mode、子代理、Skills、Hooks、MCP servers、代码审查、后台任务和 CI/CD 无头模式等能力。6 7
这条信息与前一天的 Workflows、token efficiency 线索相连,但今天新增的可核验点是模型与开发工具的绑定更明确。它让 Grok 4.5 的商业观察对象从聊天模型扩到开发工作流,仍缺活跃用户、付费转化、API 价格和客户案例。

对市场的影响

观察方向今天能确认的信号还不能推出的结论
xAI 产品数学能力主张、速度与成本定位、Grok Build 集成 Grok 4.5不能据此确认模型排名、用户增长或收入增长
开发者工具官方产品页把计划、子代理、工具连接和部署流程放在同一入口没有公开使用量、留存、单位成本和大规模客户数据
Tesla、SpaceX本窗口检索到的 7 条 @elonmusk 候选中没有新的业务硬表态不能把 TSLA 或 SPCX 的波动归因于今天这些推文
DOGE、BTC没有马斯克本人新的明确表态加密市场没有可归因于本窗口推文的直接催化
政治线只留下低信息互动。马斯克在北京时间 14:04 回复「True」,对应的是 Lauren Chen 前一天关于犯罪统计的断言;原帖没有数据来源或政策文本。8 9 这条回复显示他继续放大相关传播方向,但不足以承担事实核验或政策影响分析。

接下来盯什么

  1. 图论猜想的名称、正式陈述和可复核证明是否公开,尤其要区分反例、部分引理和完整证明。
  2. Grok 4.5 是否公布同一任务下的 token、延迟、价格和成功率,验证「不如 Fable 但更快更省」到底适用于哪些工作。
  3. Grok Build 是否出现真实用户量、订阅价格、API 权限或企业客户案例。
今天的商业信号集中在 xAI,最强的一条仍是未经复核的数学主张;能进入估值讨论的部分,暂时只有开发者工具的产品化方向和待验证的成本定位。

相似内容

  • 登录后可发表评论。
More from this channel