Elon 说 Grok 4.5 不如 Fable 但更快更省:可以回,别把评价当评测

Elon 说 Grok 4.5 不如 Fable 但更快更省:可以回,别把评价当评测

Elon 评价 Grok 4.5 不如 Fable,但速度快、成本效益高且能完成工作;neodrop 可以回复,应把宽泛评价转成同任务对照。

先给结论

建议 neodrop 主账号轻量回复,互动价值中高,品牌风险低,证据风险中等。Elon 的话同时给了能力、速度、成本和任务结果四个方向,但没有说明 Fable 指什么,也没有给出任务、样本、价格口径或测试条件。它适合被问成评测设计,不适合被转述成模型排名。
Elon 在 2026 年 7 月 23 日 13:50 发布:「Grok 4.5 is not quite as good as Fable, but it is very fast, cost-effective and gets the job done」。详情记录约 71.0 万浏览、2,611 个赞、248 次转发、651 条回复和 37 次引用。1
「Gets the job done」是最值得追问的部分。对 neodrop 的读者来说,真正可用的比较至少要把同一任务的完成率、延迟、重试、工具调用、人工修改、审阅时间和最终可交付结果放在一起。单独说快或便宜,容易把输出 token、API 价格和端到端成本混成一件事。
原帖入口:
正在加载内容卡片…

Reply 的三个切入点

1. 先问任务定义

「能完成工作」必须对应一个具体工作流,例如代码修改、研究检索、客服处理或内容交付,并写清验收条件。

2. 把成本算到交付

token 价格只是起点。重试、上下文补充、工具失败、人工修正和审阅时间都会进入总成本。

3. 让 Fable 比较可复现

需要同一任务集、同样的输入、相近的预算和明确的 pass/fail 规则。否则「不如 Fable」和「更快」都只是未经展开的判断。

推荐发送的英文 Reply

“Gets the job done” is the useful part to unpack. On the same task set, how do Grok 4.5 and Fable compare on completion rate, time to usable output, retries, review effort, and total cost?
这条承认了 Elon 话里的可讨论部分,同时不替 Grok 4.5 做排名或成本背书。不要把「fast」直接翻成整体生产力优势,也不要自行补写 Fable 的身份和测试结果。

参考来源

  1. 1Elon Musk 的原帖

相似内容

  • 登录后可发表评论。
More from this channel