
Elon 转推 Grok 4.5「日常默认模型」体验:可以回,但要把默认问成可交付结果
Elon 转推开发者对 Grok 4.5 的日常使用体验,neodrop 可以轻量回复,但应把「默认好用」落到任务完成、审阅投入和交接结果。
先给结论
建议 neodrop 主账号回复,互动价值中等,品牌风险低,证据风险中等。原帖是一位开发者对 Grok 4.5(medium)的日常偏好,不是基准测试或产品公告。最稳的切入点,是承认「默认使用」本身有信息量,再追问它在什么任务集合里减少了切换、返工和审阅。
Elon Musk 在 2026 年 7 月 23 日 14:49 转推了 @BHolmesDev 的一句话:「I can't believe I'm still using Grok 4.5 (medium) as my daily. It's such a good default」。转推详情记录约 38.9 万浏览、42 次转发;原帖发布于 14:25,记录 668 个赞、100 条回复和 68,203 次浏览。1 2
这句话的作者是 @warpdotdev 的「Whiteboard Guy」Ben Holmes。原帖没有列出任务样本、对照模型、成本、修改轮次或失败案例,所以「good default」只能当作个人使用信号,不能写成 Grok 4.5 的普遍性能结论。
Elon 的转推可以在这里查看:
Cargando tarjeta de contenido…
适合 neodrop 的三个切入点
1. 把「默认」拆成任务组合
询问他最常交给 Grok 4.5 medium 的任务类型,以及哪些任务仍会切换模型。这个问题比直接问「为什么好用」更容易得到可比较的答案。
2. 追问完整交付成本
速度和主观顺手感都不够。可以把完成率、重试次数、修改轮次、人工审阅时间和最终可合并结果放在同一个任务里看,避免只比较一次输出。
3. 留住失败边界
默认模型并不等于全能模型。回复可以邀请作者分享一个失败样例,尤其是需要工具调用、长上下文或多人交接的任务,看看它在哪些场景会主动让位给别的模型。
推荐发送的英文 Reply
优先发这一条:
What makes it a good daily default in practice: task completion rate, time to usable output, fewer retries, or lower review cost? A few real workflow examples would be more useful than a general quality claim.
这条承认了个人体验的价值,但没有替作者做全局背书。不要写「Grok 4.5 is the best」或「everyone should switch」,也不要把作者的使用习惯改写成性能排名。
Fuentes de referencia
Contenido relacionado
- Inicia sesión para comentar.
More from this channel›
- Elon 转推 Tesla「FSD Supervised helps save lives」:视频未核验,主账号先别回
- Elon 转推 Robotaxi「38 万英里零重大事件」:先问清 incident 口径
- Elon 转推 FSD「12 billion miles、2 倍更安全」:主账号不要替安全结论背书
- Elon 转推 Grok Build 文档新增页:可以回,但要问权限、沙箱与交接
- Grok 4.5 的「30 年图论猜想」说法:neodrop 应把回复落到可复现证据
- Elon 说「用 Grok 做游戏很容易」:neodrop 可以回,但要把「容易」问成可验收结果
- Elon 发「Zero stories is a low number …」:上下文不足,主账号不建议回复
- Elon 转推「SAVE America Act」:高风险政治话题,neodrop 主账号不建议回复
