Elon 转推 Grok Build 系统提示词:可以回,但把「做完」问成可验证交付

Elon 转推 Grok Build 系统提示词:可以回,但把「做完」问成可验证交付

这条转推分享了分步执行、完成后复核正确性并提交样例输出的系统提示词经验;neodrop 可从验证闭环、状态可见性和人工交接切入。

快速判断

可以轻量回复,但要把「做完」问成可验证交付。 Elon Musk 在 2026 年 7 月 18 日 13:13 CST 转推了 Yun-Ta Tsai 的帖子,没有增加自己的说明。原帖作者的 X 公开资料自述为 Tesla AI 的 Senior Staff Engineer,分享的提示词要求 agent 先完成 a、b、c 等任务,随后「double-check the correctness」、私信样例输出的可视化结果,然后离开任务。1 2
这条转推的可用价值不在于证明 Grok Build 自动可靠,而在于它把 agent 工作流里常被省略的一步说清楚了:任务完成后还要复核,并留下可供人检查的输出。neodrop 可以从验证闭环、状态可见性和人工交接切入,不应把个人提示词经验扩写成产品能力或性能证明。

这条提示词真正提供了什么

  1. 任务分解。 用 a、b、c 这样的步骤把目标拆开,方便检查是否有遗漏。
  2. 完成后复核。 「double-check the correctness」把正确性检查放到任务末尾,而不是默认 agent 说完成就算完成。
  3. 留下样例输出。 可视化的 sample outputs 提供了一个比聊天窗口里的「done」更容易被人审阅的交付物。
  4. 交接边界仍然未知。 「Then walk away」是作者建议的工作方式,不代表系统已经证明自己能独立处理失败、权限或回滚。

Reply 切入角度

  1. 追问验证方法。 任务结束后的 double-check 检查什么,使用测试、对照样例、人工审阅,还是其它机制。
  2. 把 done 变成审阅包。 关注任务状态、测试结果、失败项、样例输出和剩余风险是否一起留下。
  3. 讨论自动化边界。 如果 agent 在验证后离开,谁负责处理权限错误、回归失败和需要人工决策的分支。

可直接使用的英文话术

首选:
The strongest part is the verification loop: define the task, finish it, then show sample outputs and evidence. What do you use to validate correctness before walking away?
从可交付结果切入:
For agent workflows, “done” should include a reviewable artifact: task state, tests run, failures found, and sample outputs. How much of that is automatic in Grok Build?
要求对照实验:
It would be useful to compare the same task with and without the final double-check step: what changes in correctness, rework, and handoff time?

结论

建议 neodrop 主账号轻量回复,首选第一条话术。 这条转推比泛泛的「Grok Build 很好用」更适合接入 neodrop 的工作流定位,但回复必须把个人提示词经验转成可验证的交付标准,不替 Grok Build 宣称已具备完整的自主复核能力。

関連コンテンツ

  • ログインするとコメントできます。
More from this channel