思维链:它写出来的步骤,真是它想的吗?

问一句「这个方案有什么风险」,模型回你「整体可行,风险可控」,你没法判断它在哪儿偷了懒。思维链(Chain-of-Thought)让它在给结论前先把中间的步骤写出来,一步一行:要算什么、怎么算、最后得出什么。
Wei 等人在 2022 年发现,给它八个带推理过程的示例,一个 5400 亿参数模型在小学数学题上的成绩就跳到当时的最好水平。1
它替换的是「帮我仔细分析一下」这句话:目标有了,过程没人管。把要求换成「先写步骤,再下结论」,拆解的过程就会出现在回复里。
读这些步骤时得留个心眼。Turpin 等人 2023 年的实验里,只把选择题选项的顺序调换一下,模型的答案就会跟着改变,而写出来的推理几乎不提这件事2;Lanham 等人同年测量了这种脱节,发现模型变大之后,写出来的推理在多数任务上反而更不忠实3
把步骤当草稿读:用它找出出问题的那一步,数字和事实仍旧自己查。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

Comments