思维链
Chain-of-Thought
让AI在给出答案前先写出推理过程,正确率会提升的发现。是推理模型的起点。
简单来说
不是让AI直接给出答案,而是让它「一步步写出解题过程」再作答,结果发现正确率大幅提升。这一发现因2022年谷歌的一项研究而广为人知,「让我们一步步思考(Let's think step by step)」这句话也曾像咒语一样被反复提起。
这和笔算比心算更准确是同样的道理。这一发现后来进一步发展,催生出内置「思考时间」的推理模型——如果文章中提到模型的「思考过程」或「thinking」,说的就是这个脉络。
亲手试一试
- 试着这样问:「我有5个苹果,吃掉2个,又买了3个,然后分出去一半。还剩几个?只用一个词回答。」
- 接着再问:「用同样的问题,展示计算过程,一步步解答。」
- 你会发现写出过程能减少出错——这就是思维链。如今的推理模型即使不特意要求,也会被训练成在内部自动完成这种「写过程」的步骤。
相关词条
出现过这个词的报道
目前还没有报道用到这个词。有新报道时会自动出现在这里。