AI Agent· 第八讲 大语言模型的推理过程
Contents
推理和正确率
-
推理长度越长不一定会让正确率提高
-
答案越长也不一定让正确率提高
怎么避免模型想太多
更强的思维链(Chain-of-Thought,CoT)
-
chain of draft
给模型工作流程
让模型控制树的高度和广度
教模型推理过程
-
from explicit CoT to Implicit CoT
前提是要用简单的问题
以结果为导向学习推理
用模型进行以正确结果为目标回答四次,选择reasoning更短的reward

WeChat Pay