AI Agent· 第八讲 大语言模型的推理过程

推理和正确率

  • 推理长度越长不一定会让正确率提高

  • 答案越长也不一定让正确率提高

怎么避免模型想太多

更强的思维链(Chain-of-Thought,CoT)

  • chain of draft

给模型工作流程

让模型控制树的高度和广度

教模型推理过程

  • from explicit CoT to Implicit CoT

    前提是要用简单的问题

以结果为导向学习推理

用模型进行以正确结果为目标回答四次,选择reasoning更短的reward

https://raw.githubusercontent.com/Tin10g/PictureBed/main/20260701190017306.png

Ting WeChat PayWeChat Pay
0%