文章核心总结与翻译
一、主要内容
文章提出苏格拉底式自我优化(SSR) 框架,用于解决大语言模型(LLMs)推理过程中的级联错误问题。SSR将模型推理轨迹分解为可验证的(子问题、子答案)对(即苏格拉底步骤),通过步骤级重解、自一致性校验实现精准置信度评估,定位不可靠步骤并迭代优化,最终提升推理准确性和可解释性。
在5个推理基准(3个数学任务、2个逻辑任务)和3种主流LLM上的实验表明,SSR及其变体(线性SSR、自适应SSR、带规划优化的SSR)持续优于现有迭代自我优化基线,在计算成本相当的情况下,初始准确率相对提升约67.57%,且在CoT性能趋于饱和时仍能有效扩展。
二、创新点
- 细粒度推理分解:将自然语言推理轨迹转化为(子问题、子答案)对序列,突破传统整体式评估的局限,实现步骤级精准控制。
- 步骤级置信度评估:通过多轮并行重解子问题和自一致性校验,量化每个推理步骤的可靠性,为精准优化提供依据。
- 靶向优化机制:仅针对置信度最低的不可靠步骤进行优化,避免无差别整体修改,提升优化效率和准确性。
- 灵活部署变体:设计自适应门控(SSR-Ada)和规划优化(SSR-Plan)变体,平衡计算成本与性能,适配不同推理场景。
订阅专栏 解锁全文

1181

被折叠的 条评论
为什么被折叠?



