AI情报2026年8月18日AI情报
文章
SKILL:面向逻辑优化的自我纠正、知识引导的迭代式大语言模型智能体
公告类型:新 摘要:逻辑综合优化面临重大挑战,因为搜索空间呈指数级增长、奖励信号稀疏且逻辑结构多样。传统专家设计的流程缺乏适应性,而强化学习(RL)方法往往存在样本效率低和可解释性有限的问题。我们提出了 SKILL,一种自我纠正的
Frontier 编辑部来源: arXiv
公告类型:新 摘要:逻辑综合优化面临重大挑战,因为搜索空间呈指数级增长、奖励信号稀疏且逻辑结构多样。传统专家设计的流程缺乏适应性,而强化学习(RL)方法往往存在样本效率低和可解释性有限的问题。我们提出了 SKILL,一种自我纠正的