跳到正文
Berkeley AI Research·· 2026-07-26AI 评分38

Berkeley AI Research 提出 ABBEL:用信念状态监督 LLM 长程交互

Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction

AI 导读

Berkeley AI Research 提出 ABBEL 框架,将 LLM 的摘要内容隔离并监督为自然语言"信念状态",替代完整交互历史作为智能体工作上下文。在协作编程基准 CollabBench 上,采用基于重构的信念评分后,ABBEL 将全上下文模型的性能差距缩小约 50%,训练步数从 100 步降至 50 步,峰值上下文 token 长度也显著低于全上下文设置。

来源:Berkeley AI Research · bair.berkeley.edu