Berkeley AI Research·· 2026-07-26AI 评分59
ABBEL:通过更新信念状态实现高效长程交互
Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction
AI 导读
Berkeley AI Research 提出 ABBEL,通过自然语言信念状态压缩长交互历史,并用信念评分监督状态中保留的信息。 在 CollabBench 协作编程实验中,重建式信念评分将与完整上下文的性能差距缩小约一半,训练步数从 100 降至 50;峰值上下文 token 长度也低于完整上下文设置。
来源:Berkeley AI Research · bair.berkeley.edu