Berkeley AI Research·· 2026-07-26AI 评分46
ABBEL:教大语言模型更新信念状态以实现高效长程交互
Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction
AI 导读
Berkeley AI Research 提出 ABBEL,用自然语言 belief states 替代完整交互历史,并以 belief grading 监督大语言模型更新长程交互上下文。CollabBench 上,ABBEL-rec-BG 将与 Full Context 的差距缩小约 50%,训练步数从 100 降至 50,Peak Tokens 为 6.01±0.33×10²。
来源:Berkeley AI Research · bair.berkeley.edu