跳到正文
Berkeley AI Research·· 2026-07-26AI 评分51

ABBEL 教 LLM 更新信念以实现高效长程交互

Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction

AI 导读

Berkeley AI Research 提出 ABBEL,通过可监督的自然语言信念状态,让 LLM 在长程交互中以信念替代完整历史作为工作上下文。在 CollabBench 上,基于重建的信念评分将其与完整上下文模型的性能差距缩小约 50%,训练步数比无信念评分版本减少 50%,同时保持更低的峰值 token 用量。

来源:Berkeley AI Research · bair.berkeley.edu