Berkeley AI Research·· 2026-07-26AI 评分48
ABBEL:教大语言模型更新信念,实现高效长程交互
Teaching LLMs to Update Beliefs for Efficient Long-Horizon Interaction
AI 导读
ABBEL 通过监督自然语言信念状态的更新,改善大语言模型在长程交互中压缩上下文后的表现。在协作编程环境 CollabBench 中,相比不采用信念评分的摘要训练,基于重建的信念评分将与完整上下文模型的性能差距缩小约 50%,训练步数减少 50%。训练后,其峰值上下文 token 用量仍显著低于完整上下文模型。
来源:Berkeley AI Research · bair.berkeley.edu