[KongchangAI]
BenchmarkLong-Context Memory

Locomo

长期记忆评测基准,侧重评估AI系统跨会话的上下文连贯性与时序推理能力,要求在大量噪声信息中精准召回

Timeline (last 90 days)

Sep 24

Locomo(Long-Context Memory)侧重评估跨会话的上下文连贯性与时序推理

Unverified50%
Sep 16

EvoMem在Gaia、Locomo等传统静态benchmark上同样有效,因为长程任务中多轮交互本身也会改变环境状态

Unverified50%

All Facts (5)

Source Articles