InternLM · GitHub 原创项目· InternLM·· 2026-06-16精选AI 评分61
InternLM 开源 RNG-Bench 非马尔可夫游戏评测基准
InternLM/RNGBench
AI 导读
InternLM 的 RNG-Bench 发布代码与论文 arXiv:2606.19338,用两类 Reconstructive Non-Markov Games 评估模型在闭环中记住历史并行动的能力。
推荐理由
材料给出基准设计、排行榜和可复现实验入口,可用于比较多模态模型在闭环记忆行动任务中的差异。
来源:InternLM · GitHub 原创项目 · github.com