跳到正文
原文
InternLM · GitHub 原创项目· InternLM·· 2026-06-16精选AI 评分61

InternLM 开源 RNG-Bench 非马尔可夫游戏评测基准

InternLM/RNGBench

AI 导读

InternLM 的 RNG-Bench 发布代码与论文 arXiv:2606.19338,用两类 Reconstructive Non-Markov Games 评估模型在闭环中记住历史并行动的能力。

推荐理由

材料给出基准设计、排行榜和可复现实验入口,可用于比较多模态模型在闭环记忆行动任务中的差异。

来源:InternLM · GitHub 原创项目 · github.com