跳到正文

推理能力

模型推理能力的进展:思维链、推理模型、数学与逻辑基准的突破与争议。

最新精选

第 101–105 条 · 共 105 条
7月23日周三
  1. Mistral AI65

    Mistral AI发布AI环境标准报告,披露Mistral Large 2训练与Le Chat推理足迹

    Mistral AI发布其LLM环境足迹研究,提出用生命周期分析支持AI行业的全球环境标准。该研究与Carbone 4和法国生态转型机构ADEME合作,并经Resilio和Hubblo同行评审,披露Mistral Large 2截至January 2025且经过18个月使用后的影响为20,4 ktCO₂e、281 000 m3用水和660 kg Sb eq。

    推荐理由:报告给出训练与推理的环境核算口径,可作为比较模型足迹的参考样本。

7月17日周四
7月11日周五
  1. moonshotai · Hugging Face 新模型85

    Moonshot AI 发布 Kimi-K2-Instruct,1T 参数 MoE 模型面向 Agent 能力

    Moonshot AI 发布 Kimi-K2-Instruct,这是 Kimi K2 的后训练版本,面向通用聊天和 agentic experiences。Kimi K2 是 MoE 语言模型,拥有 1T 总参数、32B 激活参数、128K 上下文窗口,并在 15.5T tokens 上预训练。

    推荐理由:材料同时给出架构参数、基准对比和部署方式,便于评估 Kimi K2 的编码与工具调用定位。

7月3日周四
6月10日周二