跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

159条精选相关主题产品更新论文研究开源生态

最新精选

第 101–120 条 · 共 159 条
3月30日周一
3月26日周四
  1. Suno Blog77

    Suno 发布 v5.5 模型,并推出 Voices、Custom Models 和 My Taste

    Suno 今天发布 v5.5,称其为目前最具表现力的模型,并同步推出 Voices、Custom Models 和 My Taste 三项个性化功能。Voices 面向 Pro 和 Premier 订阅用户,可用实时捕捉或上传的声音创作音乐,并通过随机短语匹配验证,生成的 Voices 默认为私有。

    推荐理由:原文同时说明 Voices、Custom Models 和 My Taste 的权限与隐私设计,可帮助判断音乐生成工作流变化。

3月25日周三
  1. meituan-longcat · Hugging Face 新模型74

    美团 LongCat-Next A3B 原生多模态模型开源

    美团 LongCat 团队开源 LongCat-Next,这是基于 LongCat-Flash-Lite MoE backbone(A3B)的原生多模态模型,统一处理文本、视觉和音频。

    推荐理由:材料同时给出模型范式、能力边界和部署条件,便于比较离散多模态路线的工程取舍。

3月24日周二
  1. Mistral AI76

    Mistral AI 发布 Voxtral TTS,4B 文本转语音模型支持 9 种语言

    Mistral AI 发布 Voxtral TTS,这是其首个文本转语音模型,参数量 4B,面向多语言语音生成和企业语音智能体。它支持英语、法语、德语、西班牙语、荷兰语、葡萄牙语、意大利语、印地语和阿拉伯语,可用 3s 参考音频适配自定义声音,并在典型 10 秒语音样本和 500 characters 输入下模型延迟 70ms、RTF ≈9.7x。

    推荐理由:原文同时给出语言覆盖、延迟、价格和架构细节,便于比较企业语音智能体的接入成本。

3月20日周五
3月17日周二
  1. Mistral AI67

    Mistral AI 发布 Leanstral,面向 Lean 4 的开源代码智能体

    Mistral AI 发布 Leanstral,称其为面向 Lean 4 的开源代码智能体,用于在严格规格下生成并证明实现。Leanstral 采用高度稀疏架构,拥有 6B active parameters,权重以 Apache 2.0 许可发布,并集成到 Mistral Vibe、提供 labs-leanstral-2603 API endpoint。

    推荐理由:原文把形式化证明场景、FLTEval 对比和开放入口放在一起,便于评估可信编码智能体的工程取舍。

3月11日周三
3月5日周四
  1. mistralai · Hugging Face 新模型79

    Mistral Small 4 119B 2603 Eagle 发布,统一 Instruct、Reasoning 和 Devstral 能力

    Mistral AI 在 Hugging Face 发布 Mistral Small 4 119B 2603 Eagle,这是一个混合模型,可同时作为通用指令模型和推理模型使用,并统一 Instruct、Reasoning 和 Devstral 三类模型能力。

    推荐理由:材料同时给出架构参数、模式切换和 vLLM 部署示例,便于评估其在推理与智能体场景的适配。

3月3日周二
3月2日周一
  1. stepfun-ai · Hugging Face 新模型75

    阶跃星辰开源 Step-3.5-Flash-Base-Midtrain 模型

    阶跃星辰在 Hugging Face 发布 Step-3.5-Flash-Base-Midtrain,称 Step 3.5 Flash 是其最强开源基础模型,并同步开源训练代码库 SteptronOss。

    推荐理由:材料同时给出架构参数、吞吐、长上下文和基准成绩,便于比较开源 MoE 模型的效率取舍。

3月1日周日
2月12日周四
  1. MiniMaxAI · Hugging Face 新模型84

    MiniMax 发布 MiniMax-M2.5,强化编码、工具调用和搜索能力

    MiniMax 发布最新模型 MiniMax-M2.5,主打编码、智能体工具调用、搜索和办公任务。M2.5 在 SWE-Bench Verified 得分 80.2%,Multi-SWE-Bench 得分 51.3%,BrowseComp 得分 76.3%,完成 SWE-Bench Verified 比 M2.1 快 37%。

    推荐理由:原文同时给出基准、成本和部署入口,可用于比较智能体任务中的速度与价格取舍。

2月11日周三
2月7日周六
2月5日周四
2月2日周一
2月1日周日
1月23日周五