美团 LongCat-Next A3B 原生多模态模型开源
美团 LongCat 团队开源 LongCat-Next,这是基于 LongCat-Flash-Lite MoE backbone(A3B)的原生多模态模型,统一处理文本、视觉和音频。
推荐理由:材料同时给出模型范式、能力边界和部署条件,便于比较离散多模态路线的工程取舍。
AI 语音与音频的进展:语音合成、实时对话、音乐生成与音频理解的模型与产品。
美团 LongCat 团队开源 LongCat-Next,这是基于 LongCat-Flash-Lite MoE backbone(A3B)的原生多模态模型,统一处理文本、视觉和音频。
推荐理由:材料同时给出模型范式、能力边界和部署条件,便于比较离散多模态路线的工程取舍。
Suno Studio 1.2 面向 Suno Premier 订阅用户更新了多项音乐创作功能,强化在 Suno 内对编曲和制作流程的控制。新增 Remove FX 可从音频片段中移除效果,Warp Markers with Quantize 可调整音频时值与律动并量化到网格。
推荐理由:原文列出 Studio 1.2 的音频编辑变化,可帮助判断 Suno 向专业音乐制作流程延伸的方式。
Suno 发布 v4.5,称其为最新且最具表现力的模型,提升动态音乐、曲风多样性与准确性,并带来更丰富的人声。v4.5 支持更具表现力的描述和新的 prompt enhancement helper,并增强 Covers、Personas、Extend 等工具组合。新版本还提升生成速度,歌曲最长可达 8 minutes,并改善混音平衡、音频退化和 shimmer effects。
推荐理由:原文列出 v4.5 在曲风、声线、提示词理解和生成速度上的变化,便于对比音乐生成体验。
Suno 推出新功能 Personas,可捕捉并保存任意曲目的 vocals、style 和 vibe,并将其用于新的音乐创作。用户可从喜欢的歌曲中通过“Create”和“Make a Persona”创建 Persona,并在 Public 和 Private 间切换,公开 Persona 可供他人使用并链接回个人资料和 Persona。
推荐理由:原文交代了 Personas 的创建入口、公开权限和计费规则,便于订阅用户评估试用成本。
Suno 推出早期测试版 Covers 功能,可将语音备忘录或完整制作的曲目转换成新风格,同时保留原始旋律。该功能面向所有 Pro 和 Premier 订阅用户开放,起始提供 200 次免费 Covers,之后每次生成消耗 10 credits。Suno 提示测试期可能出现未按预期改编、返回原始片段等情况,并通过应用、Discord 或 [email protected] 收集反馈。
推荐理由:原文说明了适用对象、操作路径和计费方式,便于订阅用户评估试用成本。