跳到正文

多模态

文本之外的能力:视觉理解、图文混合、音视频输入输出的模型与产品进展。

142条精选相关主题图像生成AI 视频语音与音频

最新精选

第 141–142 条 · 共 142 条
7月1日周一
  1. Suno Blog64

    Suno 发布移动应用,iOS 版先在美国上线

    Suno 宣布推出 Suno mobile app,version one 可在手机上制作、收听和整理音乐。用户可以用文本歌词和描述生成歌曲,也可以用手机录音并把音频变成歌曲;Suno 称已有 Twelve million people 使用过其产品。该应用目前先从美国 iOS 开始,Android、全球发布和更多更新将随后推出。

    推荐理由:官方给出移动端版本的可用范围和核心入口,便于判断音乐生成如何迁移到手机场景。

6月12日周三
  1. Suno Blog76

    Suno 推出 Audio Input 功能,支持用任意声音生成歌曲

    Suno 发布 Audio Input 功能,Pro & Premier 用户现在可以上传或录制自己的音频来生成歌曲。用户可在 Library 或 Create 页面点击 Upload Audio,录制音频或上传 6 - 60 秒的音频/视频片段,再选择 Extend、设置延展时间点、填写曲风并可加入歌词。Suno 表示受版权保护的作品会被阻止上传,所有带人声的输入将保持私密且不可搜索。

    推荐理由:原文同时给出上传流程和责任限制,便于判断音频输入会怎样进入音乐创作流程。