跳到正文

#语音

今日 1 条
今天9月30日周三
  1. The Decoder77

    ElevenLabs 发布 Eleven v4 语音模型,提升表达力和长内容一致性

    ElevenLabs 正在发布 Eleven v4 语音模型,称其能更准确遵循方向提示,并在长制作中保持声音一致。Eleven v4 支持 90 多种语言、每次请求最多 10,000 个字符,Turbo 变体面向实时语音智能体,约 150 毫秒开始生成语音。

    推荐理由:原文同时给出语言覆盖、延迟、价格和对比测试,便于评估语音模型在创作与实时智能体中的适用性。

9月29日周二
9月27日周日
  1. 机器之心(公众号 · Wechat2RSS)36

    模型越来越强,企业 AI 为什么还卡在「最后一公里」?联通云犀从通信场景切入

    联通云犀工作流智能体从通信场景切入,把电话沟通信息转为可被 AI 理解和使用的数据,帮助企业 AI 嵌入业务流程。其重点布局 AI 数析、AI 助销、AI 助手,案例中某团队人均转化率提升 2.3 倍,新人培训周期从 2 周缩短至 3 天。平台历经 5 年技术打磨,已服务超 6 万家企业、800 万用户。

9月24日周四
9月23日周三
9月16日周三
9月8日周二
  1. Suno Blog61

    Suno 与 Believe 和 TuneCore 达成全球战略合作

    Suno 宣布与 Believe 及其自助发行平台 TuneCore 达成全球战略合作,面向独立艺术家和厂牌开发可选择参与的新产品体验。使用 Suno 新行业合作伙伴模型创作的曲目将有资格通过 Believe 和 TuneCore 发行,相关音乐会适用音频水印、指纹识别和下载限制等保护。Suno 称新模型将很快发布,Believe、TuneCore 及其独立艺术家社区将参与后续发展。

    推荐理由:原文呈现了 Suno 与分发方从分歧到合作的过程,可观察音乐生成工具进入发行链路的方式。

7月28日周二
  1. MiniMaxAI · Hugging Face 新模型85

    MiniMaxAI 发布 MiniMax-H3 全模态生成系统

    MiniMaxAI 在 Hugging Face 发布 MiniMax-H3,这是一个通用全模态生成系统,支持文本、图像、视频和音频组成的多模态上下文理解,并可生成带原生立体声音频的视频。

    推荐理由:原文披露了模块拆分、输入规格和本地部署路径,可帮助开发者评估接入成本与适用场景。