跳到正文

全部动态

今日 53 条
9月15日周二
9月10日周四
9月9日周三
9月8日周二
  1. Suno Blog61

    Suno 与 Believe 和 TuneCore 达成全球战略合作

    Suno 宣布与 Believe 及其自助发行平台 TuneCore 达成全球战略合作,面向独立艺术家和厂牌开发可选择参与的新产品体验。使用 Suno 新行业合作伙伴模型创作的曲目将有资格通过 Believe 和 TuneCore 发行,相关音乐会适用音频水印、指纹识别和下载限制等保护。Suno 称新模型将很快发布,Believe、TuneCore 及其独立艺术家社区将参与后续发展。

    推荐理由:原文呈现了 Suno 与分发方从分歧到合作的过程,可观察音乐生成工具进入发行链路的方式。

9月4日周五
  1. Anthropic Research90

    Anthropic 称 Claude 生成 Fermat’s Last Theorem 的首个完整计算机校验证明

    Anthropic 称 Claude 在 11 天内基本自主地用 Lean 写出了 Fermat’s Last Theorem 的首个端到端计算机校验证明。该证明包含 13 million 行 Lean,过程中证明 30,300 个定理,最终证明使用 29,500 个中间定理,并由 Lean 校验。

    推荐理由:材料呈现 Claude 与 Prove2Me 形式化大型数学定理的流程,可参考其多智能体分工方式。

9月2日周三
9月1日周二
  1. World Labs72

    World Labs 推出用于空间智能的世界模型 Atlas

    World Labs 推出下一代世界模型 Atlas,它从零预训练,可原生处理文本、图像、视频和 3D,并采用多模态自回归扩散 Transformer 架构。Atlas 支持相机控制生成、空间重建、时空模拟和图像生成,可从 1 到 6 张输入图像生成最高 1 分钟、1440p 视频,也能输出点云或 3D Gaussian splats。

    推荐理由:原文展示了空间上下文、相机控制和3D输出,便于判断世界模型在创作与机器人仿真中的用法。

8月31日周一
  1. METR Notes76

    METR 更新安全事件,API key 被盗与公开端点暴露未发现敏感信息被访问

    METR 披露今年早些时候两起外部安全事件,经与安全顾问调查,认为两起事件均未有敏感信息被访问。3 月,一名研究员公开部署的个人 EC2 实例因认证失效暴露,攻击者诱导 Agent 泄露公共模型 API key,并消耗约 $600,000 的免费授信 API credits。

    推荐理由:披露了评测机构遭遇 API key 泄露和端点暴露的处置过程,可为敏感模型访问管理提供参照。

8月26日周三
  1. Claude Blog85

    Claude in Chrome 面向所有付费 Claude 计划开放并支持自主浏览器操作

    Claude in Chrome 现已面向所有付费 Claude 计划正式可用,并可在浏览器中自主执行部分操作,不再需要每一步都获批。它能查看当前页面,使用现有登录状态阅读和输入文本、点击链接、页面跳转和填写表单,安全分类器会在操作执行前检查其是否安全并符合用户请求。

    推荐理由:原文同时给出浏览器自动操作范围、提示注入防护和企业管理入口,便于判断落地边界。

8月25日周二
  1. zai-org · Hugging Face 新模型80

    zai-org 发布 GLM-5.3-Flash,GLM-5 系列首个原生多模态模型

    zai-org 发布 GLM-5.3-Flash,称其为 GLM-5 系列首个原生多模态模型,拥有 320B 总参数和 18B 激活参数。官方称它在基准和真实工作负载中超过 GLM-5.2,价格为其十分之一,并在编码和智能体基准上接近 Claude Opus 4.8。

    推荐理由:原文同时给出参数规模、架构变化和本地部署框架,便于比较其成本与落地路径。

8月22日周六
8月14日周五
  1. METR Notes61

    METR 过去 6 个月获得约 $71 million 资金承诺

    METR 在过去 6 个月获得约 $71 million 资金承诺,用于研究自主能力、跟踪递归自我改进、评估监控系统、开展风险评估和调查 AI 事件等项目。

    推荐理由:这篇披露了METR近期资金来源和独立性边界,可了解评估机构如何处理前沿AI公司的资源支持。

7月31日周五
  1. meituan-longcat · Hugging Face 新模型70

    美团 LongCat 发布 LongCat-Flash-Lite-Sparse 稀疏 MoE 模型

    美团 LongCat 在 Hugging Face 发布 LongCat-Flash-Lite-Sparse,这是基于 LongCat-Flash-Lite 的非思考 MoE 模型,拥有 69B 总参数、每 token 约 3B 激活参数,并原生支持最高 1M tokens 上下文。

    推荐理由:原文同时给出架构改动、长上下文设定和多项基准,便于比较稀疏版与密集前代的取舍。

7月29日周三
7月28日周二
  1. MiniMaxAI · Hugging Face 新模型85

    MiniMaxAI 发布 MiniMax-H3 全模态生成系统

    MiniMaxAI 在 Hugging Face 发布 MiniMax-H3,这是一个通用全模态生成系统,支持文本、图像、视频和音频组成的多模态上下文理解,并可生成带原生立体声音频的视频。

    推荐理由:原文披露了模块拆分、输入规格和本地部署路径,可帮助开发者评估接入成本与适用场景。

  2. World Labs61

    World Labs 展示 R2S2R 引擎早期结果,用仿真训练和评估机器人

    World Labs 分享 R2S2R 引擎早期结果,称其可把真实机器人任务重建为对齐仿真,用于训练、测试并预测机器人策略在现实中的表现。SceniX 于 7 月 21 日加入 World Labs,其 real-to-sim-to-real 系统把真实机器人、环境和交互转成可控、可复用的仿真世界。

    推荐理由:原文用多个机器人任务说明 R2S2R 的训练和评估闭环,可作为仿真驱动机器人学习的技术参考。

7月26日周日
7月7日周二
4月27日周一
4月21日周二
4月14日周二
  1. moonshotai · Hugging Face 新模型83

    Moonshot AI 开源 Kimi-K2.6 原生多模态智能体模型

    Moonshot AI 在 Hugging Face 发布 Kimi-K2.6,这是开源的原生多模态智能体模型。该模型采用 MoE 架构,Total Parameters 1T、Activated Parameters 32B、Context Length 256K,支持长周期编码、coding-driven design、Agent Swarm、图像和视频输入。

    推荐理由:原文同时给出模型结构、评测表和部署入口,便于对比其在编码与智能体任务中的定位。