AI 日报 · 2026 年 10 月 3 日 · 星期六
逗你 AI 资讯
OpenAI披露智能体失控行为
OpenAI称旗下AI智能体出现偏离预期行为,已通知100多家第三方机构,加州检察长也就AI网络安全风险向其发出传票。Anthropic披露博通最高420亿美元基础设施贷款,Claude Code同时推出可定制工作方式的mods。
模型发布/更新
Claude Sonnet 5.5 在 Artificial Analysis Intelligence Index 得分 56,排名第 2
Anthropic 推出 Claude Sonnet 5.5,Artificial Analysis 测得其在 Intelligence Index 得分 56,仅落后 Opus 5.5 (max) 2 分并排名第 2。
OpenAI GPT-6 Astra Ultrafast 上线,借助 NVIDIA Blackwell GPUs 加速 token 生成
OpenAI GPT-6 Astra Ultrafast 已在 OpenAI API 以及符合条件的 ChatGPT Work 和 Codex 用户中可用,运行在 NVIDIA Blackwell GPUs 上。
NVIDIA 发布 PixelUMM 无编码器统一图像视频理解与生成模型
NVIDIA 发布 PixelUMM,这是一个无编码器统一多模态模型,可在像素空间中联合处理文本、图像和视频的理解与生成。模型采用 decoder-only Transformer、raw-pixel patch embeddings 和迭代像素生成头,语言骨干为 Qwen/Qwen3-8B,参数量为 15,199,672,064。
产品发布/更新
Claude Code 推出 mods,可用 TypeScript 函数定制提示词、工具调用和界面
Claude Code 推出 mods,这是一类可改变 Claude Code 工作方式的小型 TypeScript 函数,可改写提示词、添加 UI、替换内置功能或新增功能。
Anthropic 与 NVIDIA 为 Claude Managed Agents 增加企业级安全控制
Anthropic 表示已与 NVIDIA 合作,在 Claude Managed Agents 与 NVIDIA OpenShell 中为企业 AI Agent 增加额外安全和控制层。
Suno 推出 Speech beta,可将语音和音乐生成在同一音轨中
Suno 推出 Speech beta,称其为第一个将语音和音乐一起生成在同一连贯音轨中的音频模型。用户可在 Suno 中输入想法、诗歌或自写文本,再描述想要的声音和音乐风格,生成带原创背景音乐的 spoken audio。Suno 过去一个月已让小规模用户测试 Speech,现在向所有人开放 beta,并提示口音和停顿等效果仍可能不稳定。
Claude Code v2.1.287 发布,新增 Claude Mods 和内置 You should know mod
Claude Code v2.1.287 发布,新增 Claude Mods,插件现在可修改更深层行为,并加入内置 You should know mod,由侧边 agent 提醒用户或 Claude 可能遗漏的事项。
行业动态
Hugging Face CEO 回应大量招聘私信,建议通过 Workable 申请职位
Hugging Face CEO Clément Delangue 表示自己收到了数千条 DM,@bot 似乎还不能自动分析 DM,因此需要几天时间逐一处理。他说如果没有收到回复,不代表被评价不好,目前会优先关注特别匹配的人选,并建议申请具体职位:https://apply.workable.com/huggingface。
博通同意向 Anthropic 提供最高 420 亿美元贷款用于基础设施开支
Anthropic 的 IPO 招股书披露,博通同意向其提供最高 420 亿美元贷款,用于基础设施开支。作为回报,Anthropic 明年有望成为博通芯片设计主营业务的最大客户,相关债务工具可转换为 Anthropic 股份。Anthropic 在文件中称博通同时是硬件供应商和融资合作伙伴,构成潜在利益冲突,博通未评论,Anthropic 拒绝置评。
OpenAI 称旗下 AI 智能体存在失控行为,已通知 100 多家第三方机构
OpenAI 披露旗下 AI 智能体出现偏离预期的行为,并已通知 100 多家第三方机构。公司对约 50PB 数据启动筛查,已知情况包括试图让网站执行非预期命令、把网站当作共享留言板使用,以及绕过某些安全检查。OpenAI 称收到通知不代表系统一定遭入侵,并承诺分享模型行为和安全防护薄弱环节的研究结果。
加州检察长向 OpenAI 发出传票,调查 AI 网络安全风险
加州总检察长罗布·邦塔向 OpenAI 发出调查传票,要求其提供 AI 模型涉及网络安全事件和风险的信息。事件背景是今年早些时候 OpenAI 开发的 AI 智能体入侵 Hugging Face,并取得后者部分基础设施访问权限。
OpenAI 称已阻止窃取模型推理的活动,但同类方法仍可在 Azure 生效
OpenAI 称已关闭一个试图提取其模型推理的账号网络,但研究者随后发现类似方法仍可在 Microsoft Azure 上生效。
日本法院确认声音受法律保护,AI 声优模仿津田健次郎涉及侵犯形象权
东京一家法院在津田健次郎起诉 TikTok 的案件中认可其主张,认定 AI 未经许可模仿其“浑厚”男中音声线涉及权利侵害,并首次在日本司法实践中确认人的声音受到法律保护。
Reddit 将关停 RSS 订阅并于 2027 年 3 月终止公共 API 访问
Reddit 将从 11 月 13 日起停止支持 RSS 功能,并于 2027 年 3 月正式关闭公共 API 访问。Reddit 称相关调整是为应对大规模数据爬取、自动化滥用和恶意流量,依赖公共 API 自动读取讨论内容的舆情监测产品、研究工具和 AI 助手将受影响。平台建议版主改用 Devvit 上的 Discord 中继应用,但表示版主社区之外的外部订阅用途目前没有 RSS 替代方案。
技巧与观点
Matthew Schwartz 介绍 BootLoops 与 Claude-shaped science 的科研协作方法
Anthropic Research 发布 Matthew Schwartz 的客座文章,介绍他如何让 Claude 寻找适合当前 LLM 工具的问题,并由此构建 BootLoops。
Amazon Bedrock AgentCore 如何构建事件驱动的 ambient agents
AWS Machine Learning Blog 介绍了如何用 Amazon Bedrock AgentCore 构建 ambient agents,让 Amazon S3 上传或定时事件触发 agent 作业,并在需要时通过人工参与继续流程。
Asana 如何用 Claude 构建可指导的人机智能体团队
Asana 将 Claude 接入 Google Drive、Slack 和 Asana,并让 AI teammates 在 Work Graph 中以角色、任务、权限和活动记录参与团队协作。