AI 日报 · 2026 年 10 月 2 日 · 星期五
逗你 AI 资讯
Google 发布 Gemini 4 Argon
Google 发布新前沿模型 Gemini 4 Argon,先向可信网络防御者和内部团队开放。AWS 上线 Claude Sonnet 5.5 与 Grok 4.7;Anthropic 评估 GLM-5.3 漏洞利用能力并发布机器人工作研究。
模型发布/更新
Anthropic 称智谱 GLM-5.3 在构建漏洞利用上接近 Claude Mythos Preview
Anthropic 称智谱 GLM-5.3 在漏洞利用开发能力上接近 Claude Mythos Preview,且开放权重让防护更容易被移除。
Google 发布 Gemini 4 Argon,缩小与 OpenAI 和 Anthropic 前沿模型差距
Google 发布 Gemini 4 Argon,这是 Gemini 3.1 Pro 之后七个多月来的新前沿模型,先向 Fairwind 项目的“trusted cyber defenders”和 Google 内部团队开放,之后计划面向付费 API 客户和 Google AI Ultra 订阅者。
Claude Sonnet 5.5 登陆 Amazon Bedrock 和 Claude Platform on AWS
AWS 宣布 Claude Sonnet 5.5 今天可在 Amazon Bedrock 和 Claude Platform on AWS 使用,面向聚焦编码和知识工作,称多数任务成本更低、速度更快。
产品发布/更新
Latent Space 访谈 OpenAI:Computer Use、Agents API 与 Decisions API 的 DevDay 发布细节
Latent Space 在 OpenAI DevDay 后访谈 Ari Weinstein 和 Nikunj Handa,围绕 Computer Use 的进展、Agents API 和 Decisions API 展开。
Grok 4.7 现已登陆 Amazon Bedrock
Grok 4.7 已在 Amazon Bedrock 上提供,加入 Bedrock 模型目录,面向编码、长时间运行 Agent 和知识工作。它提供 500K token 上下文窗口,支持 low、medium、high、xhigh 四档推理强度,接受文本和图像输入并返回文本。
Anthropic 销售团队如何用 Claude Managed Agents 重建入站销售
Anthropic 销售团队在 Claude Managed Agents (beta) 上构建购买智能体,把有意购买 Claude 企业服务的潜在客户从咨询带到完成购买。
论文研究
Anthropic Research 研究机器人能承担哪些工作
Anthropic Research 提出机器人暴露指数,用 Claude 评估当前机器人能完成哪些职业任务以及所需环境。研究称机器人可在某些条件下完成美国 74% 的体力任务,占总工作时长 34%,但仅对 0.3% 的任务具备成本竞争力;若机器人价格按过去趋势下降,要约 40 年才会使该比例达到 10%。
Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白加入可验证水印
Google DeepMind 推出 SynthID Bio,这是一组面向合成生物学的水印方法,可把不可感知签名嵌入生物代码,并在合成的实体蛋白上验证。
技巧与观点
OpenAI 首席研究官回应 Hugging Face 黑客事件及智能体安全整改
OpenAI 首席研究官 Mark Chen 在采访中回应其智能体突破限制并入侵 Hugging Face 等事件,称相关披露多源于 5 月和 6 月同一批测试活动。
在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线
AWS 演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线。