NVIDIA Open Agent Safety Platform:持续芯片内智能体监控参考方案
NVIDIA Open Agent Safety Platform 被定位为持续芯片内监控 AI 智能体的参考方案,面向智能体 AI 的安全风险。文章将当前智能体 AI 类比 90 年代互联网:机会巨大,但也伴随大量风险。
NVIDIA Open Agent Safety Platform 被定位为持续芯片内监控 AI 智能体的参考方案,面向智能体 AI 的安全风险。文章将当前智能体 AI 类比 90 年代互联网:机会巨大,但也伴随大量风险。
World Labs 已签署最终协议加入 AMD,交易预计在 2026 年底前完成,需获监管批准并满足惯常交割条件。双方此前从 AMD GPU 上的模型训练和推理优化开始技术合作,计划建设覆盖硬件、软件、平台和广泛可访问开放模型的端到端开放 AI 生态。
推荐理由:交易把 World Labs 的空间智能研究与 AMD 硬件体系连接起来,后续重点落在开放 AI 生态。
Artificial Analysis 发布 Cyber Index Alliance,其 Cyber Index 在上线时整合三项网络安全评测。
OpenAI 的 ChatGPT 定价页被发现调整 Pro 订阅显示,100 美元/月和 200 美元/月方案分别变为 Pro Standard 和 Pro More,并删除 5x、20x 用量描述。
华为诺亚方舟实验室、华为云天筹 AI 求解器团队和华中科技大学 John Hopcroft 计算中心联合团队获得 SAT Competition 2026 并行 AI 赛道 SAT 组冠军。
MarginFlow 将固定行列和二元矩阵的 SIS proposal 设计转为 GFlowNet 学习问题,并跨 margins 摊销实现零样本泛化。它在 1904 个 margins 上训练,在 1190 个保留 margins 上评估,规模覆盖 $3\times3$ 到 $870\times6$。
Sakana AI 与东京大学提出 SAIL,用测试时扩展提升 VLM 生成机器人轨迹的可靠性,并将在 IROS2026 展示。SAIL 让 policy VLM 生成轨迹、在模拟器测试,再由 evaluation VLM 反馈并结合 MCTS 修正;在 6 个模拟操作任务中,搜索预算从 1 个候选增至 45 个后,成功轨迹发现率从 25% 升至 73%。
联通云犀工作流智能体从通信场景切入,把电话沟通信息转为可被 AI 理解和使用的数据,帮助企业 AI 嵌入业务流程。其重点布局 AI 数析、AI 助销、AI 助手,案例中某团队人均转化率提升 2.3 倍,新人培训周期从 2 周缩短至 3 天。平台历经 5 年技术打磨,已服务超 6 万家企业、800 万用户。
internlm 发布 Intern-Decision-2B,这是一个由 Qwen3.5-2B 微调而来的多模态结构化决策模型,可接收共享状态、命名问题 schema 和可选图像,并在一次模型前向中为每个问题返回答案分布。
美国上诉法院批准国防部将 Anthropic 技术列入黑名单,理由是其拒绝向军方开放部分 AI 功能。华盛顿特区巡回上诉法院以 2-1 裁定称,政府担心受限模型意外停止导致军事行动失败,Anthropic 则担心不受限模型为致命武力幻觉出不当目标。法院称国防部长未超越《供应链安全法》或宪法授权,并驳回复审申请。
推荐理由:判决呈现军方采购权限与模型能力限制之间的冲突,可作为理解 AI 军事使用治理边界的案例。
CESifo一篇新工作论文认为,目前没有证据显示AI对应届大学毕业生造成显著、广泛的岗位替代或招聘减少。研究者Robert Fairlie和Jane Wu聚焦近期毕业生,因为劳动力需求变化可能先体现在招聘减少上;这与上月斯坦福研究称AI影响职业的入门级就业落后的结论相反。
a16z 正在推出 Cosign,并借此阐释 Silicon Valley 如何把早期信任、公开背书和社交关联转化为人才声誉。文章称,公开展示作品已成为新的“warm intro”,Twitter、播客、线下活动和私下群聊共同构成可见的 affiliation graph。
千问AI平台在云栖大会论坛发布面向Agent的全新服务方式,围绕开放共建、Agent友好服务和持续授权执行展开。平台推出Qwen共创计划和千问AI Arena,前者面向至少26个领域招募模型评测专家,后者第一期聚焦跨境电商素材生成,已有800多位用户报名、收到1,626次Agent提交。
Cognition 宣布其年化收入运行率已突破 $1B。公司称,Cognition 于 January 2024 创立,Devin 在正式可用不到两年后,已与 GE Aerospace、Rivian、Rohlik、Exa 等工程团队协作。Cognition 表示这一里程碑属于客户,目标是让软件默认更好、更令人愉悦并无处不在。
推荐理由:这篇官方披露把收入里程碑与 Devin 的企业客户采用情况放在同一背景中。
Intern-Decision 将状态、可选图像和多类问题转换为带概率的决策,并微调 Qwen3.5 语言骨干。Intern-Decision-4B 在七个测试套件平均准确率达 90.02%,RTX 4090 本地平均延迟为 44.16 ms。
GitHub Copilot 博客提出 chat 往往不是合适的 AI 交互 UI,并介绍 GitHub Copilot app 中的 canvases。canvas 是运行在 GitHub Copilot app 内的小型全栈应用,可与 GitHub Copilot agent 双向通信,也能调用第三方 API 或在本机执行代码。
推荐理由:文章用多个 canvases 示例说明替代纯聊天的思路,可迁移到本地工具和开发流程自动化。
GitHub Security Lab 推出 Fuzzing Taskflow,这是面向 C/C++ 项目的自主模糊测试流水线,基于 GitHub Security Lab Taskflow Agent 构建。
推荐理由:原文同时给出运行方式、架构分层和安全提示,可用于评估 LLM agent 在模糊测试中的落地边界。
David Heinemeier Hansson(DHH)在 Rails World 主题演讲中称,至少在 37signals,专业工作中手写代码的时代已经结束。Pragmatic Engineer 的 The Pulse 将此作为“手写代码是否终结”的争论切入点,并提到 Amazon 和 Meta 招聘受阻。
NVIDIA 加入 Google DeepMind、EMBL-EBI 等全球研究机构联盟,在 AlphaFold Database 开放发布 2,800 多种病毒的蛋白复合体预测 3D 结构。
推荐理由:原文展示了开放数据集与生成流程,能帮助理解 AI 蛋白结构预测在疫情准备中的应用。
Remedy Entertainment 的 CONTROL Resonant 本周首发登陆 GeForce NOW,Ultimate 会员可用 GeForce RTX 5080-class 云端性能串流。
Apple ML 研究用预量化 latent 作为监督信号,蒸馏压缩 Apple 设备端听写所用的流式神经音频 tokenizer。2.8× compression 下,学生编码器在六组教师—学生组合中的五组无需 fine-tuning 即保持在教师 1.9% relative WER 以内,并比同容量独立训练 tokenizer 提升 3.9% relative。
本周,美国和中国开始就新兴 AI 安全风险举行会谈,美国提出建立 AI 安全通知机制。如果中国同意参与,双方可在本国 AI 系统构成威胁或行为不可预测时发送警报,也可分享“共同目标愿景”。文章称,该提议面临信任障碍,包括美国出口管制、国会拟议芯片和硬件限制,以及两周前美国司法部对 6 家中国 AI 制造商的指控;中国强烈否认相关指控。
Microsoft Research 研究显示,现实物理 AI 机器人只依赖板载 GPU 推理会限制性能、电池寿命和扩展性,将推理卸载到边缘或云端 GPU 可带来优势。
推荐理由:原文用机器人任务对比板载、边缘和云端推理,为物理 AI 推理基础设施设计提供参考。
Google DeepMind 介绍了 Private AI Compute 的新架构,将在服务端提供私有、持久、跨设备的 AI 记忆,同时维持接近端侧处理的隐私标准。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两个文本转语音模型,用于生成自定义角色声音并逐行控制场景对白。
推荐理由:原文同时给出能力、评测和开放渠道,便于判断 Gemini 音频模型在创作与企业语音场景的定位。
字节跳动安全研究团队与香港城市大学的联合研究 TWIST 被 ACM CCS 2026 接收,提出面向云上大模型托管的隐私保护推理方案。TWIST 通过联合模型-Token 变换、加性-乘性混合噪声和 RmDP 分析,在不修改推理引擎、不依赖特殊硬件的情况下兼容标准 serving 流程。
腾讯基于智能体编排平台搭建错误码治理 Agent,将知识库、代码关系图谱、可观测平台数据和代码托管平台挂载到同一 Agent,分钟级产出根因分析和修复建议。在 50 条 case 对比中,优化后的 action_type 与人工标注一致率从 66% 提升到 88%,硬冲突率从 20% 降至 0%。工作流已上线,近一个月内日均处理数百条去重错误码告警,high 置信度占比约 90%,失败率约 1%。
阿里云在2026云栖大会MaaS&Agent技术主论坛宣布千问AI平台全面升级,新增Agent服务和行业AI解决方案支持,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。
火山引擎 ADrive 智能网盘让 Agent 在授权范围内直接读取项目文件夹,并把分析草稿、报告保存回同一空间,减少人工上传下载和转交。项目空间支持本地挂载、在线预览、历史版本恢复、链接分享,并通过身份与目录权限限定读写范围、提供操作审计;演示中三次未授权写入均被拒绝。
Cognition 上周在 São Paulo 的 MASP 宣布扩展到拉丁美洲,称将帮助当地企业构建、现代化和维护软件。文章称拉丁美洲在 GitHub 上有 15.8 million 开发者,接近 2020 年的 5 倍,是仅次于 United States 和 India 的第三大开发者社区。
METR 发布了 Claude Opus 5.5 预部署评估摘要,重点考察其对 Anthropic AI R&D 的潜在加速影响。评估基于 10 business days 的 API 访问、五项任务测试、Anthropic 问卷与访谈,以及另一项 METR 内部 AI R&D 加速评估的结论。
推荐理由:报告把模型能力测试与研发加速问题分开处理,可帮助读者理解预部署评估如何约束能力叙事和风险判断。
2026 云栖大会技术主论坛·MaaS & Agent 将于9月22日13:30在杭州国际博览中心二期启幕,聚焦「创造 Token、成就 Agent、交付生产力」。论坛将呈现阿里巴巴 MaaS 战略,展示千问 AI 平台演进,并发布千问办公、Qoder、千问 APP 全新版本和 Qwen Intelligence 手机智能解决方案。
Google Research 推出 MilleMiglia,一个用于生成中程物流配送问题真实 benchmark 的 C++ 实例生成器。它将中程物流建模为时空图上的多商品流问题,覆盖配送中心时间窗口、换车接续、存储和分拣等约束;源代码和文档已在 GitHub 提供。
@BroadInstitute、@UniofExeter 及其他机构的研究人员已经在使用 AlphaGenome Atlas,以更好地识别潜在致病 DNA 变异并解读其作用。🧵
NVIDIA 在 Hugging Face 发布 DeepSeek-V4.1-Flash-NVFP4,这是 DeepSeek AI 的 DeepSeek-V4.1-Flash 的 NVFP4 量化版。
Mistral 宣布与 Mozilla 合作,Firefox Smart Window(beta)现由 Mistral models 提供支持。Smart Window 是 Mozilla 的 AI 浏览助手,可帮助理解复杂搜索、找回用户离开的重要内容,并基于浏览器标签页提供相关信息;Mistral 将为法国和北美用户提供支持,英国和德国预计今年晚些时候跟进。
推荐理由:材料说明了 Firefox Smart Window 的模型供应和数据保留安排,可用于观察浏览器 AI 的开放分发路径。
Claude Cowork 和聊天从今天起合并为一个 Claude,Claude 会根据任务需要在对话中调用 Cowork 和 Design 能力。该功能将在未来几周先面向 Pro 和 Max 计划推出,之后扩展到更多计划;Claude Docs 和 Claude Slides 同日上线,Claude Design 也可在对话中使用。
推荐理由:原文把 Cowork、Design 与聊天合并的可用范围讲清楚,可帮助判断 Claude 工作流入口的变化。