Anthropic 试点开放 Claude 使用数据供外部研究者独立研究
Anthropic 试点让三组外部研究者通过 Anthropic Insights 分析约 250,000 条 Claude.ai 或 Claude Code 对话,并发布各项目的聚合数据。
推荐理由:材料展示了外部研究者如何在隐私约束下分析 Claude 真实使用数据,可作为平台开放研究数据的参考。
Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
Anthropic 试点让三组外部研究者通过 Anthropic Insights 分析约 250,000 条 Claude.ai 或 Claude Code 对话,并发布各项目的聚合数据。
推荐理由:材料展示了外部研究者如何在隐私约束下分析 Claude 真实使用数据,可作为平台开放研究数据的参考。
Claude in Chrome 现已面向所有付费 Claude 计划正式可用,并可在浏览器中自主执行部分操作,不再需要每一步都获批。它能查看当前页面,使用现有登录状态阅读和输入文本、点击链接、页面跳转和填写表单,安全分类器会在操作执行前检查其是否安全并符合用户请求。
推荐理由:原文同时给出浏览器自动操作范围、提示注入防护和企业管理入口,便于判断落地边界。
Cognition 在 Devin Fusion 上用 FrontierCode 1.1 比较 Fable 5 与 Opus 4.8,发现 Fable 5 + Sidekick 得分更高且成本更低。
推荐理由:通过同一 sidekick 下的 3,000 次评测,文章把智能体成本拆到轮次、上下文和委派策略。
Claude Code 开始支持 artifacts,可把会话中的工作进展生成实时、可分享的交互式网页,包括 PR walkthroughs、system explainers、dashboards 和 release checklists。
推荐理由:文章给出 artifacts 的协作方式、更新机制和权限边界,可帮助团队评估是否纳入代码会话流程。
Anthropic 的 Frontier Red Team 分析称,攻击者正在把 Claude Code 等智能体 AI 工具用于网络攻击,但 Anthropic 认为长期看强大语言模型会让防御者受益更多。
推荐理由:案例展示了 Claude Code 与 MCP 被串联进攻击链的方式,可为工程团队提供智能体治理的风险背景。
Anthropic 在 Claude Managed Agents 中推出 self-hosted sandboxes 和 MCP tunnels,让智能体可在企业控制的沙盒中运行工具,并连接私有网络内的 MCP servers。
推荐理由:材料说明了执行环境和私有服务连接的边界,适合评估企业智能体落地的安全架构。
Claude Managed Agents 以研究预览推出 dreaming,并向开发者开放 outcomes、多智能体编排和 webhooks。dreaming 会定期回顾 agent sessions 和 memory stores,提取模式并整理记忆;outcomes 让开发者用 rubric 定义成功标准,由单独 grader 评估并推动智能体重试。
推荐理由:原文列出 dreaming、outcomes 与多智能体编排的机制和测试数据,便于评估托管智能体的适用场景。
Claude Managed Agents 的内置记忆功能已在 Claude Platform 开放 public beta,让 agents 可从每次会话中学习。
推荐理由:文章具体说明了文件化记忆、权限和审计设计,可用于评估企业智能体的跨会话学习方案。
Claude 扩展 connectors,新增连接 AllTrails、Instacart、Audible、Tripadvisor、Intuit TurboTax 等日常应用。
推荐理由:原文列出新增生活类应用和权限控制方式,可帮助判断 Claude 连接器从办公扩展到日常场景的影响。