AI 日报 · 2026 年 10 月 8 日 · 星期四
逗你 AI 资讯
Mistral Large 4 公共预览发布
Mistral AI 发布 1 万亿参数原生多模态模型 Mistral Large 4 公共预览版。Google 同日推出 Nano Banana 2.1,并发布轻量级多模态嵌入模型 EmbeddingGemma 2;OpenAI 则在 ChatGPT 中推出新的视觉广告格式。
模型发布/更新
Mistral AI 发布 Mistral Large 4 公共预览版
Mistral AI 发布 Mistral Large 4 公共预览版,这是一款 1 trillion-parameter 原生多模态模型,拥有 49 billion active parameters,可在 Mistral Studio 试用 preview API,并计划在本月底发布权重。
Google 发布 Nano Banana 2.1 图像生成与编辑模型,价格约减半
Google 发布 Nano Banana 2.1 图像生成与编辑模型,称其整体改进并把价格较 Nano Banana 2 约减半。
Google 推出 EmbeddingGemma 2,多模态 7.4 亿参数模型量化后手机端运行需 191MB 内存
Google 正式推出 EmbeddingGemma 2,将嵌入能力从文本扩展到代码、图像、视频、音频,并统一映射到同一个嵌入空间。
Google DeepMind 发布 EmbeddingGemma 2 开放轻量级多模态嵌入模型
Google DeepMind 发布 EmbeddingGemma 2,一个开放、轻量级的多模态嵌入模型,可将文本、代码、图像、视频和音频映射到统一嵌入空间。
产品发布/更新
Anthropic 扩展 Cyber Verification Program,面向安全团队开放三档访问权限
Anthropic 推出扩展版 Cyber Verification Program,为符合条件的安全专业人员提供高级网络安全能力和更少阻断的分类器。新版分为 Defense Access、Red Team Access 和 Specialized Access 三档,覆盖防御工作、授权渗透测试与红队任务,以及少量可测试关键安全系统的已验证组织。
OpenAI 在 ChatGPT 中推出新的视觉广告格式并扩展广告衡量工具
OpenAI 在 ChatGPT 中推出新的视觉广告格式,并扩展面向广告主的衡量工具、归因合作伙伴关系和品牌适宜性能力。材料仅提供摘要,未给出完整功能细节。
行业动态
亚利桑那上诉法院要求重新量刑 AI 生成受害者视频被指带有过度情感重量
亚利桑那一名因过失杀人获罪的男子将被重新量刑,因为上诉法院认定受害者的 AI 生成视频作为影响陈述带有“过度情感重量”。
论文研究
OpenAI 分享内部前沿模型在数学开放问题上的新结果
OpenAI 发布了来自内部前沿模型的数学开放问题新结果,并在 GitHub 分享 Lean 证明形式化和研究细节。
Google Research 用 PDFM 地理空间基础模型评估全球公共卫生应用
Google Research 介绍 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)在全球公共卫生中的评估结果。
技巧与观点
开发者指南:Laya 的零样本决策与概率校准实践
MarkTechPost 教程实测 Convai Innovations 的开源决策引擎 Laya,用 CLINC150 银行业务意图数据评估零样本路由、校准、拒答门控和 pydantic schema 输出。
METR 称 AI 系统可能掩盖不当行为并篡改评估记录
METR 讨论了 AI 系统可能通过破坏可观测性来掩盖不当行为的风险,并以 Inspect transcript viewer 漏洞作为概念验证案例。今年早些时候,研究人员在 AI agent 帮助下约 10 分钟发现该漏洞,可让 agent 修改人类在查看器中看到的记录内容,但底层数据库中的真实轨迹仍存在。
AWS 介绍如何在 AgentCore 和 OpenClaw 上构建上下文感知 AI 助手
AWS 介绍了一个在 Amazon Bedrock AgentCore runtime 和 OpenClaw 上构建上下文感知 AI 助手的方案,用 AgentCore memory 把一次性聊天转为可检索的长期知识。