Moonshot AI 发布 Kimi-Linear-48B-A3B-Instruct 线性注意力模型
Moonshot AI 在 Hugging Face 发布 Kimi-Linear-48B-A3B-Instruct,并介绍 Kimi Linear 混合线性注意力架构及 KDA kernel 开源信息。
推荐理由:材料同时给出架构、长上下文指标和部署命令,可用于比较线性注意力在长序列中的效率取舍。
开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。
Moonshot AI 在 Hugging Face 发布 Kimi-Linear-48B-A3B-Instruct,并介绍 Kimi Linear 混合线性注意力架构及 KDA kernel 开源信息。
推荐理由:材料同时给出架构、长上下文指标和部署命令,可用于比较线性注意力在长序列中的效率取舍。
OpenAI 在 Hugging Face 发布 gpt-oss-safeguard-20b,这是基于 gpt-oss 构建的安全推理模型,可按用户提供的安全政策对文本内容分类并执行基础安全任务。
推荐理由:原文说明了自带策略分类和可调推理强度,便于评估开源安全模型在内容审核中的适配方式。
World Labs 推出 Marble 限量访问 beta 预览,用户可在 marble.worldlabs.ai 查看并创建 3D 世界。给定图像或文本提示词,其模型可生成可长期探索的 3D 世界,并称相比此前结果,世界更大、风格更多样、3D 几何更干净。
推荐理由:原文展示了从图像或文本生成可导航 3D 世界的入口和导出方式,便于评估创作者工作流适配。
Sebastian Raschka 分析 OpenAI 本周发布的 gpt-oss-120b 和 gpt-oss-20b,称这是自 GPT-2 以来 OpenAI 再次共享大型完全开权重模型。
推荐理由:文章把 gpt-oss 与 GPT-2、Qwen3 的结构差异逐项拆开,便于理解开权重模型的工程取舍。
OpenAI 发布 gpt-oss 系列开放权重模型,gpt-oss-20b 面向低延迟、本地或专用场景,拥有 21B parameters 和 3.6B active parameters。
推荐理由:材料同时给出参数规模、许可、硬件需求和多种推理部署方式,便于评估开源权重落地成本。
Mistral AI 与 All Hands AI 推出 Devstral Medium,并将 Devstral Small 升级到 Devstral Small 1.1,面向代码智能体和不同提示词、agentic scaffolds 的泛化。
推荐理由:原文同时给出开源许可、API价格和SWE-Bench Verified成绩,便于比较代码智能体模型取舍。
Moonshot AI 发布 Kimi K2,这是一款 MoE 语言模型,拥有 1T 总参数、32B 激活参数,并用 Muon optimizer 在 15.5T tokens 上预训练。
推荐理由:原文同时给出参数规模、训练 token、评测表和部署入口,便于比较 Kimi K2 在 Agent 与编码任务中的定位。
Mistral AI 发布其首个推理模型 Magistral,面向领域特定、透明和多语言推理,并提供 Magistral Small 与 Magistral Medium 两个版本。
推荐理由:原文同时给出开源版和企业版的参数、评测与入口,便于比较其推理模型路线。