最新精选 第 141–151 条 · 共 151 条 04:55 SemiAnalysis 认为,AWS 可能通过 Anthropic 合作和多 GW Trainium 数据中心扩张迎来 AI 复苏。文章称 Anthropic 年化收入在 2025 年内增长 5 倍至 $5B,AWS 有 3 个园区处于建设最后阶段,合计超过 1.3GW IT capacity,专门服务 Anthropic 训练需求。
推荐理由:文章把云收入、数据中心建设和芯片 TCO 放在一起,提供了理解 AWS 押注 Anthropic 的背景。
11:34 moonshotai · Hugging Face 新模型 精选AI 评分 81 81 月之暗面发布 Kimi K2-Instruct-0905,这是 Kimi K2 的最新版本,采用 MoE 架构,拥有 1T 总参数、32B 激活参数,上下文窗口从 128k 增至 256k tokens。
推荐理由:原文同时给出参数、评测和部署入口,可用于比较 K2 版本迭代、编码智能体表现和本地推理适配路径。
19:23 Sebastian Raschka 分析 OpenAI 本周发布的 gpt-oss-120b 和 gpt-oss-20b,称这是自 GPT-2 以来 OpenAI 再次共享大型完全开权重模型。
推荐理由:文章把 gpt-oss 与 GPT-2、Qwen3 的结构差异逐项拆开,便于理解开权重模型的工程取舍。
06:33 openai · Hugging Face 新模型 精选AI 评分 93 93 OpenAI 发布 gpt-oss 系列开放权重模型,gpt-oss-20b 面向低延迟、本地或专用场景,拥有 21B parameters 和 3.6B active parameters。
推荐理由:材料同时给出参数规模、许可、硬件需求和多种推理部署方式,便于评估开源权重落地成本。
06:33 openai · Hugging Face 新模型 精选AI 评分 94 94 OpenAI 在 Hugging Face 发布 gpt-oss 系列开放权重模型,包括 gpt-oss-120b 和 gpt-oss-20b,面向推理、智能体任务和开发者用例。
推荐理由:原文同时列出许可、显存需求、量化方式和多种推理接入路径,便于评估开放权重模型的部署成本。
04:12 Meta 正以新 Superintelligence 团队、激进挖角和大规模 AI 训练集群重建其 GenAI 战略,以追赶 OpenAI、DeepSeek 等基础模型实验室。
推荐理由:文章把人才挖角、数据问题和集群建设放在同一框架下,提供了理解 Meta 追赶策略的背景。
08:55 moonshotai · Hugging Face 新模型 精选AI 评分 85 85 Moonshot AI 发布 Kimi-K2-Instruct,这是 Kimi K2 的后训练版本,面向通用聊天和 agentic experiences。Kimi K2 是 MoE 语言模型,拥有 1T 总参数、32B 激活参数、128K 上下文窗口,并在 15.5T tokens 上预训练。
推荐理由:材料同时给出架构参数、基准对比和部署方式,便于评估 Kimi K2 的编码与工具调用定位。
00:00 Mistral AI 与 All Hands AI 推出 Devstral Medium,并将 Devstral Small 升级到 Devstral Small 1.1,面向代码智能体和不同提示词、agentic scaffolds 的泛化。
推荐理由:原文同时给出开源许可、API价格和SWE-Bench Verified成绩,便于比较代码智能体模型取舍。
20:00 Mistral AI 发布 Devstral,这是一款面向软件工程任务的智能体式 LLM,并以 Apache 2.0 许可开放。
推荐理由:原文同时给出基准成绩、部署门槛和开放渠道,便于比较它在编码智能体中的适用场景。
20:00 Mistral AI 发布 Mistral Medium 3,称其在 SOTA 性能、8X lower cost 和更简单部署之间取得平衡,面向企业使用。Mistral 称该模型在全套基准上达到或超过 Claude Sonnet 3.7 的 90%,价格为 $0.4 input / $2 output per M token,并在编码和多模态理解等专业场景表现突出。
推荐理由:原文同时给出价格、部署方式和对比基准,便于评估中型模型在企业场景的取舍。
15:39 openai · Hugging Face 新模型 精选AI 评分 67 67 OpenAI 在 Hugging Face 发布 Whisper large-v3-turbo,它是 Whisper large-v3 的剪枝微调版本。模型将解码层从 32 层减少到 4 层,因此速度更快,但会有轻微质量下降;参数量为 809 M,支持在 Hugging Face Transformers 中用于自动语音识别、语音翻译和时间戳预测。
推荐理由:模型卡同时给出结构变化与部署示例,便于评估语音转写场景中的速度和质量取舍。
上一页 1 … 6 7 8