DeepSeek V3 到 V3.2 的架构、稀疏注意力和 RL 更新解析
Sebastian Raschka 解析 DeepSeek 从 V3 到 V3.2 的技术演进,重点包括 DeepSeek Sparse Attention、混合推理模型和 RL 训练更新。
推荐理由:文章把 V3.2 的稀疏注意力、RL 奖励和 GRPO 改动放进 DeepSeek 演进脉络中比较,便于理解技术取舍。
拿来就能用的实操内容:提示词技巧、工作流搭建、工具用法与踩坑经验。
Sebastian Raschka 解析 DeepSeek 从 V3 到 V3.2 的技术演进,重点包括 DeepSeek Sparse Attention、混合推理模型和 RL 训练更新。
推荐理由:文章把 V3.2 的稀疏注意力、RL 奖励和 GRPO 改动放进 DeepSeek 演进脉络中比较,便于理解技术取舍。
Sebastian Raschka 分析 OpenAI 本周发布的 gpt-oss-120b 和 gpt-oss-20b,称这是自 GPT-2 以来 OpenAI 再次共享大型完全开权重模型。
推荐理由:文章把 gpt-oss 与 GPT-2、Qwen3 的结构差异逐项拆开,便于理解开权重模型的工程取舍。