Google DeepMind 发布开源实验模型 DiffusionGemma,文本生成最高快 4x
Google DeepMind 发布 DiffusionGemma,这是一个采用文本扩散方法的开源实验模型,在专用 GPU 上文本生成最高快 4x。
推荐理由:原文同时说明了速度来源、硬件条件和质量取舍,适合评估本地交互式生成场景。
英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力市场的风向。
Google DeepMind 发布 DiffusionGemma,这是一个采用文本扩散方法的开源实验模型,在专用 GPU 上文本生成最高快 4x。
推荐理由:原文同时说明了速度来源、硬件条件和质量取舍,适合评估本地交互式生成场景。
Mistral AI 发布 Mistral Small 4,这是 Mistral Small 系列的下一次主要版本,把 Magistral 的推理、Pixtral 的多模态和 Devstral 的智能体编码能力整合到一个模型中。
推荐理由:原文同时给出架构参数、性能对比和部署入口,便于评估开放模型在多任务场景的取舍。
Mistral AI 发布 Mistral 3,包括 14B、8B、3B 三个小型 dense 模型,以及 Mistral Large 3 这一 41B active、675B total parameters 的 sparse MoE 模型,全部采用 Apache 2.0 license。
推荐理由:原文同时给出模型规模、许可证和部署入口,便于比较开源模型的落地成本与覆盖场景选择。