跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

120条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 101–120 条 · 共 120 条
3月3日周二
3月2日周一
  1. stepfun-ai · Hugging Face 新模型75

    阶跃星辰开源 Step-3.5-Flash-Base-Midtrain 模型

    阶跃星辰在 Hugging Face 发布 Step-3.5-Flash-Base-Midtrain,称 Step 3.5 Flash 是其最强开源基础模型,并同步开源训练代码库 SteptronOss。

    推荐理由:材料同时给出架构参数、吞吐、长上下文和基准成绩,便于比较开源 MoE 模型的效率取舍。

3月1日周日
2月27日周五
  1. Cognition Blog70

    Cognition 如何用 Devin 构建 Devin

    Cognition 介绍了内部如何用 Devin 构建 Devin,上周将 659 个 Devin PR 合并进自家代码库,高于 2025 年最好一周的 154 个。

    推荐理由:文章拆解了 Cognition 内部把 Devin 接入 PR、工单、日志和数据分析的工作流,可迁移到工程团队的智能体落地。

2月24日周二
  1. Cognition Blog77

    Cognition 发布 Devin 2.2,支持桌面测试、自验证和自动修复代码

    Cognition 发布 Devin 2.2,称这是 Devin 上线以来最大的更新之一,新增通过 computer use 测试、自验证和自动修复代码能力。Devin 现在可访问自己的 Linux desktop,用于启动和测试 desktop applications,并在创建 PR 后建议在桌面上测试,随后返回 screen recordings。

    推荐理由:原文给出 Devin 从写代码到测试修复的闭环变化,可用于评估编码智能体接管 PR 前流程的边界。

2月10日周二
  1. Cognition Blog72

    Devin 推出自动修复 PR 审查评论功能

    Cognition 推出 Devin 自动修复 PR 审查评论功能,可配置 Devin 处理来自 Devin Review 和其他 review bots 的评论,并继续自动修复 lint 与 CI/CD 问题。

    推荐理由:原文展示了编码智能体与审查机器人闭环的配置方式,可参考其把机械修复前置到人工评审前。

1月23日周五
1月21日周三
12月20日周六
  1. MiniMaxAI · Hugging Face 新模型82

    MiniMax 开源 MiniMax-M2.1,面向 Agent 编码与工具使用

    MiniMaxAI 将 MiniMax-M2.1 交给开源社区,称其面向编码、工具使用、指令遵循和长周期规划做了优化。MiniMax-M2.1 API 已在 MiniMax Open Platform 上线,基于该模型的 MiniMax Agent 已公开可用,模型权重已在 Hugging Face 开源并支持本地部署。

    推荐理由:原文同时给出多项编码与工具使用评测及本地部署方式,便于比较开源 Agent 模型的工程适配。

11月30日周日
11月14日周五
11月4日周二
  1. moonshotai · Hugging Face 新模型85

    Moonshot AI 发布 Kimi-K2-Thinking 开源推理模型

    Moonshot AI 发布 Kimi-K2-Thinking,称其为最新、能力最强的开源 thinking model,支持逐步推理并动态调用工具。该模型为 MoE 架构,总参数 1T、激活参数 32B、上下文长度 256K,原生 INT4 量化,称可在低延迟模式下实现无损 2x 加速,并在 200–300 次连续工具调用中保持稳定。

    推荐理由:原文同时给出架构参数、评测设置和部署入口,便于比较开源推理模型的长程工具调用能力。

10月29日周三
10月16日周四
9月29日周一
  1. Cognition Blog69

    Cognition 发布搭载 Claude Sonnet 4.5 的 Devin Agent Preview

    Cognition 宣布 Devin Agent Preview 接入 Claude Sonnet 4.5,并称该模型从今天起可在 Devin 中使用。Cognition 表示,在 Devin 上 Claude Sonnet 4.5 将规划性能提高 18%、端到端评测分数提高 12%,是自 Claude Sonnet 3.6 发布以来该团队看到的最大提升。

    推荐理由:原文披露了 Sonnet 4.5 接入 Devin 后的评测变化,可用于观察编码模型对智能体工作流的影响。

9月3日周三
7月30日周三
7月11日周五
  1. moonshotai · Hugging Face 新模型85

    Moonshot AI 发布 Kimi-K2-Instruct,1T 参数 MoE 模型面向 Agent 能力

    Moonshot AI 发布 Kimi-K2-Instruct,这是 Kimi K2 的后训练版本,面向通用聊天和 agentic experiences。Kimi K2 是 MoE 语言模型,拥有 1T 总参数、32B 激活参数、128K 上下文窗口,并在 15.5T tokens 上预训练。

    推荐理由:材料同时给出架构参数、基准对比和部署方式,便于评估 Kimi K2 的编码与工具调用定位。