跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

184条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 121–140 条 · 共 184 条
5月27日周三
  1. Cognition Blog77

    Cognition 完成超过 $1B 融资,估值达 $26B

    Cognition 宣布完成超过 $1B 融资,估值为 $26B,由 Lux Capital、General Catalyst 和 8VC 领投。公司称 Devin 企业使用量自今年初增长 >10x,run-rate revenue 达 $492M,客户包括 Citi、Mercedes-Benz、Goldman Sachs、U.S. Army 和 U.S. Navy。

    推荐理由:融资金额、收入增速和客户案例放在一起,呈现 Devin 从云端 Agent 工具走向企业级交付的商业进展。

5月23日周六
  1. stepfun-ai · Hugging Face 新模型79

    阶跃星辰发布 Step 3.7 Flash 198B MoE 视觉语言模型

    阶跃星辰发布 Step 3.7 Flash,这是一个 198B-parameter sparse MoE 视觉语言模型,结合 196B-parameter 语言骨干和 1.8B-parameter 视觉编码器,支持 256k context window。

    推荐理由:材料同时给出参数规模、基准成绩、价格和部署方式,便于评估多模态智能体工作流的接入成本。

5月22日周五
  1. Mistral AI75

    Mistral AI 在 Studio 发布 Connectors,支持内置连接器和自定义 MCP

    Mistral AI 发布 Studio 的 Connectors,内置连接器和自定义 MCP 现可通过 API/SDK 用于所有模型和 Agent 调用。新功能包括 direct tool calling、人类参与审批流程,以及创建、修改、列出、删除连接器和直接运行工具的编程访问;连接器会集中注册并可用于 LeChat、AI Studio,Vibe 即将支持。

    推荐理由:原文展示了连接器从注册到调用的开发路径,可参考其处理企业数据集成与工具治理的方式。

  2. Tessl60

    Tessl 创始人谈智能体开发安全应保护编码者而非代码

    Tessl 创始人 Guy Podjarny 认为,随着 AI 智能体高速创建和删除代码,安全工作的重点应从直接保护代码转向让智能体在构建时主动保障安全。他用 ElevenLabs 音乐 API 任务说明 evals 的必要性,并称加入技能后平均分从 50% 提升到 98%;在 CodeGuard 实验中,精简到认证和授权内容的技能也达到 98%。

    推荐理由:文章把智能体开发中的安全对象从代码转向技能和上下文,给出 eval 与治理框架供团队参考。

5月20日周三
5月18日周一
  1. Cognition Blog73

    Cognition 推出 Devin Auto-Triage,用于自动调查告警并生成后续行动

    Cognition 推出 Devin Auto-Triage,Devin 现在可以监控新告警、自动调查,并返回调查结果、后续步骤甚至 PR。它可响应 Slack、Linear、GitHub、日程和 incoming webhooks,检查代码库、可观测性工具、相关 ticket 或 thread,并在需要人工时标记负责人。

    推荐理由:原文展示了 Devin 从告警检测延伸到调查和 PR 的流程,可帮助评估工程值班自动化的边界。

5月13日周三
  1. Cognition Blog63

    Devin 现已支持 Android 模拟器

    Devin 现在可以启动 Android Virtual Device(AVD),支持面向 Android 应用的自主开发。此前 Devin 能处理 Android 代码,但不能在本地 Android 环境中运行和测试应用;新的 Android 模拟器支持让它能在自己的机器上构建和运行 Android 应用,打开应用、检查行为、复现问题并验证更改。

    推荐理由:原文说明了 Devin 从编写 Android 代码扩展到本地运行测试,对移动应用开发流程有直接参考。

5月6日周三
4月27日周一
  1. Cognition Blog81

    Cognition 发布 Devin CLI,支持本地终端运行并交接到云端

    Cognition 发布 Devin CLI,可在本地 shell 运行编码智能体,并在任务超出本机能力时把同一会话交给云端 Devin。它可访问代码库、工具和环境,支持选择 Opus 4.7、GPT-5.5 和 SWE-1.6,并用 Rust 编写自定义终端渲染库。

    推荐理由:原文说明了本地终端与云端接力的边界,便于评估编码智能体在长任务中的工作流变化。

4月23日周四
4月22日周三
  1. Cognition Blog76

    Cognition 总结多智能体在软件开发中真正有效的模式

    Cognition 总结其多智能体实践,认为当前较有效的形态是保持写入单线程,让其他 agents 贡献智能而不是并行改动。文中称 Devin Review 在 Devin 编写的 PR 上平均发现 2 个 bug,其中约 58% 属于严重问题,干净上下文的审查 agent 能发现编码 agent 忽略的问题。

    推荐理由:文章用 Devin 的代码审查循环和 smart friend 实验,归纳了多智能体在软件开发中的可行边界。

4月15日周三
4月14日周二
  1. moonshotai · Hugging Face 新模型83

    Moonshot AI 开源 Kimi-K2.6 原生多模态智能体模型

    Moonshot AI 在 Hugging Face 发布 Kimi-K2.6,这是开源的原生多模态智能体模型。该模型采用 MoE 架构,Total Parameters 1T、Activated Parameters 32B、Context Length 256K,支持长周期编码、coding-driven design、Agent Swarm、图像和视频输入。

    推荐理由:原文同时给出模型结构、评测表和部署入口,便于对比其在编码与智能体任务中的定位。

4月9日周四
  1. MiniMaxAI · Hugging Face 新模型78

    MiniMax 在 Hugging Face 发布 MiniMax-M2.7 模型

    MiniMax 在 Hugging Face 发布 MiniMax-M2.7,称其为首个深度参与自身演进的模型,可构建复杂 Agent harnesses、使用 Agent Teams、复杂 Skills 和动态工具搜索完成生产力任务。

    推荐理由:材料同时列出自进化流程、工程基准和部署入口,便于比较开源权重模型的智能体能力。

4月8日周三
  1. Cognition Blog63

    Devin 如何帮助 Fortune 500 公司现代化 COBOL

    Cognition 说明 Devin 在过去八个月被多家 Fortune 500 公司用于 COBOL 现代化,覆盖数百万行代码文档、从 COBOL 到 AWS Lambda 的海关工作流迁移,以及跨数百个程序的税号逻辑重构。

    推荐理由:文章把 COBOL 改造拆成文档、批处理迁移和重构三类,呈现 Agent 适用边界与落地条件。

4月7日周二
  1. Cognition Blog74

    Cognition 发布 SWE-1.6,面向软件工程智能体改进 Model UX

    Cognition 发布 SWE-1.6,这是面向软件工程智能体的最新模型,并已在 Windsurf 面向所有人开放。SWE-1.6 在 SWE-Bench Pro 等基准上与 Preview 模型表现相近,但更强调 Model UX,减少过度思考、循环行为和不当终端依赖,更多使用并行工具调用。

    推荐理由:原文披露了从预览版到正式版的行为改进,可用于理解编码智能体体验优化的取舍。