文章 · 阿里技术

《AI Native 研发范式实践手册》重磅发布

阿里技术约 8 分钟
内容摘要阿里在云栖大会发布《AI Native 研发范式实践手册》,梳理从 Copilot 到 Agentic 的行业转折,并指出模型能力与企业 10x 研发效能之间的三重 gap:Agent 基础设施、上下文与组织配套。

原创 阿里技术 2026-09-23 14:49 浙江

唯有积极投身其中才有可能真正理解这一变革的路径和意义

刚刚,在云栖大会“智启原生 研见未来”阿里巴巴集团 AI Native 研发实践论坛上,《AI Native 研发范式实践手册》正式发布。

过去两年,AI 辅助研发经历了从“补全代码”到“自主交付”的范式转折。2024 年中,行业的主流形态仍是 Copilot——GitHub Copilot、Cursor、通义灵码等产品以 IDE 内嵌补全和对话为核心,解决的是单点编码效率问题。同年 3 月 Cognition 发布 Devin,首次提出“AI 软件工程师”概念,虽然实际能力有限,却将行业叙事从“辅助工具”拉向了“自主 Agent”。

转折发生在 2024 年底至 2025 年上半年。Anthropic 于 2024 年 11 月发布 MCP(Model Context Protocol),为 Agent 连接外部工具建立了开放标准;2025 年初 Claude Code 以 CLI 形态面世,将 Agent Harness 框架推向前台──Agent 不再嵌入 IDE 等待指令,而是以“行动—验证—纠错”闭环自主推进任务。OpenAI 随后推出 Codex CLI,并在近期迭代至 Multi-Agent V2,支持跨模型子 Agent 派发。Google 的 Gemini CLI、Jules,以及 Cursor 向 Agent 模式的转型,共同标志着行业从 Copilot 时代全面进入 Agentic 时代。

模型能力的进步为这一转型提供了基础。截至 2026 年中,主流模型在 SWE-bench Verified 上的通过率已从两年前的不足 30% 攀升至 80% 左右 ,在 Terminal-Bench 2.1 等更贴近真实工程的评测中,Claude、GPT-5.6 Sol、Qwen3 等模型均突破 85%。Coding 能力正在被快速“解决”,行业共识也随之转移:瓶颈不再是生成代码本身,而是需求理解、环境构建、测试验证、发布运维等占据研发生命周期 70%~80% 的环节。

与此同时,企业级 Agent 基础设施成为新的竞争焦点。Anthropic 于 2026 年 5 月推出 Claude Managed Agents,提供托管的 Agent 运行时、自托管沙箱执行和 MCP 隧道,让企业无需自建基础设施即可将 Agent 投入生产;Microsoft Entra 开始将 Agent 作为企业目录中的独立身份管理;MCP 授权规范纳入 OAuth 2.1;OWASP 专门整理了 Agentic AI 威胁模型。Agent 的运行环境、身份与权限体系、可观测与评测能力,正在从可有可无变为规模化落地的刚需。

在阿里巴巴,我们选择积极投身这场变革,我们认为 LLM 和 Agent 带来的变革对于软件工程来说几乎是史无前例的。从软件工程效率提升的角度,可能只有高级编程语言带来的变化可以与之相提并论,而在这种情形下,唯有积极投身其中才有可能真正理解这一变革的路径和意义。事实上大家也是这么去做的,我们积极引入内外部的各种模型和工具,鼓励工程师在真实的业务中去用全新的范式工作;我们鼓励大家打破岗位和团队的边界,让知识更透明、流动更快,让有价值判断的工程师自主决策,并看到一大批“超级个体”的涌现;我们成体系地面向 Agent 重新设计基础设施,不断打破 Agent 完成长程任务所遇到的各类障碍,并看到 Agent 从完成代码编写开始,在不断接近能够自主完成复杂软件交付的目标。

当然这一切离不开行业的整体长足进步,尤其是模型能力的持续飞跃以及 Harness 框架的演进。但是仅仅依赖模型能力的自然溢出显然不够,因为我们认识到从模型及 Harness 框架的能力,到像阿里巴巴这样的大型企业的研发效能 10x 提升,中间存在着非常大的 gap,具体来说主要在三个方面:

  1. 企业是否建设了一套完整的 Agent 基础设施以支持 Agent 安全可靠地访问操作各类内部系统。

  2. 企业是否通过重塑工作流(例如编写大量可靠的 Skill)、整理历史知识,让 Agent 能够访问到围绕目标的清晰上下文。

  3. 企业是否重塑了组织文化、人才画像及激励机制、团队协同模式,以支撑个体和团队发挥 10x 的效能。这个问题对于个体来说演进路径是比较清晰的,对团队来说会非常复杂。

带着上述问题,我们首先从三个真实的业务实践案例出发,分别是 AIDC 数字投手智能营销助手、千问用增 Agent 和万有无界平台,呈现不同团队研发范式演进路径中的实际探索与反思。随后,我们从这些案例中提炼出五个共性挑战:环境与验证驱动、平台能力升级、提效度量、数字员工和组织配套,尝试回答研发流程、协作方式和组织设计层面正在发生的结构性变化。最后,我们会进一步展开 企业级 AI 研发基础设施的技术全景:从 Harness 框架、企业知识库、工具体系(MCP / Skill / CLI),到 Sandbox 与 Coding 环境、身份与权限、生产安全 Guardrail 以及可观测能力,进而阐述让 Agent 从“能写代码”走向“可靠交付”所需要的系统性工程建设。

本手册目录如下,完整版详见:

https://ai-native.alistatic.com/app/ainativeinfra/ai-native-handbook-web/index(复制链接到浏览器打开即可下载)