OPEN SOURCE DEEP DIVE
AI Agent HandBook:阿里云企业级 Agent 落地白皮书
阿里云按 Agent 生命周期(架构、构建、运行、治理、调优)整理的企业级 Agent 落地白皮书,Apache-2.0 开源,30 章全 Markdown。核心主张:理解 Model 与 Harness 的责任边界,不要把所有问题都归因于模型能力。覆盖 Agent Loop、任务状态机、Context Builder、Action Plane、MCP/A2A、沙箱运行时、AI 网关治理、评估数据飞轮,并附 2026 Agent 开发者调研报告与 ABACI/Kitta/B 站等真实企业案例。
阿里云开源的企业级 Agent 落地白皮书
AI Agent HandBook(github.com/aliyun/ai-agent-handbook,Apache-2.0,2026 年 9 月 11 日创建)是阿里云按 Agent 应用生命周期——架构、构建、运行、治理、调优——整理的企业级 Agent 落地实践经验白皮书,目前 516 star。它不是又一个框架或 SDK,而是一本持续演进的开放式「行业工程手册」:30 个章节 + 2026 Agent 开发者调研报告 + 企业案例,全部以 Markdown 形式放在仓库里,欢迎社区协作修订。
它的定位继承自阿里云 2025 年 9 月发布的《AI 原生应用架构白皮书》:当时解决的是 AI 原生应用的 DevOps 全生命周期问题;现在模型能力上来了,真正的瓶颈变成了两件事——工程化(把概率性的智能变成可靠的生产力,让 Agent 敢承接关键任务)与规模化(从孤立实验走向可大规模部署的智能基础设施时的稳定性、安全、性能与成本)。全书就是围绕这两条主线重写的。
全书结构:六章 30 章
| 篇章 | 章节 | 主题 |
|---|---|---|
| 架构篇 | 1–2 | Agentic Application 的定义与边界、企业成熟度判断、参考架构(组件视图 / 平台责任 / 生命周期视图) |
| 构建篇 | 3–6 | Harness 的主流构建方式与责任边界;任务编排、长程推进与协作流转;上下文、状态与可复用能力资产;受控执行、验证反馈与交付准备 |
| 运行篇 | 7–12 | Agent 运行时与沙箱;状态存储与语义资产;AI 网关与统一流量治理;异步 Agent 任务与自动化;多智能体协调编排;分布式 Agent 通信 |
| 治理篇 | 13–16 | 可观测性;安全(提示注入、身份、逐动作校验、高危授权、数据外发);AI 资产(Prompt/技能/MCP/Agent)的注册、版本与发现;行为生成与上线前质量验证 |
| 调优篇 | 17–24 | Trace / Trajectory / 黄金数据集 / 评估实验驱动的持续改进数据飞轮 |
| 实践篇 | 25–30 | 企业案例(ABACI 内核补丁定向测试、Kitta 领域代码审查 Agent、B 站跨平台内容洞察等);展望:从 Agentic Application 走向 Agentic OS |
为什么值得读:Harness 视角
对 harness/agent 基础设施方向的人来说,这本书最核心的主张在第 3–5 章:理解 Model 与 Harness 的责任边界,不要把所有问题都归因于模型能力。章节导航里明确覆盖了 Agent Loop、任务状态机、计划与阶段门禁、委派、异步续行与完成证据(第 4 章);Context Builder、压缩与卸载、Session/Task 状态、工作区、记忆、知识与技能(第 5 章);Action Plane、Function Calling、MCP、A2A、环境契约、权限与 HITL(第 6 章)。第 7–9 章则把运行时、沙箱、Event Log / Checkpoint / 工作区快照 / Artifact、以及横跨 LLM、MCP 和 Agent 流量的 AI 网关治理(身份、权限、预算、路由、审计)串成了一套完整的生产执行视图。
按读者角色给的「阅读路径」也很实用:开发者看构建/运行/调优篇掌握 Harness、上下文、状态、工具、沙箱、轨迹与评估闭环;架构师看架构/运行/治理篇形成可扩展的 Agent 基础设施设计;技术负责人看架构/治理/实践篇判断应用形态、成熟度、投入边界与生产风险;安全质量运维人员看运行/治理/调优篇建立可观测、审计、上线验证与故障归因机制。
一些值得注意的点
- 开源演进而非一次成稿:Roadmap 明确说要随模型、Harness、协议、运行时、多智能体系统与 Agentic OS 的演进持续修订,并开放社区协作(内容准则、案例模板、术语、评审流程)。
- 附带 2026 Agent 开发者调研报告:覆盖企业 Agent 开发、生产化、架构选型、工具链、治理与评估现状,可单独阅读。
- 案例是真实业务:软件工程(内核补丁测试、领域代码审查)与客户运营(B 站内容洞察)等,不是玩具 demo。
- 语言注意:章节正文目前是中文,英文 README 只是导读而非全书翻译。
与 RobotWorld 的相关性
站点此前已收录 langchain-ai/deepagents、XiaomiMiMo/MiMo-Code、Untrivial-ai/agent-orchestrator 等 harness 类开源项目——那些是「怎么造一个 harness」;这本手册回答的是「harness 造出来之后,企业怎么把它跑稳、管住、调好」,两边的视角正好互补,适合一起读。
资源
- 仓库:https://github.com/aliyun/ai-agent-handbook(Apache-2.0)
- 前作:《AI 原生应用架构白皮书》(developer.aliyun.com/ebook/8479)
- 关键词:Agentic Application、Agent Harness、上下文工程、MCP、A2A、Agent 治理、评估闭环、Agentic OS