源码深度学习 · 零基础友好

gov-agents-platform 框架源码学习

20 天 · 每天 30 分钟 · 从"Agent 是什么"到"读懂一个企业级多 Agent 可信工程化框架"

00

开篇 · 这是个什么框架

先破除一个误解:它的名字里有 gov,但和"政务"毫无关系。这里的 gov 指的是 governance(治理)——也就是"给 AI Agent 上护栏、做可信工程化"的意思。

一句话概括它:架构组内部的「多 Agent 开发框架」。它想解决的痛点是——

🎯 每个人开发新 Agent 时,只写业务逻辑 + 调 API,而"防幻觉 / 失败兜底 / 自动评测 / 成本管控"这些可信能力开箱即有,不用每个 Agent 重复造轮子。

换句话说,这个仓库 = 一套共享的"可信底座"(ai-trust-toolkit)+ 二十来个基于它开发的业务 Agent(apps/*)+ 把它们跑起来的运行时(server / cli / mcp)+ 一个 Web 管理门户

零基础也别怕:前 5 天完全不假设你懂 LangChain / LangGraph / Agent。我们从"大模型 API 怎么调"讲起,一步步搭到"多 Agent 协作"。看到不懂的名词,先记住,后面几天一定会展开。
01

分层架构总图(动起来看)

整个框架分成 5 层。下图里那颗发光的小球,就是一次真实请求「从上往下穿过每一层」的过程——你现在不用懂细节,只要建立"分层"这个直觉:越往下越通用、越稳定;越往上越贴业务、越常改

L4 · 工具生态层 · skills/
IDE 一句话 SOP在 Cursor / Claude Code 里说人话触发
agent-onboarding加新 agent 指路
release-gate / cost-audit调 agent 出报告
L2.5 · 研发体验层 · gov-agents-portal/
Web 管理门户Next.js 控制台
脚手架 CLI / Wizard起新 agent 快 10×
L3 · 业务实现层 · apps/<agent>/
sre-rca故障根因
risk-reviewer上线风险
doc-checker文档检查
… 共 20+ 个只写 State/Prompt/DAG
L2 · 应用脚手架层 · packages/ai-trust-toolkit ⭐
Critic双层防幻觉
Failsafe失败闸门
Eval多维评测
Memory四层记忆
server/cli/mcp运行时
L1 · 框架 / Runtime 层 · langgraph(pip 依赖,本仓不改)
StateGraph状态图引擎
Node / Edge节点与连边
Reducer并行归约
Checkpointer断点续跑
一条铁律先记住:下层不许 import 上层(toolkit 永远不知道有哪些业务 agent),业务 agent 之间也不许互相 import——要复用就沉到 toolkit。这条约束贯穿全教程。
02

怎么用这份教程

⏱️

每天 30 分钟

一天一个独立页面,不贪多。看完做完页尾"今日小结 + 动手"再关。

👶

零基础友好

每个术语第一次出现都用大白话解释一遍,配图/动画帮你建立直觉。

📍

精确到行号

关键代码都标了 文件:行号,你可以边看边在真源码里跳转对照。

关于版本漂移:仓库文档里的数字(几个 agent、多少测试)随时间变,不同文件对不上很正常。以代码/配置为准,文档是快照——这是读任何真实项目都要有的心态。
W1

第 1 周 · 建立心智模型

不写代码也能懂:框架是什么、Agent 是什么、多 Agent 怎么协作
01

项目全景与分层架构

它到底是什么、解决什么痛点、5 层架构各管什么、仓库目录地图、技术栈一览。

≈30 min · 已就绪 NEW开始学 →
02

环境搭建 & 跑通第一个 Agent

uv workspace 是什么、一条命令装好全仓、配置 profile、本地把平台跑起来。

≈30 min开始学 →
03

LangGraph 零基础入门

State / Node / Edge / Reducer / Checkpointer 六大抽象,配 4 个能跑的 demo。

≈30 min开始学 →
04

Supervisor 模式与多 Agent 协作

中央调度 + handoff 交接,为什么官方不再推荐 supervisor-py、改用 tools 模式。

≈30 min开始学 →
05

一个 Agent 的标准解剖

state / builder / nodes / specialists / prompts / server 各是什么、图怎么流转。

≈30 min开始学 →
W2

第 2 周 · ai-trust-toolkit 可信底座

整个框架的灵魂:防幻觉、失败兜底、评测、记忆、成本治理
06

toolkit 总览 & 渐进抽象哲学

10 个模块速记、"何时该抽象"的方法论、公共 API 全貌。

≈30 min开始学 →
07

Critic 双层防幻觉

L1 规则闸拦 80% 显式错 + L2 LLM Judge 评语义,PASS/FAIL/触顶三态路由。

≈30 min开始学 →
08

失败闸门 Failsafe(5+2 道)

软闸门 + budget/sensitivity 硬闸门,reporter 前必走的流水线。

≈30 min开始学 →
09

四层 Memory Protocol

Working / Episodic / Semantic / Procedural,pgvector + Embedder 协议解耦。

≈30 min开始学 →
10

多维评测 Eval + CI 阻断

golden set 5 维打分、在线评测、回归检测,PR 不达标自动拦。

≈30 min开始学 →
W3

第 3 周 · 运行时与实战精读

把 Agent 跑起来、暴露成 API/MCP、逐文件精读旗舰 Agent
11

安全工具 & LLM 注入 & FakeLLM

@safe_tool_result、get_llm/set_llm_factory 厂商无关、0 外网测试基础设施。

≈30 min开始学 →
12

gov-agents-server 运行时

一个镜像 + ENABLED_AGENTS 跑任意组合、v1 API 工厂、统一 envelope。

≈30 min开始学 →
13

CLI 与 MCP 接入 IDE

agentctl 命令行、把 agent 暴露成 MCP tool 让 IDE 直接调。

≈30 min开始学 →
14

精读旗舰 Agent:sre-rca

逐文件读一个真实故障根因 Agent,triage→rag→critic→synthesizer 全流程。

≈30 min开始学 →
15

Agent 全家福 + 元 Agent

20+ 个 agent 各干什么、agent-creator / spec-author 如何"用 Agent 造 Agent"。

≈30 min开始学 →
W4

第 4 周 · 平台化、部署与收官

门户、配置、部署、CI、从零起新 agent、规格驱动开发
16

Web 管理门户 portal

Next.js 控制台各页面:agents / gates / cost / eval / replay,前后端怎么连。

≈30 min开始学 →
17

配置 / Docker / 部署

profile 深合并、多阶段 Dockerfile、docker-compose、K8s Kustomize。

≈30 min开始学 →
18

CI 流水线与治理闸门

7 个 stage、BOM 审计、eval 回归、成本红线、金丝雀发布。

≈30 min开始学 →
19

从零开发一个新 Agent(实操)

跟 cookbook 一步步 scaffold、写 builder、加评测样本、跑通、接入 registry。

≈30 min开始学 →
20

OpenSpec 规格驱动 & 收官串讲

propose/apply/archive 三段流、平台"自我开发"闭环、全框架回顾与学习路线。

≈30 min开始学 →

番外篇 · 实战

Day 19 的深化:把 standalone-repo-agent skill 展开成可照抄跑通的完整路径

独立仓 Agent 开发手把手 9 步

没有 monorepo 权限,如何在自己 git 仓从零起一个用平台可信底座的本地 agent:下模板 → Nexus 凭据 → 跑通 → 写业务图 → telemetry → CLI/MCP/pod 形态 → 测 → 安全自检 → obelisk 上线。含 9 步时间线动画 + 三大坑点。

≈35 min · 实战 NEW开始学 →
AB

业务方构建 Agent · 5 天接入教程

业务工程师视角完整路径:Skill vs Agent 选型 → 独立仓 / Monorepo 双路径 → 业务图开发 → 评测 FakeLLM → 安全 7 问 → canary 上线与 Portal KPI。与源码 21 天互补。

≈2.5 h · 接入 NEW开始学 →

📅 Day 01 已就绪,其余每天陆续上线。建议按顺序学,前一天是后一天的地基。准备好了就从 Day 01 · 项目全景 开始吧。