作者:CatalpaLog
版权声明:© CatalpaLog,保留所有权利,未经授权禁止传播与商用。
AgentOps 低代码平台是一套面向企业内部 AI Agent 的全生命周期生产与治理中台。平台围绕企业从“AI Demo”走向“可控上线”的核心问题,提供 Agent 创建、低代码编排、调试沙箱、评测门禁、审批发布、灰度放量、运行观测、Bad Case 回流、成本治理、SLA 管理、权限安全与持续运营能力。
本项目以“销售政策助手 Agent”为主业务案例,模拟企业销售人员在 CRM、员工门户或企业 IM 中咨询折扣政策、客户等级、合同条款、审批规则和区域政策差异时,Agent 如何完成身份识别、权限裁剪、RAG 检索、CRM/OA 工具调用、风险判定、引用校验、输出拦截、Trace 留痕与线上问题回归。
项目目标不是展示一个单点聊天机器人,而是展示一套企业级 AI Agent 从需求立项到生产运行的可治理供应链。
| 维度 | 说明 |
|---|---|
| 产品类型 | 企业级 AI Agent 低代码生产与治理平台 |
| 核心场景 | 销售政策助手 Agent 的构建、发布、运行与治理 |
| 目标用户 | 平台管理员、业务负责人、Agent 建设者、知识管理员、安全审计员、终端员工 |
| 关键能力 | Agent 工厂、Agent 市场、编排画布、RAG 知识治理、模型网关、工具调用、评测门禁、Trace、Bad Case、SLA、成本、权限与风险治理 |
| 项目形态 | 可交互原型 + 运营看板 + 架构图谱 + PRD/规格/治理文档 + Excel 数据资产 + API Mock/状态机规格 |
| 交付目标 | 形成可展示、可评审、可拆解、可试点讨论的 AI 产品作品包 |
企业落地 AI Agent 时,真正的难点通常不在于“模型能不能回答”,而在于 Agent 能否稳定、可控、可复盘地进入真实业务系统。本项目聚焦以下问题:
- 各部门重复建设 Agent,Prompt、知识库、模型和工具链分散,无法复用模板和治理经验。
- Agent 上线前缺少评测门禁,P0 风险用例、越权访问、Prompt 注入、工具失败和旧知识引用无法被系统性阻断。
- 销售政策、区域规则、客户等级、合同条款存在有效期、密级、数据域和版本冲突,RAG 结果需要治理而不是简单召回。
- CRM、OA、ERP 等企业工具调用具有业务风险,不能让模型直接执行高风险动作。
- 模型调用、Embedding、工具调用和运维资源成本难归集,业务侧无法判断投入产出。
- 线上 Trace、Bad Case、用户反馈、回归测试和再发布没有形成闭环,问题容易反复出现。
场景立项
↓
模板创建
↓
知识库 / 工具 / 权限配置
↓
低代码流程编排
↓
调试沙箱运行
↓
自动化评测门禁
↓
业务 / 安全 / 平台审批
↓
10% → 30% → 50% → 全量灰度发布
↓
线上运行与 Trace 观测
↓
Bad Case 归因与知识补料
↓
回归测试
↓
再发布或退役
销售政策助手贯穿该闭环:从业务提问、RAG 检索、CRM/OA 工具调用,到高风险折扣人工确认,再到 Bad Case 入库与回归测试,形成完整的企业级 AgentOps 链路。
文件:index.html
首页是整个作品包的统一入口,提供动态原型、运营看板、架构图谱、文档、数据表和方案汇报的集中访问。当前版本已支持在首页选择下载不同文档与数据表。
文件:prototype/index.html
动态原型覆盖 AgentOps 的主要业务操作:
- 角色切换:平台管理员、业务负责人、知识管理员、安全审计员、终端员工。
- Agent 工厂:创建、复制、编辑、删除 Agent。
- Agent 编排:拖拽节点、运行调试、保存画布、提交审批。
- 发布中心:自动评测、人工审批、灰度放量、驳回整改。
- Trace 观测:记录 Prompt、RAG、工具调用、模型、延迟、成本、引用与风险。
- Bad Case 闭环:问题入库、根因归类、修复复测、回归集沉淀。
- 知识治理:知识库清单、RAG 检索测试、低置信拒答、补料队列。
- 模型网关:质量优先、成本均衡、成本优先路由与预算联动。
- 成本与 ROI:展示单次成本、预算使用率、ROI 敏感性分析。
- SLA 管理:按 L1/L2/L3 Agent 分级治理。
- 风险治理:越权拦截、敏感字段、Prompt 注入和高风险输出控制。
文件:dashboard/index.html
运营看板用于展示 AgentOps 从“功能可用”到“经营可量化”的能力,包含:
- 总览:在线 Agent、调用趋势、生命周期漏斗、部门采用率。
- 经营:营收、成本、净收益、投入 ROI、成本明细。
- 质量:准确率、幻觉率、问题解决率、SLA 达标率、Bad Case 分布。
- 风险:风险事件数、拦截次数、合规通过率、高危占比和近期风险事件。
当前看板已接入 assets/mock-api.js,并预留读取 Excel 数据资产的能力,支持从静态展示向数据驱动原型演进。
文件:diagrams/index.html
架构图谱中心用于展示产品、技术、数据、安全、运行时和部署视角,覆盖:
- 产品全景架构
- 技术架构图
- Agent 运行时架构
- 销售政策助手业务闭环
- RAG 知识治理架构
- 模型网关与成本治理
- 权限安全治理架构
- 发布评测治理闭环
- Agent 生命周期图
- 数据流图
- 数据模型 ER 图
- 部署架构图
- 菜单与权限矩阵
- 规格与 Mock 接入关系
- Excel 数据资产接入关系
- 前端原型运行关系
目录:docs/
| 文档 | 作用 |
|---|---|
AgentOps低代码平台_PRD.docx |
产品主文档,说明产品定位、业务目标、核心场景、模块边界和验收标准。 |
AgentOps低代码平台_产品需求文档_PRD简洁版.docx |
精简版 PRD,用于快速评审和作品集浏览。 |
AgentOps低代码平台_产品规格说明书.docx |
面向研发拆解,细化页面、字段、状态、接口、权限、错误码和数据模型。 |
AgentOps低代码平台_评测治理与落地说明.docx |
面向 AI 治理,细化评测集、发布门禁、灰度熔断、Bad Case 回归和风险策略。 |
目录:sheets/
| 数据表 | 作用 |
|---|---|
AgentOps低代码平台_数据表.xlsx |
汇总需求池、RICE、KPI、埋点、ROI、SLA、风险和数据模型。 |
AgentOps_销售政策助手评测集_100条.xlsx |
100 条销售政策助手评测样例,覆盖正常问答、低置信、越权、Prompt 注入、工具失败和回归验证。 |
AgentOps_实施对接清单.xlsx |
CRM、OA、SSO、知识库、IM、可观测与合规对接字段、接口人、环境、权限和验收负责人。 |
目录:specs/、assets/
| 文件 | 作用 |
|---|---|
specs/AgentOps_API_Mock_状态机.yaml |
定义 Agent 创建、调试、评测、发布、Trace、Bad Case、权限审批、工具调用等 Mock API 与状态机。 |
specs/API草案.yaml |
API 初版草案,用于说明接口方向。 |
specs/事件埋点规范.md |
定义首页、原型、看板、Trace、评测、风险、下载等事件口径。 |
specs/数据字典摘要.md |
定义 Agent、版本、Trace、评测、Bad Case、权限、成本、SLA 等核心对象。 |
specs/故障处理流程.md |
定义模型、知识库、工具、预算、下载、图表、Mock API 等故障兜底。 |
assets/mock-api.js |
前端本地 Mock 服务层,模拟 Agent、评测、发布、Trace、Bad Case、权限审批和工具调用。 |
assets/data-loader.js |
数据加载适配层预留文件,用于后续统一读取 Excel 与 YAML。 |
销售政策助手是本项目的 MVP 主案例,面向销售组织的高频政策咨询场景。
- “华东大区 A 类客户本季度最高可以申请几折?”
- “这个客户属于重点客户吗?是否能走特批?”
- “合同里能不能承诺返点?”
- “当前审批状态到哪一步了?”
- “区域活动政策和总部政策冲突时,以哪个为准?”
- 识别用户身份、部门、角色和数据域。
- 判断问题意图:折扣、合同、客户等级、审批状态、政策冲突。
- 从销售政策库中检索有效期内政策。
- 对召回结果进行权限裁剪、版本校验和引用校验。
- 必要时调用 CRM 查询客户等级,调用 OA 查询审批状态。
- 对底价、利润、客户隐私、合同承诺等高风险内容进行拦截或人工确认。
- 输出带引用、带风险提示、可追溯的答案。
- 全链路写入 Trace,异常问题进入 Bad Case 与回归集。
本项目的重点不只是“生成答案”,而是让 Agent 在企业内部可管理、可审计、可回滚、可量化。
| 治理方向 | 设计落点 |
|---|---|
| 质量治理 | 离线评测、P0/P1/P2 用例、幻觉率、引用准确率、工具成功率、回归测试。 |
| 发布治理 | 评测门禁、业务审批、安全审批、灰度放量、异常暂停、一键回滚。 |
| 知识治理 | 文档有效期、密级、版本、切片质量、召回阈值、过期知识拦截。 |
| 工具治理 | CRM/OA 只读调用、高风险动作人工确认、工具重试、熔断与审计。 |
| 权限治理 | RBAC + ABAC、数据域、字段脱敏、工具白名单、审计日志。 |
| 成本治理 | 模型预算、单次成本、部门归集、ROI 计算、预算超限降级。 |
| SLA 治理 | L1/L2/L3 分级、延迟、成功率、可用性、恢复时间和告警策略。 |
| 风险治理 | Prompt 注入、敏感信息泄露、越权访问、系统提示词泄露、高风险输出。 |
本项目当前采用静态前端作品包形态,便于作品集展示、面试演示和产品评审。整体技术结构如下:
index.html
├─ 统一项目入口
├─ 文档下载中心
├─ 数据表下载中心
└─ 原型 / 看板 / 架构跳转
prototype/index.html
├─ Agent 工厂
├─ 编排画布
├─ 调试与发布
├─ Trace 与 Bad Case
└─ 调用 assets/mock-api.js
dashboard/index.html
├─ 经营看板
├─ 质量看板
├─ 风险看板
└─ 调用 ECharts 与 Mock 指标
diagrams/index.html
├─ 架构视图导航
├─ SVG 预览
└─ 工程接入关系说明
assets/mock-api.js
├─ 本地内存状态机
├─ Agent / Release / Eval / Trace / Bad Case 模拟接口
└─ localStorage 状态保存
specs/AgentOps_API_Mock_状态机.yaml
├─ Mock API 契约
├─ 状态机
└─ 错误码 / 数据结构
- 打开
index.html。 - 查看项目定位、核心能力和主业务闭环。
- 进入
diagrams/index.html查看产品架构与运行时架构。 - 下载 PRD 或产品规格说明书。
- 打开
docs/AgentOps低代码平台_PRD.docx,理解产品定位与业务目标。 - 打开
prototype/index.html,按“销售政策助手”主案例运行调试。 - 在“发布中心”查看评测门禁、审批、灰度和回滚流程。
- 在“Trace 观测”和“Bad Case 闭环”查看线上治理链路。
- 打开
dashboard/index.html,查看 ROI、质量、成本和风险指标。
- 阅读
docs/AgentOps低代码平台_产品规格说明书.docx。 - 查看
specs/AgentOps_API_Mock_状态机.yaml。 - 查看
specs/数据字典摘要.md。 - 查看
sheets/AgentOps_实施对接清单.xlsx。 - 结合
assets/mock-api.js理解前端状态机和 Mock 接口。
- 阅读
docs/AgentOps低代码平台_评测治理与落地说明.docx。 - 查看
sheets/AgentOps_销售政策助手评测集_100条.xlsx。 - 查看
specs/事件埋点规范.md。 - 查看
specs/故障处理流程.md。 - 在原型中触发调试、评测、发布、Bad Case 修复和风险拦截。
使用 VS Code Live Server 或任意本地静态服务器打开项目根目录。
# 可选方式一:使用 Python 启动本地服务
python -m http.server 8080
# 浏览器访问
http://localhost:8080/index.html推荐使用本地服务的原因是:部分浏览器在 file:// 模式下会限制 fetch() 读取本地 YAML、Excel、SVG 或 JS 资源,可能导致 Mock API、图表或下载状态无法正常展示。
| 入口 | 说明 |
|---|---|
index.html |
项目首页、下载中心、作品总入口。 |
prototype/index.html |
动态交互原型,展示 AgentOps 全生命周期业务流程。 |
dashboard/index.html |
企业运营看板,展示质量、成本、ROI、风险与 SLA。 |
diagrams/index.html |
架构图谱中心,展示产品、技术、运行时、治理和部署架构。 |
- 不是单点问答,而是生产治理中台:覆盖 Agent 创建、调试、评测、审批、灰度、运行、观测、回归和退役。
- 主案例清晰:以销售政策助手贯穿业务、RAG、工具、权限、评测和运营指标。
- 产品与工程结合:不仅有 PRD,还包括产品规格、API Mock、数据字典、埋点、故障流程和 Excel 数据资产。
- AI 治理意识完整:覆盖 Prompt 注入、越权访问、敏感信息泄露、旧知识引用、工具失败和预算超限。
- 经营价值可量化:通过 ROI、部门采用率、单次成本、预算使用率和 Bad Case 闭环率体现 AI 投入产出。
- 适合真实评审语境:产品、研发、算法、测试、安全、运维和业务负责人都能在项目包中找到对应材料。
当前项目为前端静态作品包,重点在产品方案、交互原型、数据结构、Mock 状态机和治理闭环展示。当前版本不包含真实后端服务、真实企业账号体系、真实 CRM/OA 生产接口、真实向量数据库和真实模型调用。相关能力已在规格文档、API Mock、实施对接清单和架构图中给出设计边界,可作为后续工程化开发依据。
AgentOps低代码平台/
├── index.html # 项目首页与下载中心
├── README.md # 项目说明书
├── assets/
│ ├── mock-api.js # 本地 Mock API 与状态机
│ ├── data-loader.js # 数据加载适配层预留
│ └── xlsx_dashboard_preview.png # 数据看板预览图
├── prototype/
│ └── index.html # 动态交互原型
├── dashboard/
│ └── index.html # 企业运营看板
├── diagrams/
│ ├── index.html # 架构图谱中心
│ └── *.svg # 产品、技术、数据、安全、部署架构图
├── docs/
│ ├── AgentOps低代码平台_PRD.docx
│ ├── AgentOps低代码平台_产品需求文档_PRD简洁版.docx
│ ├── AgentOps低代码平台_产品规格说明书.docx
│ └── AgentOps低代码平台_评测治理与落地说明.docx
├── sheets/
│ ├── AgentOps低代码平台_数据表.xlsx
│ ├── AgentOps_销售政策助手评测集_100条.xlsx
│ └── AgentOps_实施对接清单.xlsx
├── specs/
│ ├── AgentOps_API_Mock_状态机.yaml
│ ├── API草案.yaml
│ ├── 事件埋点规范.md
│ ├── 数据字典摘要.md
│ └── 故障处理流程.md
└── slides/
└── AgentOps低代码平台_方案汇报.pptx
| 场景 | 建议展示内容 |
|---|---|
| AI 产品经理作品集 | 首页、PRD、动态原型、运营看板、架构图谱。 |
| 产品面试 | 产品定位、销售政策助手主案例、评测门禁、Trace、Bad Case、ROI。 |
| 研发评审 | 产品规格说明书、API Mock、数据字典、状态机、实施对接清单。 |
| 安全评审 | 权限治理、风险治理、Prompt 注入拦截、敏感字段脱敏、审计日志。 |
| 业务评审 | 销售政策助手场景、业务闭环、ROI、SLA、灰度发布和人工确认。 |
| 运营复盘 | 运营看板、Bad Case 闭环率、质量趋势、成本预算、部门采用率。 |
- 接入真实后端服务,将
assets/mock-api.js替换为标准 REST API。 - 将
AgentOps_API_Mock_状态机.yaml扩展为完整 OpenAPI 契约。 - 将 Excel 数据资产沉淀为数据库表和管理后台配置。
- 接入真实 SSO、CRM、OA、企业 IM 和知识库服务。
- 引入真实向量数据库、模型网关和可观测链路。
- 增加评测集管理、红队测试、Prompt 版本差异对比和自动回归流水线。
- 增加多租户、组织隔离、字段级权限、审计导出和私有化部署方案。
作者:CatalpaLog
© CatalpaLog,保留所有权利,未经授权禁止传播与商用。