打开后 Ctrl/Cmd+P → 另存为 PDF、横向、开启背景图形,即得提交用 PDF。已含官方要求的架构 / AgentTeams 能力映射 / Skill / 上下文·可观测·评估 / 安全边界与风控 / 开源计划。
手册红线:只交 PPT 无可验证材料会严重扣分。仓库 CI 常绿,一键自证:python -m guardteam bench / python examples/guardteam_demo.py。
四个 Skill 的输入输出 / 调用条件 / 失败处理 / 安全边界 / 复用价值 / 与协同流程关系;含 RAG「4 选 2」覆盖说明。
| 手册要求 | 我们 |
|---|---|
| ≥3 个不同职能 Agent 闭环 | ✓ 4 个:信号聚合→风险定位→处置→合规审计 |
| AgentTeams 为设计基点 + 能力映射 | ✓ 角色编排/任务拆解/上下文传递/状态追踪均映射 |
| Skill 必选(输入输出/失败/安全/复用) | ✓ 4 个 Skill,经 MCP 接入,清单齐全 |
| RAG 上下文「4 选 2」 | ✓ 共享状态管理 + 轨迹可观测 |
| 可观测(Trace/Log/Metrics) | ✓ transcript + 结构化审计日志 + 哈希链账本 |
| 高风险动作:审批/回滚/审计 | ✓ 三态 + 人在回路 + 防篡改签名回执 |
| 评估集 | ✓ SentinelBench(97)+CommerceBench(10) |
| 开源合规(协议/依赖/IP) | ✓ Apache-2.0 · 运行时零依赖 · IP 自研 |
| 评分权重 25/25/25/20/5 | ✓ 逐维度命中,安全可审计 20% 为强项 |
186080014742【项目名称】Sentinel GuardTeam — 支付/理赔风控多智能体自主闭环 【问题场景】风控理赔已由多 Agent 接管;Agent 能动钱后,一张投毒工单即可操纵它越权放款(LLM 作用域越权)。现有框架只管"协同",不管"动作可信"。 【核心方案】基于 AgentTeams 编排四个 Agent 成闭环:①信号聚合(注入检测+打污点)→②风险定位(来源追踪+黑名单/频次/金额筛查)→③处置(放款/复核/拒绝)→④合规审计(结算前强制校验+签名回执)。三态:通过/拦截/暂缓复核。 【创新】「LLM 提议,Sentinel 裁决」:分析 Agent 可 LLM 驱动,但每笔放款强制确定性执行——越权/超预算/参数溯源到污点即熔断。是唯一自身不会被注入劫持乱付款的风控系统,直吃"安全可审计"。 【开放复用】四个 Skill(注入检测/溯源/授权校验/签名回执)经 MCP 接入、可跨 Team 复用;Apache-2.0,SentinelBench+CommerceBench 开放可复现。 【进展】闭环、四 Skill、CLI、防篡改审计账本、合规报告已实现;80 测试全绿,真 MCP 客户端验证,已容器化;复赛部署 AgentTeams。