GOAI 初赛提交总览

Sentinel GuardTeam · 新智基座 / Agent Infra · 方向四 金融风控与理赔自动化
初赛截止 8.16 团队 ≤3 人 Apache-2.0 80 测试全绿 核心检出 100% · 误报 0%

① 提交材料(逐项)

必交 · 就绪

作品简介(≤500 字,498 字)

官方六要素齐全,可直接复制。全文见下方"作品简介全文",或打开纯文本文件。

必交 · 就绪

方案 PPT / PDF(15 页)

打开后 Ctrl/Cmd+P → 另存为 PDF、横向、开启背景图形,即得提交用 PDF。已含官方要求的架构 / AgentTeams 能力映射 / Skill / 上下文·可观测·评估 / 安全边界与风控 / 开源计划。

该交(红线#3) · 就绪

可执行代码包

手册红线:只交 PPT 无可验证材料会严重扣分。仓库 CI 常绿,一键自证:python -m guardteam bench / python examples/guardteam_demo.py

② 手册必备清单(评委会查)

就绪

Agent Identity 清单(手册 8.2 / 附录 A)

4 个职能 Agent + Manager 的身份 / 能力边界 / 决策边界 / Trace。

就绪

Skill 清单(手册 9.1 / 附录 B)

四个 Skill 的输入输出 / 调用条件 / 失败处理 / 安全边界 / 复用价值 / 与协同流程关系;含 RAG「4 选 2」覆盖说明。

③ 在线 Demo(可验证)

在线

交互式多 Agent 控制台

点一个案件,看 4 个 Agent 对话,看欺诈被拦 / 高风险暂缓 / 正常放款三态。

④ 手册对照(逐项核验)

手册要求我们
≥3 个不同职能 Agent 闭环 4 个:信号聚合→风险定位→处置→合规审计
AgentTeams 为设计基点 + 能力映射 角色编排/任务拆解/上下文传递/状态追踪均映射
Skill 必选(输入输出/失败/安全/复用) 4 个 Skill,经 MCP 接入,清单齐全
RAG 上下文「4 选 2」 共享状态管理 + 轨迹可观测
可观测(Trace/Log/Metrics) transcript + 结构化审计日志 + 哈希链账本
高风险动作:审批/回滚/审计 三态 + 人在回路 + 防篡改签名回执
评估集 SentinelBench(97)+CommerceBench(10)
开源合规(协议/依赖/IP) Apache-2.0 · 运行时零依赖 · IP 自研
评分权重 25/25/25/20/5 逐维度命中,安全可审计 20% 为强项

⑤ 你要做的(只有你能做)

  1. goaihz.com「立即报名」→ 选 新智基座 → 建队(≤3 人,提交后不可改成员)
  2. 上传:作品简介 + PPT(PDF)+ 代码包(仓库链接)
  3. 进赛道钉钉答疑群:186080014742
完整操作单:HOW_TO_SUBMIT.md

作品简介全文(498 字 · 可复制)

【项目名称】Sentinel GuardTeam — 支付/理赔风控多智能体自主闭环

【问题场景】风控理赔已由多 Agent 接管;Agent 能动钱后,一张投毒工单即可操纵它越权放款(LLM 作用域越权)。现有框架只管"协同",不管"动作可信"。

【核心方案】基于 AgentTeams 编排四个 Agent 成闭环:①信号聚合(注入检测+打污点)→②风险定位(来源追踪+黑名单/频次/金额筛查)→③处置(放款/复核/拒绝)→④合规审计(结算前强制校验+签名回执)。三态:通过/拦截/暂缓复核。

【创新】「LLM 提议,Sentinel 裁决」:分析 Agent 可 LLM 驱动,但每笔放款强制确定性执行——越权/超预算/参数溯源到污点即熔断。是唯一自身不会被注入劫持乱付款的风控系统,直吃"安全可审计"。

【开放复用】四个 Skill(注入检测/溯源/授权校验/签名回执)经 MCP 接入、可跨 Team 复用;Apache-2.0,SentinelBench+CommerceBench 开放可复现。

【进展】闭环、四 Skill、CLI、防篡改审计账本、合规报告已实现;80 测试全绿,真 MCP 客户端验证,已容器化;复赛部署 AgentTeams。