AgentTeams:多个 AI 一起干活,怎么证明没人在撒谎

本象协议本身只回答"这份文件里有什么"。AgentTeams 是接在协议上的一层多智能体运行层:谁改的、谁看的、谁签的证,三个身份必须互不相同,且全程留痕可复核。下面四段都是实跑记录,标了实测日期——不是效果图。

01 · 在线不是"看起来在线"

四层同时通过,不是端口通了就算完成

健康检查同时看 WSL 常驻钉、Docker、三个容器状态、三个 HTTP 入口——任一层失败就判 unhealthy,不把"端口通"当成"服务好了"。

AgentTeams 四层在线健康检查实跑截图
3 个容器controller / manager / dashboard 均 running,restart=0
HTTP 200Matrix 46ms · Manager 17ms Dashboard 18ms
四层闸门任一层失败即 unhealthy 不把端口通当成任务完成
实测时间 2026-08-13。复核:node agentteams/runtime.mjs health
02 · 拒绝也要留痕,不只是通过的那条路

出版社教材审稿闭环:五步 trace,含两次故意拒批

执行者登记候选、考官在没有观察记录时提前发证被拒、观察者补上观察、正式发证、把用过的观察拿去重放又被拒——成功和拒绝都进同一条台账,拒绝分支全程学历零改动。

出版社真实教材审稿三身份 Trace 实跑截图
8 / 8登记、拒批、取象、发证 防重放、身份分离、零 token
拒批 2 次无观察拒批;旧观察重放拒批 两次都不改学历
三身份Executor / Sensor / Examiner 指纹分别落盘
实测时间 2026-08-13。复核:node agentteams/demo-publishing.mjs
03 · 真正的安全证据来自失败分支

身份闭环 12/12,反向闸门当前已扩容到 50/50(44 条故意造假)

绿灯不是只跑正例得到的:自证、冒名、重放观察、绕过考题都被专门设计的反向用例去撞,撞不过才算数。截图定格在扩容前的 33/33(29 条反向)那一版;套件在 2026-08-28 只增未减扩到了 50 条,口径以现在的仓库为准。

Tuwunel 三身份与发证分离闸门反向用例实跑截图
12 / 12三个 homeserver 签发身份 作者、取象、考官互不相同
50 / 50发证闸门全绿(现行) 其中 44 条反向用例故意造假
零改动自证与无观察被拒时 学历字节和考试次数不变
身份闭环实测 2026-08-13(截图口径 33/33);闸门数字为 2026-08-28 之后的仓库现状,未重新截图。证明强度上限:截图这轮用的是本进程起的 stub homeserver,只证明闸门逻辑成立,不证明身份已被外部锚定——那需要真 Tuwunel + 真 Worker 容器。复核:node agentteams/verify-agentteams.mjs
04 · 不是一个 Demo,是同一条闸门换了三次检查器

教材、CAD 图纸、小说续写,走的是同一个 certify.mjs

这张截图直接呼应本站案例墙——xlsx、CAD、textbook、story 四个方言在协议层各自独立,但接到 AgentTeams 之后,发证闸门、台账格式、三身份分离规则完全共用一份代码,换领域只换 recheck 指向哪个检查器。第四格 RFP 合规矩阵还没做,如实留空,不进演示。

教材、CAD 与小说跨领域同协议实跑截图
教材真实客户稿件 figure & table numbering audit
CADDXF 图纸 cross-reference integrity check
小说续写文本 series bible / continuity check
实测时间 2026-08-13,3/3 通过,跳过 0,失败 0。复核:node demo/agentteams-bridge/e2e-crossdomain.mjs

不能推出