Open Agent Trust Specification
为 AI 智能体生态系统中的信任提供一种通用语言。OATS 定义了平台如何评估行为、签发可移植凭证以及共享声誉——适用于任何提供商、任何框架、任何云环境。
OATS 定义的内容
信任评分模式
五个维度——身份、风险、可靠性、自主性、校准——结合置信度值和标准评分档案。具有确定性、可解释性和可复现性。
事件分类体系
24 种标准化事件类型,为评分提供依据。任务完成、工具调用、安全事件、审核操作、置信度与结果配对。只需映射一次智能体活动,即可在任何地方进行评分。
可移植凭证
携带信任声明的 ES256 签名 JWT。任何平台无需账户或 API 密钥即可验证智能体的信任状态。基于 JWKS 的密钥分发。
声誉信号
保护隐私的行为报告。经过哈希处理的身份、汇总评分、自愿参与。每加入一个平台,网络就会变得更智能。
三个合规级别
级别 1:信任评分。级别 2:可移植凭证。级别 3:声誉网络。可根据需要实施尽可能多或尽可能少的内容。
采用 CC-BY-4.0 许可
该规范是开放的。任何人都可以实施 OATS。该标准属于整个生态系统,而非任何单一供应商。
为什么需要开放标准?
1
身份提供商并不处理信任问题
知道一个智能体是谁,并不能告诉你它是否安全。身份提供商验证凭证,OATS 评估行为。二者相辅相成。
2
信任应当是可移植的
在一个平台上建立信任的智能体,不应在另一个平台上从零开始。OATS 凭证会随智能体一起移动——任何人、在任何地方都可以验证。
3
声誉需要一个网络
单一平台对智能体的了解是有限的。OATS 支持跨提供商的声誉共享,使恶意行为者无法在未被发现的情况下在各平台间流窜。
实施 OATS
VeriSwarm 是参考实现——涵盖全部三个合规级别、开源评分引擎,并提供 Python 和 Node.js 版 SDK。