신원은 에이전트가 누구인지를 말해준다. 신뢰 계층은 지금 이 행동을 허용할지 여부를 말해준다 — 배포 시 부여된 권한이 아니라 실시간 행동을 기반으로, 모든 에이전트 행동을 allow, review, deny 중 하나로 해결한다. 이는 당신의 에이전트와 그들이 할 수 있는 일 사이에 있는 결정 계층이며, 순전히 신원에만 기반한 스택에는 없는 조각이다.
이AI 에이전트를 위한 신뢰 계층은 에이전트가 시도하는 모든 행동을, 배포 시 한 번이 아니라 요청 시점에 평가하여 실시간 결정 — allow, review, deny — 으로 해결하는 인프라다. 이는 에이전트와 그것이 도달하려는 대상 — 도구 호출, 데이터 접근, 다운스트림 API — 사이에 위치하여, 결정이 에이전트가 시작할 때의 정적인 권한 부여가 아니라 실제로 해온 행동을 반영하도록 한다.
이 둘은 끊임없이 혼동되며, 그 사이의 간극이 바로 사고가 발생하는 지점이다. 신원은 정적이다 — 자격 증명, 검증된 소유자, 에이전트가 할 수 있어야 하는 일을 선언하는 서명된 매니페스트. 이 중 어느 것도 에이전트가 한 시간 전에 한 일에 따라 바뀌지 않는다. 신뢰 계층은 동적이다 — 이 에이전트가 누구이고 어떻게 행동해 왔는지를 고려할 때, 이 특정 행동이 지금 진행되어야 하는가를 묻는다. 완벽하게 유효하고 검증된 신원을 가진 에이전트라도 여전히 사고 도중일 수 있다 — 데이터를 유출하거나 평소 패턴을 벗어난 무언가를 시도하는 중일 수 있다 — 그리고 신원만으로는 이를 포착할 메커니즘이 없다. 신뢰 계층은 있다. 자격 증명을 한 번 확인하는 대신 행동을 지속적으로 평가하기 때문이다.
전통적인 IAM이 왜 신원에서 멈추고 이 간극을 열어두는지에 대한 더 자세한 논의는 AI 에이전트를 위한 신원 대 신뢰.
allow와 deny만 아는 신뢰 계층은 모든 결정을 두 극단 중 하나로 몰아넣는다 — 대체로 괜찮은 에이전트를 과도하게 차단하거나, 완전한 거부가 너무 공격적으로 느껴져서 진짜로 위험한 것을 통과시키거나. 세 번째 결과인 review는 이 모델을 프로덕션에서 실용적으로 만드는 것이다 — 자동화된 시스템이 한쪽을 선택하도록 강요하는 대신, 사람이 살펴볼 수 있도록 행동을 일시 중지한다. VeriSwarm의 결정 엔진은 이 결과를, 신원 신뢰도, 리스크, 신뢰성, 자율성, 캘리브레이션이라는 다섯 가지 차원에 걸친 에이전트의 실시간 점수와, 그 시점에 유효한 킬 스위치 또는 위임 재정의로부터 도출하여, 요청마다 정확히 하나의 결정을 반환한다: allow, review 또는 deny다. 그 점수가 어떻게 계산되는지에 대한 전체 메커니즘은 에이전트 신뢰 점수 산정: 기술 가이드.
VeriSwarm은 이 계층 옆이 아니라 이 계층을 중심으로 구축되어 있다. Gate는 결정 엔진 그 자체 — 항상 켜져 있고 무료 등급이며, 다른 모든 기둥이 연결되는 조각이다. 플랫폼의 나머지 부분은 신뢰 계층에 더 나은 입력을 공급하거나 그 출력에 따라 작동한다:
신뢰 계층 그 자체. 다섯 가지 차원에 걸쳐 에이전트 행동을 점수화하고 모든 요청을 allow, review, deny 중 하나로 해결한다. 무료 등급, 항상 켜져 있음.
신뢰 계층에 더 강력한 신원 입력 — 소유권 검증, 서명된 매니페스트, 범위가 지정된 위임 — 을 공급하여 결정이 익명의 에이전트가 아니라 알려진 에이전트에서 시작되도록 한다.
신뢰 계층이 다루는 지점에서 통제를 시행한다 — 도구 권한, PII 토큰화, 인젝션 스캐닝, 그리고 결정을 완전히 뒤집는 킬 스위치.
모든 결정과 모든 시행 조치를 해시 체인 원장에 기록한다 — 특정 요청이 왜 허용, 검토, 또는 거부되었는지에 대한 증거 흔적이다.
Cortex는 신뢰 계층의 가드레일을 인라인으로 적용하며 LLM 호출을 라우팅하고 실행한다. Fleet는 에이전트 라이프사이클을 관리하여 킬되거나 일시 중지된 에이전트의 상태가 어디서나 일관되도록 한다.
YAML 기반 자동화는 각 단계에서 동일한 결정 계층을 호출하므로, 다단계 에이전틱 프로세스도 단일 도구 호출과 동일한 allow/review/deny 검사를 받는다.
결정 계층은 유료 부가 기능이 아니라 무료 기반이다. Gate는 완전한 5차원 신뢰 점수 산정, 하루 5,000건의 allow/review/deny 검사, 무제한 이벤트 수집, 그리고 무제한 기본 자격 증명 발급을 무료로 제공한다. 요금제에 따라 제한되는 것은 그 결정을 둘러싼 깊이와 시행이다 — Pro에서 더 완전한 Passport 신원, Max에서 Guard의 런타임 시행과 Vault의 내보내기 가능한 원장. 신뢰 계층이 필요한지 평가 중인 팀은 아무것도 지출하기 전에 모든 에이전트 행동에 실제 결정을 연결할 수 있다. 신뢰 계층이 전체 6가지 보안 통제 체크리스트에 어떻게 들어맞는지 보기.
신뢰 계층은 AI 에이전트가 시도하는 모든 행동을, 배포 시 한 번이 아니라 요청 시점에 평가하여 실시간 결정 — allow, review, deny — 으로 해결하는 인프라다. 이는 에이전트와 그것이 도달하려는 도구, 데이터, 행동 사이에 위치하여, 결정이 처음 설정될 때 부여된 권한뿐 아니라 에이전트가 실제로 해온 행동을 반영하도록 한다.
신원은 정적인 질문에 답한다 — 이 에이전트는 누구이며, 이를 증명할 수 있는가? 신뢰 계층은 동적인 질문에 답한다 — 이 에이전트가 누구이고 어떻게 행동해 왔는지를 고려할 때, 이 특정 행동이 지금 허용되어야 하는가? 에이전트는 완벽한 신원 — 유효한 서명된 자격 증명, 검증된 소유자 — 을 가지고 있으면서도 여전히 사고 도중일 수 있으며, 데이터를 유출하거나 평소 패턴을 벗어난 무언가를 시도할 수 있다. 신원만으로는 이를 표현할 방법이 없다. 신뢰 계층은 있다. 자격 증명을 한 번 확인하는 대신 행동을 지속적으로 평가하기 때문이다.
Gate는 VeriSwarm의 결정 계층 구현체 — 다섯 가지 차원에 걸쳐 에이전트 행동을 점수화하고 모든 요청을 allow, review, deny 중 하나로 해결하는, 항상 켜져 있는 무료 등급 기반 — 이다. 이는 운영상 중요한 의미에서 신뢰 계층이다 — 모든 VeriSwarm 결정 검사가 이를 통과한다. 더 넓은 플랫폼 — Guard의 시행, Passport의 신원, Vault의 감사 추적, Cortex의 실행 제어 — 은 그 동일한 결정 계층에 공급하거나 그 위에 올라타는 기둥들이지, 그것과 경쟁하는 별개의 신뢰 계층이 아니다.
VeriSwarm의 결정 검사를 호출하는 모든 행동이 통과한다 — 그것이 핵심이다. 누군가 이미 위험하다고 표시한 행동만 평가하는 신뢰 계층은 아무것도 해결하지 못한다 — 그것은 이미 사람이 내린 판단을 확인하는 것에 불과하다. 가치는 아무도 표시하지 않은 행동을 포착하는 데 있다 — 몇 달 동안 신뢰할 수 있었던 에이전트가 평소 패턴에서 표준편차 하나만큼 벗어난 무언가를 시도하는 경우다. 이는 표본화된 일부가 아니라 모든 요청이 동일한 검사를 거칠 때만 드러난다.
둘이 아닌 세 가지 결과 — allow, review, deny. 이진 allow/deny는 과도한 차단(대체로 괜찮은 에이전트가 완전히 정지됨)과 부족한 차단(완전한 거부가 너무 공격적으로 느껴져서 진짜로 위험한 행동이 통과됨) 사이의 선택을 강요한다. review는 세 번째 옵션이다 — 두 극단 중 하나로 가는 대신, 사람이 살펴볼 수 있도록 행동이 일시 중지된다. VeriSwarm의 결정 엔진은 신원, 리스크, 신뢰성, 자율성, 캘리브레이션에 걸친 에이전트의 실시간 점수와, 유효한 킬 스위치 또는 위임 재정의로부터 결과를 도출한 다음, 요청마다 단일 결정을 반환한다.
결정 계층 자체 — Gate — 는 무료다. 완전한 5차원 신뢰 점수 산정, 하루 5,000건의 allow/review/deny 검사, 무제한 이벤트 수집, 그리고 무제한 기본 자격 증명 발급. 그것이 다른 모든 기둥이 구축되는 항상 켜져 있는 기반이다. 요금제에 따라 제한되는 것은 그것을 둘러싼 시행과 깊이다 — Max에서의 Guard 런타임 통제(도구 권한, PII 토큰화, 인젝션 스캐닝, 킬 스위치), Pro에서의 더 완전한 Passport 신원(매니페스트, 위임), Max에서의 Vault의 조회 가능하고 내보내기 가능한 감사 원장, 그리고 Pro와 Max에 나뉜 Cortex의 LLM 라우팅과 실행 제어. 첫날부터 모든 요청에서 실제 결정을 얻는다. 유료 요금제는 그 결정을 둘러싼 것들을 추가한다.
Gate의 신뢰 점수 산정과 allow/review/deny 결정은 무료다 — 하루 최대 5,000건의 검사, 무제한 이벤트 수집, 무제한 기본 자격 증명.