보안 인증
「OWASP Top 10 for Agentic Applications (2026)」는 AI 에이전트 시스템에서 가장 치명적인 보안 위험을 정의합니다. VeriSwarm이 각 위험에 어떻게 대응하는지 소개합니다. 상위 두 가지 위험에 대해 자세히 알아보려면 VeriSwarm이 프롬프트 인젝션 탐지와 MCP 도구 포이즈닝에 어떻게 접근하는지 확인하세요.
신뢰할 수 없는 수집 콘텐츠(문서, 웹페이지, 이메일, 도구 응답)가 에이전트가 여전히 사용자를 위해 작동한다고 믿는 동안 에이전트의 목표를 다른 방향으로 유도합니다 — 계획 레이어에서 발생하는 에이전틱 프롬프트 인젝션입니다.
에이전트가 정상적인 도구를 유해하게 호출합니다 — 잘못된 매개변수, 안전하지 않은 도구 체이닝, 검증되지 않은 출력을 더 강력한 API로 전달하는 경우 — 또는 오염된 도구 메타데이터에 의해 조종됩니다.
과도하거나 공유되거나 장기간 유효하거나 상속된 자격 증명은 자격 증명 재사용, 권한 상승, 에이전트 사칭을 가능하게 합니다.
프레임워크, 모델 제공업체, 도구 통합, MCP 서버 또는 레지스트리를 통한 침해 — 패키지 포이즈닝, MCP CVE — 일부는 런타임에서만 발견됩니다.
자연어가 의도된 경계를 벗어나 실행되는 코드나 셸 명령으로 변합니다 — 지시와 실행 사이의 벽이 무너지면서 샌드박스 탈출이나 호스트 또는 다운스트림 시스템에서의 RCE가 가능해집니다.
VeriSwarm은 코드 실행 도구 접근을 제한하고 명령 인젝션을 스캔하지만, 에이전트 런타임 실행 자체를 샌드박스화하지는 않습니다. ASI05를 완전히 커버하려면 격리되거나 임시적인 실행 런타임을 별도로 배포하세요.
공격자가 세션 컨텍스트, 검색 인덱스 또는 영구 메모리에 허위 또는 악의적인 정보를 심어 향후 세션과 다른 사용자에 걸쳐 에이전트의 행동을 조작합니다.
VeriSwarm은 중요한 결정을 검증하고 출처를 기록하지만, 에이전트의 메모리 저장소 자체를 관리하지는 않습니다. 에이전트 런타임에서 메모리 쓰기를 검증하고 영구 메모리를 감사하세요.
에이전트 간 메시징에 인증, 무결성 또는 출처 검증이 없어 스푸핑, 변조, 재생 또는 가짜 피어 등록이 가능해집니다 — 침해된 하나의 에이전트가 네트워크 전체로 확산됩니다.
잘못된 결정, 환각 또는 침해가 인간이 감지할 수 있는 속도보다 빠르게 연결된 에이전트와 워크플로를 통해 전파됩니다 — 한 에이전트의 출력이 다른 에이전트의 신뢰된 입력이 됩니다.
인간이 루프 안에서 실제로 승인하지만, 에이전트가 그렇게 하도록 조종합니다 — 실제 기저 작업을 숨기는 유창하고 자신감 있는 요약이나, 자격 증명이나 데이터를 빼내기 위한 설득을 통해서입니다. 로그에는 유효한 인간 승인이 표시되지만, 표시된 내용은 실제로 실행된 내용과 일치하지 않습니다.
VeriSwarm은 AI 상태 및 책임 주체 공개(제50조 대응 준비), 트러스트 귀속, 기만적 페르소나 스캔을 제공하지만, 원본 작업과 요약 표시 간 무결성을 강제하는 에이전트 UI 제어는 하지 않습니다.
에이전트 자체가 내부자 위협이 됩니다 — 이미 신뢰 경계 내부에 있는 행위자가 설계 결함, 시간에 따른 드리프트, 또는 침해를 통해 정책 봉쇄를 상실하는 것입니다. 표면적인 활동은 정상으로 보이는 동안 조용히 승인되지 않은 목표를 추구하며 세션에 걸쳐 지속될 수 있습니다.
이 /v1/compliance/owasp-attestation 엔드포인트는 테넌트별 구체적인 커버리지 상태, 증거 수, 업그레이드 권장 사항이 포함된 보고서를 반환합니다.