Certificación de Seguridad
El OWASP Top 10 for Agentic Applications (2026) define los riesgos de seguridad más críticos para los sistemas de agentes de IA. Así es como VeriSwarm se corresponde con cada uno. Para profundizar en los dos riesgos principales, consulta cómo VeriSwarm aborda la detección de inyección de prompts y el envenenamiento de herramientas MCP.
El contenido no confiable ingerido (documentos, páginas web, correo electrónico, respuestas de herramientas) redirige los objetivos del agente mientras este cree que sigue sirviendo al usuario — inyección de prompts agéntica en la capa de planificación.
Los agentes invocan herramientas legítimas de forma dañina — parámetros incorrectos, encadenamiento inseguro de herramientas, reenvío de salida no validada a una API más potente — o son manipulados mediante metadatos de herramientas envenenados.
Credenciales excesivas, compartidas, de larga duración o heredadas permiten la reutilización de credenciales, la escalada de privilegios y la suplantación del agente.
Compromiso a través de frameworks, proveedores de modelos, integraciones de herramientas, servidores MCP o registros — envenenamiento de paquetes, CVEs de MCP — algunos descubiertos solo en tiempo de ejecución.
El lenguaje natural se convierte en código o comandos de shell en ejecución fuera de los límites previstos — el muro entre instrucción y ejecución se derrumba, permitiendo un escape de sandbox o RCE en el host o en sistemas posteriores.
VeriSwarm restringe el acceso a herramientas de ejecución de código y escanea en busca de inyección de comandos, pero no aísla en un sandbox la ejecución del runtime del agente; despliega runtimes de ejecución aislados/efímeros para una cobertura completa de ASI05.
Los adversarios introducen información falsa o maliciosa en el contexto de la sesión, los índices de recuperación o la memoria persistente, moldeando el comportamiento del agente en sesiones y usuarios futuros.
VeriSwarm verifica las decisiones críticas y registra la procedencia, pero no gestiona el almacén de memoria del agente; valida las escrituras en memoria y audita la memoria persistente en tu runtime de agentes.
La mensajería entre agentes carece de autenticación, integridad o verificación de origen, lo que permite la suplantación, la manipulación, la repetición o el registro de pares falsos — un agente comprometido gira a través de toda la red.
Una mala decisión, una alucinación o un compromiso se propaga a través de agentes y flujos de trabajo conectados más rápido de lo que los humanos pueden detectar — la salida de un agente se convierte en la entrada de confianza de otro.
El humano está en el circuito y sí aprueba, pero el agente lo manipula para que lo haga — resúmenes fluidos y confiados que ocultan la operación real subyacente, o persuasión para extraer credenciales o datos. Los registros muestran una aprobación humana válida mientras que lo mostrado no coincide con lo que se ejecutó.
VeriSwarm proporciona divulgación del estado de IA y del responsable (preparación para el Artículo 50), atribución de confianza y escaneo de personas engañosas; no controla la interfaz del agente para hacer cumplir la integridad de la visualización operación-en-bruto-frente-a-resumen.
El propio agente se convierte en una amenaza interna — pérdida de contención de políticas por parte de un actor ya dentro del perímetro de confianza, por fallo de diseño, deriva a lo largo del tiempo o compromiso. Persigue silenciosamente objetivos no autorizados y puede persistir a través de sesiones mientras la actividad superficial parece normal.
El endpoint /v1/compliance/owasp-attestation devuelve un informe por tenant con tu estado de cobertura específico, el recuento de evidencias y recomendaciones de mejora.