Saltar al contenido principal

Adversarial Testing para LLMs
EU AI Act y OWASP Top 10 LLMs

Secvex ALT evalúa la robustez de tus modelos de lenguaje frente a ataques adversariales —evasión, puertas traseras, extracción de datos, inferencia de pertenencia, transferencia adversarial— y genera documentación técnica estructurada para el EU AI Act.

¿Qué es Secvex ALT?

Secvex ALT es un toolkit de adversarial testing on-premise y en cloud para sistemas de IA generativa de texto —chatbots, asistentes virtuales, copilotos de código y agentes de IA—. Evalúa su resistencia frente a ataques adversariales de evasión, puertas traseras, extracción de datos de entrenamiento e inferencia de pertenencia. Genera documentación técnica mapeada al Art. 15 del EU AI Act, las Guías 11 y 15 de AESIA, y OWASP Top 10 for LLM Applications 2025.

Alcance actual: exclusivamente sistemas de IA generativa de texto. No incluye clasificadores tabulares ni sistemas biométricos.

Familias de ataque evaluadas

Evasión adversarial

Prueba si el modelo puede ser manipulado para saltarse sus restricciones de seguridad o revelar instrucciones confidenciales del sistema.

Puertas traseras

Detecta comportamientos maliciosos ocultos en el modelo, insertados durante el entrenamiento y que solo se activan ante inputs específicos.

Extracción de datos de entrenamiento

Verifica si el modelo puede reproducir datos sensibles con los que fue entrenado, exponiendo información privada o confidencial.

Inferencia de pertenencia

Determina si un dato concreto formó parte del corpus de entrenamiento, con implicaciones directas para la privacidad y el RGPD.

Transferencia adversarial

Evalúa si existen inputs que modifican el comportamiento del modelo de forma sistemática y predecible, transferibles entre distintos contextos de uso.

Construye tus prompts

Configura tu propia evaluación desde la interfaz: selecciona las familias de ataque e introduce directamente los prompts que quieres testear. Incluye plantillas predefinidas para pruebas genéricas.

Familias de ataque y marcos de referencia

Secvex ALT cubre las categorías de vulnerabilidad adversarial que las Guías 11 y 15 de AESIA identifican como relevantes para el Art. 15 del EU AI Act, complementadas con el OWASP Top 10 for LLM Applications 2025.

Categoría (AESIA Guía 11) Familia de ataque en Secvex ALT Marco adicional
Puertas traseras y envenenamiento de modelo Puertas traseras OWASP LLM04
Ataques de evasión y transferencia adversarial Evasión adversarial OWASP LLM01
Ataques de evasión y transferencia adversarial Transferencia adversarial OWASP LLM01
Extracción de modelo y datos de entrenamiento Extracción de datos de entrenamiento OWASP LLM02
Inferencia de pertenencia y propiedades Inferencia de pertenencia OWASP LLM02
Fuga de instrucciones del sistema Evasión adversarial — sub-test fuga OWASP LLM07

Presets de Compliance Scan

No hace falta saber qué ataque corresponde a cada norma. Elige el preset según qué informe necesitas.

EU AI Act

Escaneo completo AI Act

Evalúa las categorías de vulnerabilidad adversarial identificadas en el Art. 15 del EU AI Act y las Guías 11 y 15 de AESIA. Genera documentación técnica de apoyo estructurada para el proceso de conformidad.

OWASP LLM

Escaneo OWASP Top 10

Mapea cada ataque al OWASP Top 10 for LLM Applications 2025. Ideal para equipos que necesitan acreditar adhesión al estándar de facto de seguridad en LLMs.

Cobertura total

Escaneo completo

Combina todas las familias de ataque disponibles. Máxima cobertura para organizaciones que deben demostrar cumplimiento simultáneo con múltiples marcos normativos.

Defensa configurable

Introduce tu propia capa de seguridad entre el usuario y el modelo —un filtro, un clasificador o un sistema de moderación— y mide su efectividad real frente a los ataques evaluados. Comprueba si tu defensa aguanta o puede ser evadida.

Disponible en los planes Pro y Business.

¿Por qué tu empresa necesita testing adversarial ahora?

En agosto de 2026 entran en plena vigencia las obligaciones del EU AI Act para sistemas de IA de alto riesgo (Anexo III). Las empresas que despliegan modelos de lenguaje en sectores críticos necesitan documentar la evaluación de robustez adversarial de sus sistemas como parte de los procesos de gestión de riesgos que el marco regulatorio contempla.

Agosto 2026 — Plena vigencia del EU AI Act para sistemas de IA de alto riesgo del Anexo III. Los deployers deben poder acreditar el proceso de evaluación adversarial ante las autoridades competentes.

Art. 9 — EU AI Act

Gestión de riesgos

Secvex ALT documenta el proceso de evaluación adversarial que el Art. 9 requiere registrar como parte del sistema de gestión de riesgos del sistema de IA.

Art. 15 — EU AI Act

Robustez y ciberseguridad

Secvex ALT evalúa las categorías de vulnerabilidad adversarial que el Art. 15 identifica: evasión, puertas traseras, extracción de datos de entrenamiento e inferencia de pertenencia.

Art. 26 — EU AI Act

Obligaciones del deployer

Secvex ALT genera la documentación técnica que el deployer puede aportar como evidencia de su proceso de diligencia debida en materia de robustez adversarial.

¿Tu sector ya está en el punto de mira regulatorio?

El EU AI Act prioriza los sectores con mayor impacto en los derechos fundamentales y la seguridad pública.

Infraestructura crítica OT

Sistemas de control industrial, redes de energía o agua con IA incorporada para supervisión o toma de decisiones. Operadores de infraestructura crítica sujetos a NIS2.

Fintech y banca

IA para scoring crediticio, detección de fraude o atención al cliente. DORA y el EU AI Act lo clasifican como sistema de alto riesgo del Anexo III.

RRHH y empleo

¿Tu empresa usa IA para filtrar candidatos o evaluar perfiles? El EU AI Act lo clasifica directamente como sistema de alto riesgo.

Salud

Apoyo diagnóstico, triaje automatizado o análisis de historial clínico con IA. Cualquier vulnerabilidad adversarial tiene implicaciones directas de seguridad para el paciente.

Administración pública

IA para gestión de prestaciones, análisis de solicitudes o evaluación de beneficiarios. Mismo régimen de multas que el sector privado, con responsabilidad política y reputacional añadida.

Seguros

Modelos de IA para evaluación de riesgos, suscripción de pólizas o gestión de siniestros. Clasificados como sistemas de alto riesgo del Anexo III cuando condicionan el acceso a servicios financieros.

Si tu organización despliega modelos de lenguaje en alguno de estos sectores, el marco regulatorio contempla requisitos de evaluación de robustez adversarial. La situación regulatoria de cada organización es específica — hablamos contigo para valorar la tuya.

Hablamos contigo

El informe de compliance de Secvex ALT

El informe de Secvex ALT es un documento técnico de apoyo para procesos de cumplimiento. Recoge los resultados del testing adversarial, mapea cada hallazgo a los marcos de referencia aplicables y genera un registro con integridad verificable. No sustituye una certificación regulatoria — documenta el proceso de evaluación adversarial realizado.

Índice de severidad por familia de ataque

Bajo / Medio / Alto / Crítico — prioriza los hallazgos por impacto real en el sistema evaluado para que el equipo técnico sepa por dónde empezar.

Mapeo a OWASP LLM Top 10 2025

Cada resultado vinculado a la categoría de vulnerabilidad del estándar de facto en seguridad de LLMs. Facilita la comunicación con equipos de seguridad y auditores.

Mapeo al Art. 15 del EU AI Act y Guías AESIA

Para los ataques alineados con las categorías de vulnerabilidad que el Art. 15 identifica: puertas traseras, extracción de datos de entrenamiento, inferencia de pertenencia y transferencia adversarial.

Audit trail SHA-256

Hash del conjunto de resultados que garantiza que el informe no ha sido modificado desde su generación. Verificable por terceros de forma independiente.

Persona responsable y fecha de emisión

Campos contemplados en el Anexo IV.2(g.4) del EU AI Act para la documentación técnica de sistemas de IA de alto riesgo.

Dos modos de firma

Autoevaluación (Pro): el cliente firma como responsable del proceso de testing realizado.

Con respaldo de Secvex (Business): el equipo de Secvex supervisa el escaneo y firma el informe, añadiendo credibilidad como documentación respaldada por un evaluador externo.

Planes

Cada organización tiene necesidades distintas. Hablamos contigo para encontrar la solución más adecuada.

Demo

Prueba la herramienta sin compromiso

  • 3 familias de ataque: evasión adversarial, transferencia adversarial y puertas traseras
  • Entorno on-premise
  • Panel de métricas por sesión
  • Sin historial de escaneos individuales
  • Sin presets de Compliance Scan
  • Sin informe de compliance PDF
Descargar Demo
Recomendado

Pro

Para organizaciones que documentan su evaluación adversarial

  • Todo lo incluido en Demo
  • 2 familias adicionales: extracción de datos de entrenamiento e inferencia de pertenencia
  • 3 presets de Compliance Scan (EU AI Act · OWASP Top 10 · Completo)
  • Construye tus prompts — builder visual con plantillas predefinidas
  • Historial completo de escaneos
  • Informe PDF: severity index, mapeo OWASP + AI Act, audit trail SHA-256, persona responsable y fecha de emisión

El cliente firma el informe como autoevaluación.

Solicitar información

Evaluamos cada caso 1 a 1

Coming soon

Business

Para organizaciones con máxima exigencia

  • Todo lo incluido en Pro
  • Monitorización continua programada (Art. 72 EU AI Act)
  • Evaluación de tu propia capa de defensa
  • Comparación multi-modelo
  • API REST + integración CI/CD
  • El equipo de Secvex supervisa el escaneo y respalda la documentación generada
Únete a la lista de espera

Evaluamos cada caso 1 a 1

Preguntas frecuentes

Respuestas directas sobre adversarial testing, normativa y Secvex ALT.

¿Qué es el adversarial testing en IA?

El adversarial testing en IA es un proceso sistemático para evaluar la resistencia de modelos de lenguaje frente a entradas maliciosas diseñadas para evadir sus restricciones de seguridad. Mediante técnicas como jailbreak, ataques de Universal Trigger y backdoor injection, identifica vulnerabilidades antes de que actores maliciosos las exploten en producción. Es el equivalente al penetration testing tradicional aplicado a sistemas de IA.

¿Cómo se cumple el Artículo 15 del EU AI Act?

El Artículo 15 del EU AI Act exige que los sistemas de IA de alto riesgo sean robustos frente a errores, fallos y ataques adversariales. Para cumplirlo, las organizaciones deben realizar evaluaciones de robustez documentadas y demostrar que el sistema ha sido testado bajo condiciones adversas. Secvex ALT automatiza estas evaluaciones y genera documentación técnica de apoyo para el proceso de conformidad, diseñada para ser presentada como evidencia del testing adversarial realizado.

¿Secvex ALT funciona on-premise o en la nube?

Depende del plan. La versión Pro funciona exclusivamente on-premise y offline: ningún dato de tu modelo, tus prompts ni tus resultados sale de tu infraestructura. La versión Business está diseñada para entornos cloud, permitiendo integración con infraestructura remota y evaluación continua programada. En ambos casos, la elección del modo de despliegue se adapta a las políticas de seguridad y los requisitos regulatorios de la organización.

¿Qué diferencia a Secvex de otras herramientas de AI red teaming?

Secvex ALT se diferencia por su despliegue 100% on-premise (Pro) o cloud (Business) sin dependencia de servidores externos, familias de ataque alineadas con la taxonomía de AESIA Guía 11, documentación técnica mapeada al EU AI Act y OWASP LLM Top 10 2025, audit trail SHA-256 verificable, y dos modos de firma del informe: autoevaluación (Pro) o con respaldo del equipo de Secvex como evaluador externo (Business).

  • Despliegue on-premise (Pro) o en cloud (Business) — sin dependencia de servidores externos de terceros
  • Familias de ataque alineadas con la taxonomía de AESIA Guía 11: evasión adversarial, puertas traseras, extracción de datos de entrenamiento, inferencia de pertenencia y transferencia adversarial
  • Documentación técnica estructurada mapeada al EU AI Act (Arts. 9/15), Guías AESIA 11 y 15, y OWASP LLM Top 10 2025
  • Audit trail SHA-256 — integridad del documento verificable por terceros de forma independiente
  • Defensa configurable — evalúa la efectividad de tu propia capa de seguridad durante el testing
  • Presets de Compliance Scan preconfigurados por marco normativo, sin necesidad de conocimientos técnicos previos
  • Constructor de prompts propio — introduce tus casos de prueba desde la interfaz con plantillas predefinidas
  • Dos modos de firma: autoevaluación (Pro) o con respaldo del equipo de Secvex como evaluador externo (Business)
¿Qué sistemas de IA puede auditar Secvex ALT?

Secvex ALT audita exclusivamente sistemas de IA generativa basados en texto: chatbots, copilotos de código, asistentes RAG, motores de resumen de documentos y sistemas de extracción de información. No audita (todavía) clasificadores tabulares —scoring de crédito, detección de fraude, concesión de ayudas públicas— ni sistemas biométricos —reconocimiento facial, de voz o de imagen—. Esta delimitación evita expectativas erróneas y garantiza que los resultados sean técnicamente válidos.

¿Qué diferencia un informe de autoevaluación de uno auditado por Secvex?

En el plan Pro, el cliente firma el informe como autoevaluación propia: documentación diseñada para acreditar el proceso de diligencia debida (contexto Art. 26 EU AI Act). En el plan Business, el equipo de Secvex supervisa el escaneo y firma el informe como evaluador externo, añadiendo credibilidad como documentación respaldada por un tercero. La diferencia es análoga a un CRO en un ensayo clínico: genera la evidencia técnica, no el certificado regulatorio final.

¿Secvex ALT es lo mismo que una certificación ISO 42001?

ISO 42001 certifica que una organización ha implementado un Sistema de Gestión de IA con procesos de gobernanza documentados. Secvex ALT ejecuta ataques adversariales reales contra el modelo y genera evidencia técnica reproducible sobre su comportamiento bajo presión. Son complementarios, no excluyentes: la ISO certifica el proceso; Secvex demuestra que el modelo resiste los ataques que el regulador identifica como relevantes para evaluar.

¿Cuándo entra en vigor el EU AI Act para sistemas de alto riesgo?

Las obligaciones para sistemas de IA de alto riesgo del Anexo III entran en plena vigencia en agosto de 2026. A partir de esa fecha, los deployers deben poder demostrar cumplimiento del Artículo 9 (gestión de riesgos) y el Artículo 15 (robustez y ciberseguridad) ante las autoridades competentes, con documentación técnica auditada y trazable.

¿Qué información incluye el documento técnico de apoyo para cumplimiento de Secvex ALT?

El documento técnico de apoyo para cumplimiento (plan Pro y Business) incluye: índice de severidad por familia de ataque, mapeo completo a OWASP LLM Top 10 y EU AI Act, audit trail con hash SHA-256 para garantizar la integridad ante auditores, persona responsable y fecha de emisión. El documento está diseñado para ser presentado como evidencia técnica del proceso de evaluación adversarial realizado.

Hablemos

Cada caso es distinto — hablemos y evaluamos tu situación.

Sin compromiso

Analizamos tu situación técnica antes de hablar de producto.

Confidencial

Toda la información que compartes con el equipo de Secvex es confidencial.

Respuesta rápida

El equipo de Secvex responde en menos de 24 horas hábiles.

Correo directo

info@secvex.es

Al enviar aceptas nuestra Política de Privacidad. Sin checkout ni precios.