Adversarial Testing para LLMs
EU AI Act y OWASP Top 10 LLMs
Secvex ALT evalúa la robustez de tus modelos de lenguaje frente a ataques adversariales —evasión, puertas traseras, extracción de datos, inferencia de pertenencia, transferencia adversarial— y genera documentación técnica estructurada para el EU AI Act.
¿Qué es Secvex ALT?
Secvex ALT es un toolkit de adversarial testing on-premise y en cloud para sistemas de IA generativa de texto —chatbots, asistentes virtuales, copilotos de código y agentes de IA—. Evalúa su resistencia frente a ataques adversariales de evasión, puertas traseras, extracción de datos de entrenamiento e inferencia de pertenencia. Genera documentación técnica mapeada al Art. 15 del EU AI Act, las Guías 11 y 15 de AESIA, y OWASP Top 10 for LLM Applications 2025.
Alcance actual: exclusivamente sistemas de IA generativa de texto. No incluye clasificadores tabulares ni sistemas biométricos.
Familias de ataque evaluadas
Evasión adversarial
Prueba si el modelo puede ser manipulado para saltarse sus restricciones de seguridad o revelar instrucciones confidenciales del sistema.
Puertas traseras
Detecta comportamientos maliciosos ocultos en el modelo, insertados durante el entrenamiento y que solo se activan ante inputs específicos.
Extracción de datos de entrenamiento
Verifica si el modelo puede reproducir datos sensibles con los que fue entrenado, exponiendo información privada o confidencial.
Inferencia de pertenencia
Determina si un dato concreto formó parte del corpus de entrenamiento, con implicaciones directas para la privacidad y el RGPD.
Transferencia adversarial
Evalúa si existen inputs que modifican el comportamiento del modelo de forma sistemática y predecible, transferibles entre distintos contextos de uso.
Construye tus prompts
Configura tu propia evaluación desde la interfaz: selecciona las familias de ataque e introduce directamente los prompts que quieres testear. Incluye plantillas predefinidas para pruebas genéricas.
Familias de ataque y marcos de referencia
Secvex ALT cubre las categorías de vulnerabilidad adversarial que las Guías 11 y 15 de AESIA identifican como relevantes para el Art. 15 del EU AI Act, complementadas con el OWASP Top 10 for LLM Applications 2025.
| Categoría (AESIA Guía 11) | Familia de ataque en Secvex ALT | Marco adicional |
|---|---|---|
| Puertas traseras y envenenamiento de modelo | Puertas traseras | OWASP LLM04 |
| Ataques de evasión y transferencia adversarial | Evasión adversarial | OWASP LLM01 |
| Ataques de evasión y transferencia adversarial | Transferencia adversarial | OWASP LLM01 |
| Extracción de modelo y datos de entrenamiento | Extracción de datos de entrenamiento | OWASP LLM02 |
| Inferencia de pertenencia y propiedades | Inferencia de pertenencia | OWASP LLM02 |
| Fuga de instrucciones del sistema | Evasión adversarial — sub-test fuga | OWASP LLM07 |
Presets de Compliance Scan
No hace falta saber qué ataque corresponde a cada norma. Elige el preset según qué informe necesitas.
Escaneo completo AI Act
Evalúa las categorías de vulnerabilidad adversarial identificadas en el Art. 15 del EU AI Act y las Guías 11 y 15 de AESIA. Genera documentación técnica de apoyo estructurada para el proceso de conformidad.
Escaneo OWASP Top 10
Mapea cada ataque al OWASP Top 10 for LLM Applications 2025. Ideal para equipos que necesitan acreditar adhesión al estándar de facto de seguridad en LLMs.
Escaneo completo
Combina todas las familias de ataque disponibles. Máxima cobertura para organizaciones que deben demostrar cumplimiento simultáneo con múltiples marcos normativos.
Defensa configurable
Introduce tu propia capa de seguridad entre el usuario y el modelo —un filtro, un clasificador o un sistema de moderación— y mide su efectividad real frente a los ataques evaluados. Comprueba si tu defensa aguanta o puede ser evadida.
Disponible en los planes Pro y Business.
¿Por qué tu empresa necesita testing adversarial ahora?
En agosto de 2026 entran en plena vigencia las obligaciones del EU AI Act para sistemas de IA de alto riesgo (Anexo III). Las empresas que despliegan modelos de lenguaje en sectores críticos necesitan documentar la evaluación de robustez adversarial de sus sistemas como parte de los procesos de gestión de riesgos que el marco regulatorio contempla.
Agosto 2026 — Plena vigencia del EU AI Act para sistemas de IA de alto riesgo del Anexo III. Los deployers deben poder acreditar el proceso de evaluación adversarial ante las autoridades competentes.
Art. 9 — EU AI Act
Gestión de riesgos
Secvex ALT documenta el proceso de evaluación adversarial que el Art. 9 requiere registrar como parte del sistema de gestión de riesgos del sistema de IA.
Art. 15 — EU AI Act
Robustez y ciberseguridad
Secvex ALT evalúa las categorías de vulnerabilidad adversarial que el Art. 15 identifica: evasión, puertas traseras, extracción de datos de entrenamiento e inferencia de pertenencia.
Art. 26 — EU AI Act
Obligaciones del deployer
Secvex ALT genera la documentación técnica que el deployer puede aportar como evidencia de su proceso de diligencia debida en materia de robustez adversarial.
¿Tu sector ya está en el punto de mira regulatorio?
El EU AI Act prioriza los sectores con mayor impacto en los derechos fundamentales y la seguridad pública.
Infraestructura crítica OT
Sistemas de control industrial, redes de energía o agua con IA incorporada para supervisión o toma de decisiones. Operadores de infraestructura crítica sujetos a NIS2.
Fintech y banca
IA para scoring crediticio, detección de fraude o atención al cliente. DORA y el EU AI Act lo clasifican como sistema de alto riesgo del Anexo III.
RRHH y empleo
¿Tu empresa usa IA para filtrar candidatos o evaluar perfiles? El EU AI Act lo clasifica directamente como sistema de alto riesgo.
Salud
Apoyo diagnóstico, triaje automatizado o análisis de historial clínico con IA. Cualquier vulnerabilidad adversarial tiene implicaciones directas de seguridad para el paciente.
Administración pública
IA para gestión de prestaciones, análisis de solicitudes o evaluación de beneficiarios. Mismo régimen de multas que el sector privado, con responsabilidad política y reputacional añadida.
Seguros
Modelos de IA para evaluación de riesgos, suscripción de pólizas o gestión de siniestros. Clasificados como sistemas de alto riesgo del Anexo III cuando condicionan el acceso a servicios financieros.
Si tu organización despliega modelos de lenguaje en alguno de estos sectores, el marco regulatorio contempla requisitos de evaluación de robustez adversarial. La situación regulatoria de cada organización es específica — hablamos contigo para valorar la tuya.
Hablamos contigoEl informe de compliance de Secvex ALT
El informe de Secvex ALT es un documento técnico de apoyo para procesos de cumplimiento. Recoge los resultados del testing adversarial, mapea cada hallazgo a los marcos de referencia aplicables y genera un registro con integridad verificable. No sustituye una certificación regulatoria — documenta el proceso de evaluación adversarial realizado.
Índice de severidad por familia de ataque
Bajo / Medio / Alto / Crítico — prioriza los hallazgos por impacto real en el sistema evaluado para que el equipo técnico sepa por dónde empezar.
Mapeo a OWASP LLM Top 10 2025
Cada resultado vinculado a la categoría de vulnerabilidad del estándar de facto en seguridad de LLMs. Facilita la comunicación con equipos de seguridad y auditores.
Mapeo al Art. 15 del EU AI Act y Guías AESIA
Para los ataques alineados con las categorías de vulnerabilidad que el Art. 15 identifica: puertas traseras, extracción de datos de entrenamiento, inferencia de pertenencia y transferencia adversarial.
Audit trail SHA-256
Hash del conjunto de resultados que garantiza que el informe no ha sido modificado desde su generación. Verificable por terceros de forma independiente.
Persona responsable y fecha de emisión
Campos contemplados en el Anexo IV.2(g.4) del EU AI Act para la documentación técnica de sistemas de IA de alto riesgo.
Dos modos de firma
Autoevaluación (Pro): el cliente firma como responsable del proceso de testing realizado.
Con respaldo de Secvex (Business): el equipo de Secvex supervisa el escaneo y firma el informe, añadiendo credibilidad como documentación respaldada por un evaluador externo.
Planes
Cada organización tiene necesidades distintas. Hablamos contigo para encontrar la solución más adecuada.
Demo
Prueba la herramienta sin compromiso
- 3 familias de ataque: evasión adversarial, transferencia adversarial y puertas traseras
- Entorno on-premise
- Panel de métricas por sesión
- Sin historial de escaneos individuales
- Sin presets de Compliance Scan
- Sin informe de compliance PDF
Pro
Para organizaciones que documentan su evaluación adversarial
- Todo lo incluido en Demo
- 2 familias adicionales: extracción de datos de entrenamiento e inferencia de pertenencia
- 3 presets de Compliance Scan (EU AI Act · OWASP Top 10 · Completo)
- Construye tus prompts — builder visual con plantillas predefinidas
- Historial completo de escaneos
- Informe PDF: severity index, mapeo OWASP + AI Act, audit trail SHA-256, persona responsable y fecha de emisión
El cliente firma el informe como autoevaluación.
Solicitar informaciónEvaluamos cada caso 1 a 1
Business
Para organizaciones con máxima exigencia
- Todo lo incluido en Pro
- Monitorización continua programada (Art. 72 EU AI Act)
- Evaluación de tu propia capa de defensa
- Comparación multi-modelo
- API REST + integración CI/CD
- El equipo de Secvex supervisa el escaneo y respalda la documentación generada
Evaluamos cada caso 1 a 1
Preguntas frecuentes
Respuestas directas sobre adversarial testing, normativa y Secvex ALT.
¿Qué es el adversarial testing en IA?
El adversarial testing en IA es un proceso sistemático para evaluar la resistencia de modelos de lenguaje frente a entradas maliciosas diseñadas para evadir sus restricciones de seguridad. Mediante técnicas como jailbreak, ataques de Universal Trigger y backdoor injection, identifica vulnerabilidades antes de que actores maliciosos las exploten en producción. Es el equivalente al penetration testing tradicional aplicado a sistemas de IA.
¿Cómo se cumple el Artículo 15 del EU AI Act?
El Artículo 15 del EU AI Act exige que los sistemas de IA de alto riesgo sean robustos frente a errores, fallos y ataques adversariales. Para cumplirlo, las organizaciones deben realizar evaluaciones de robustez documentadas y demostrar que el sistema ha sido testado bajo condiciones adversas. Secvex ALT automatiza estas evaluaciones y genera documentación técnica de apoyo para el proceso de conformidad, diseñada para ser presentada como evidencia del testing adversarial realizado.
¿Secvex ALT funciona on-premise o en la nube?
Depende del plan. La versión Pro funciona exclusivamente on-premise y offline: ningún dato de tu modelo, tus prompts ni tus resultados sale de tu infraestructura. La versión Business está diseñada para entornos cloud, permitiendo integración con infraestructura remota y evaluación continua programada. En ambos casos, la elección del modo de despliegue se adapta a las políticas de seguridad y los requisitos regulatorios de la organización.
¿Qué diferencia a Secvex de otras herramientas de AI red teaming?
Secvex ALT se diferencia por su despliegue 100% on-premise (Pro) o cloud (Business) sin dependencia de servidores externos, familias de ataque alineadas con la taxonomía de AESIA Guía 11, documentación técnica mapeada al EU AI Act y OWASP LLM Top 10 2025, audit trail SHA-256 verificable, y dos modos de firma del informe: autoevaluación (Pro) o con respaldo del equipo de Secvex como evaluador externo (Business).
- Despliegue on-premise (Pro) o en cloud (Business) — sin dependencia de servidores externos de terceros
- Familias de ataque alineadas con la taxonomía de AESIA Guía 11: evasión adversarial, puertas traseras, extracción de datos de entrenamiento, inferencia de pertenencia y transferencia adversarial
- Documentación técnica estructurada mapeada al EU AI Act (Arts. 9/15), Guías AESIA 11 y 15, y OWASP LLM Top 10 2025
- Audit trail SHA-256 — integridad del documento verificable por terceros de forma independiente
- Defensa configurable — evalúa la efectividad de tu propia capa de seguridad durante el testing
- Presets de Compliance Scan preconfigurados por marco normativo, sin necesidad de conocimientos técnicos previos
- Constructor de prompts propio — introduce tus casos de prueba desde la interfaz con plantillas predefinidas
- Dos modos de firma: autoevaluación (Pro) o con respaldo del equipo de Secvex como evaluador externo (Business)
¿Qué sistemas de IA puede auditar Secvex ALT?
Secvex ALT audita exclusivamente sistemas de IA generativa basados en texto: chatbots, copilotos de código, asistentes RAG, motores de resumen de documentos y sistemas de extracción de información. No audita (todavía) clasificadores tabulares —scoring de crédito, detección de fraude, concesión de ayudas públicas— ni sistemas biométricos —reconocimiento facial, de voz o de imagen—. Esta delimitación evita expectativas erróneas y garantiza que los resultados sean técnicamente válidos.
¿Qué diferencia un informe de autoevaluación de uno auditado por Secvex?
En el plan Pro, el cliente firma el informe como autoevaluación propia: documentación diseñada para acreditar el proceso de diligencia debida (contexto Art. 26 EU AI Act). En el plan Business, el equipo de Secvex supervisa el escaneo y firma el informe como evaluador externo, añadiendo credibilidad como documentación respaldada por un tercero. La diferencia es análoga a un CRO en un ensayo clínico: genera la evidencia técnica, no el certificado regulatorio final.
¿Secvex ALT es lo mismo que una certificación ISO 42001?
ISO 42001 certifica que una organización ha implementado un Sistema de Gestión de IA con procesos de gobernanza documentados. Secvex ALT ejecuta ataques adversariales reales contra el modelo y genera evidencia técnica reproducible sobre su comportamiento bajo presión. Son complementarios, no excluyentes: la ISO certifica el proceso; Secvex demuestra que el modelo resiste los ataques que el regulador identifica como relevantes para evaluar.
¿Cuándo entra en vigor el EU AI Act para sistemas de alto riesgo?
Las obligaciones para sistemas de IA de alto riesgo del Anexo III entran en plena vigencia en agosto de 2026. A partir de esa fecha, los deployers deben poder demostrar cumplimiento del Artículo 9 (gestión de riesgos) y el Artículo 15 (robustez y ciberseguridad) ante las autoridades competentes, con documentación técnica auditada y trazable.
¿Qué información incluye el documento técnico de apoyo para cumplimiento de Secvex ALT?
El documento técnico de apoyo para cumplimiento (plan Pro y Business) incluye: índice de severidad por familia de ataque, mapeo completo a OWASP LLM Top 10 y EU AI Act, audit trail con hash SHA-256 para garantizar la integridad ante auditores, persona responsable y fecha de emisión. El documento está diseñado para ser presentado como evidencia técnica del proceso de evaluación adversarial realizado.
Hablemos
Cada caso es distinto — hablemos y evaluamos tu situación.
Sin compromiso
Analizamos tu situación técnica antes de hablar de producto.
Confidencial
Toda la información que compartes con el equipo de Secvex es confidencial.
Respuesta rápida
El equipo de Secvex responde en menos de 24 horas hábiles.
Correo directo
info@secvex.es