Pruebas de seguridad de IA y LLM

Pruebas adversarias de aplicaciones con LLM, agentes e integraciones MCP: inyección de prompts, fuga de datos, abuso de herramientas y escape de la tarea prevista.

IA, Web3 y criptografía

Una aplicación construida sobre un modelo de lenguaje recibe instrucciones de todo lo que lee: el usuario, un documento recuperado, el contenido de una página web, la salida de una herramienta. No puede distinguir de forma fiable una instrucción de un dato. En cuanto el modelo puede llamar a herramientas, enviar mensajes o escribir en una base de datos, una frase oculta en un documento se convierte en una acción en sus sistemas.

Probamos toda la aplicación y no solo el modelo: los prompts, el pipeline de recuperación, las herramientas y sus permisos, los agentes y los protocolos que los conectan. La pregunta es qué puede conseguir un atacante que el sistema haga, lea o revele, y si los controles que rodean al modelo resisten cuando el propio modelo no resiste.

01Alcance

Qué ponemos a prueba

  • Inyección de prompts directa e indirecta a través de cada entrada que lee el modelo
  • Revelación de prompts del sistema, secretos y datos de otros usuarios o inquilinos
  • Generación aumentada por recuperación: envenenamiento, control de acceso al almacén de documentos
  • Herramientas y llamadas a funciones: permisos excesivos, parámetros inseguros, confused deputy
  • Agentes: secuestro de objetivos, envenenamiento de la memoria, autonomía insegura, confianza entre agentes
  • Servidores de Model Context Protocol: autenticación, envenenamiento de herramientas, ejecución de comandos
  • Gestión de la salida: inyección en navegadores, shells, consultas y sistemas posteriores
  • Barreras de protección (guardrails) y filtros: elusión mediante codificación, idioma, juego de rol y ataques de varios turnos
  • Consumo de recursos y abuso de costes

02Enfoque

Cómo se realiza el trabajo

  1. Revisión de la arquitectura

    Trazamos qué lee el modelo, a qué puede llamar y con los permisos de quién. La mayoría de los hallazgos críticos son visibles en esta fase como un límite de confianza que falta.

  2. Pruebas adversarias

    Las entradas se elaboran a mano y se generan a escala contra cada canal que llega al modelo. Un ataque que tiene éxito se reduce a la entrada mínima que lo reproduce.

  3. Abuso de herramientas y agentes

    Usamos instrucciones inyectadas para dirigir herramientas y agentes: leer lo que no debería poder leerse, actuar en nombre de otro usuario, pasar de un sistema al siguiente.

  4. Validación de los controles

    Los filtros, las barreras de protección y los pasos de aprobación se prueban por separado. El informe indica qué control detuvo qué ataque y cuál no detuvo ninguno.

Metodología

03

Qué recibe

  • Entradas de ataque con su tasa de reproducción, ya que el comportamiento del modelo es probabilístico
  • Diagrama de límites de confianza con los controles que faltan y los débiles
  • Un conjunto de regresión de entradas adversarias para su propio pipeline de pruebas
  • Resumen ejecutivo para la dirección
  • Informe técnico: cada hallazgo con evidencias, vector CVSS 4.0, clase CWE y corrección
  • Llamada de presentación de resultados con sus ingenieros
  • Un retest de cada hallazgo en el plazo de 60 días desde la entrega del informe
  • Carta acreditativa (attestation letter) después del retest

04

Qué necesitamos de usted

  • Acceso a la aplicación como usuarios de cada rol
  • Una descripción de la arquitectura: modelos, prompts, fuentes de recuperación, herramientas, agentes
  • Un entorno de pruebas en el que las herramientas se puedan activar sin efectos en el mundo real
  • La política de uso de su proveedor de modelos, cuando restrinja las pruebas adversarias

05Estándares

Estándares en los que se basa el método

06Preguntas

Preguntas sobre este servicio

¿Prueban el modelo o la aplicación?

La aplicación. La seguridad del modelo base es responsabilidad de su proveedor. Lo que usted controla, y lo que explotan los atacantes, es cómo se conecta el modelo a sus datos y a sus herramientas.

La inyección de prompts no se puede corregir del todo. ¿Qué sentido tiene encontrarla?

El sentido es saber qué se deriva de ella. Si la inyección lleva a una respuesta equivocada, es un problema de calidad. Si lleva a un correo electrónico enviado en nombre del usuario, es una vulnerabilidad en los permisos que rodean al modelo, y se puede corregir.

¿Usan nuestros datos para entrenar servicios externos de IA o como prompts para ellos?

No. Los datos de los clientes, los prompts y los hallazgos no se envían a servicios públicos de IA ni se usan para entrenamiento. Las herramientas que se basan en modelos de lenguaje se ejecutan en entornos que controlamos.

¿Cubre esto los requisitos del Reglamento de IA de la UE?

Las pruebas adversarias son una de las medidas a las que se refiere el Reglamento para determinados sistemas y modelos. El informe documenta el método, el alcance y los resultados de una forma que sirve como evidencia. Si el Reglamento se aplica a su sistema, y cómo, es una cuestión jurídica a la que no respondemos.

08Solicitud

Cuéntenos qué hay que probar

  • Comprobación gratuita del sitio web
  • Respuesta en el plazo de 1 día hábil
  • NDA antes de cualquier detalle técnico
  • Precio fijo en los proyectos de pago
  • Sin compromiso

Solicitar una evaluación

Describa los sistemas y el objetivo. Un gestor responde en el plazo de 1 día hábil con preguntas aclaratorias y el siguiente paso.

A quién responder

Respondemos a esta dirección, salvo que elija otro canal.

Un empresario individual escribe su propio nombre.

Canal preferido
Qué evaluar
Servicios de interés

Elija todos los que correspondan.

Comprobación gratuita

Comprobamos su sitio web gratis

Si no encontramos problemas, también recibe el informe gratis. Solo paga por el informe si encontramos problemas, y su precio depende de cuántos sean y de su gravedad.

Condiciones de la comprobación gratuita de seguridad web

Seguridad de aplicaciones

Infraestructura y nube

Simulación de adversarios

IA, Web3 y criptografía

Programas y aseguramiento

Seguridad de aplicaciones

Comprobación gratuita de seguridad web

Observamos su sitio web desde fuera, como lo hace un atacante, y comprobamos si se puede entrar en él: configuraciones débiles, software desactualizado, archivos expuestos, formularios inseguros. La comprobación es gratuita.

Seguridad de aplicaciones

Pentesting de aplicaciones web

Intentamos entrar en su aplicación web como lo haría un atacante real: iniciar sesión en cuentas ajenas, leer los datos de otros clientes, cambiar precios o pedidos. Así sabe qué es posible antes que los delincuentes.

Seguridad de aplicaciones

Pruebas de seguridad de API

Una API es el canal a través del cual su aplicación, su sitio web y sus socios intercambian datos con sus servidores. Comprobamos que nadie pueda usarla para leer o modificar datos que no son suyos.

Seguridad de aplicaciones

Pentesting de aplicaciones móviles

Analizamos su aplicación de iOS o Android y los servidores que hay detrás: qué guarda la aplicación en el teléfono, qué se puede extraer de ella y si sus peticiones se pueden manipular.

Seguridad de aplicaciones

Revisión de seguridad del código

Nuestros especialistas leen el código fuente de su producto y encuentran los errores que permiten una intrusión, incluidos los que no se ven desde fuera.

Infraestructura y nube

Evaluación de seguridad en la nube y Kubernetes

Comprobamos cómo está configurada su nube (AWS, Azure, Google Cloud, Kubernetes): quién tiene acceso a qué, qué datos están abiertos a internet y hasta dónde llega un atacante después del primer error.

Infraestructura y nube

Pentesting de infraestructura

Probamos sus servidores y la red de su oficina desde fuera y desde dentro: si un atacante puede entrar y, una vez dentro, llegar al sistema de contabilidad, al correo o a las copias de seguridad.

Infraestructura y nube

Evaluación de superficie de ataque externa

Encontramos todo lo que su empresa expone a internet, incluido lo que se ha olvidado: sitios web antiguos, servidores de prueba, contraseñas filtradas. Después mostramos qué parte de ello se puede atacar.

Infraestructura y nube

Seguridad de CI/CD y cadena de suministro

Comprobamos el camino que recorre su código desde el desarrollador hasta el cliente: servidores de compilación, bibliotecas de terceros, claves de acceso. Quien controla ese camino controla su producto.

Simulación de adversarios

Operaciones de Red Team

Un ejercicio a escala real. Nuestro equipo actúa como un atacante real con un objetivo, por ejemplo, llegar a los datos de los clientes, y usted ve si su defensa lo detecta y lo detiene.

Simulación de adversarios

Ejercicios de Purple Team

Nuestros atacantes y sus defensores trabajan codo con codo: mostramos una técnica de ataque, su equipo comprueba si la ve y las carencias de la monitorización se cierran en el acto.

Simulación de adversarios

Evaluación de ingeniería social

Ponemos a prueba a las personas, no a las máquinas: los correos de phishing, las llamadas y los mensajes que usan los atacantes para obtener contraseñas. Así sabe cuántos empleados caerían en el engaño y en qué hay que formarlos.

IA, Web3 y criptografía

Pruebas de seguridad de IA y LLM

Si su producto tiene un chatbot u otro modelo de IA, comprobamos si se le puede convencer para que revele datos confidenciales, incumpla sus propias reglas o actúe en nombre de otra persona.

IA, Web3 y criptografía

Auditoría de contratos inteligentes

Antes de que un contrato inteligente custodie dinero, buscamos errores en su código que permitirían a alguien retirar o bloquear los fondos. Después del despliegue, esos errores ya no se pueden corregir.

IA, Web3 y criptografía

Revisión de criptografía

Comprobamos cómo cifra los datos su producto y cómo protege las claves: si se han elegido los algoritmos adecuados y si se aplican correctamente. Un error aquí hace que el cifrado no sirva de nada.

Programas y aseguramiento

Gestión de programas de bug bounty

Un bug bounty es un programa en el que investigadores independientes buscan vulnerabilidades en su producto y cobran por cada una que encuentran. Lanzamos y gestionamos ese programa por usted.

Programas y aseguramiento

Programa de divulgación de vulnerabilidades (VDP)

Una página pública y un procedimiento que indican a los investigadores cómo notificarle una vulnerabilidad de forma segura. Sin ellos, los informes se pierden o llegan en forma de amenazas. Ponemos en marcha el proceso y gestionamos los informes que llegan.

Programas y aseguramiento

Pentesting continuo

En lugar de una prueba al año, probamos cada cambio significativo de su producto a lo largo de todo el año, para que una nueva vulnerabilidad no espere meses a que alguien la encuentre.

Programas y aseguramiento

Pentesting para cumplimiento normativo

Una prueba de penetración organizada para que un auditor, un regulador o un gran cliente acepte su informe: PCI DSS, DORA, NIS2, ISO/IEC 27001, SOC 2.

Servicios de interés

Aún no lo sé

Elija esta opción si no sabe qué servicio necesita. Describa la tarea con sus propias palabras y un especialista le sugerirá el servicio en la respuesta.

Dominio o URL del sitio web o del sistema principal que se va a probar, por ejemplo, app.example.com.

Qué hay que probar, por qué ahora y cualquier plazo o requisito de cumplimiento. Sin contraseñas, claves ni detalles de vulnerabilidades.

Confirmaciones

No envíe credenciales, claves ni detalles de una vulnerabilidad a través de este formulario. Se acuerda un canal seguro después de la primera respuesta.

Verificación automática contra abusos