I Manual de respuesta a incidentes
Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026
$4.2M
Costo promedio de incidentes de seguridad de IA
Costo de IBM por violación de datos 2025)
29 min
Tiempo promedio de fuga del crimen
Multitud de huelga 2026)
47 days
tiempo promedio de parche de vulnerabilidad de IA
Instituto Ponemon)
🚨
crítico: actuar rápido
AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.
Clasificación de incidentes
RÍTICO - P0
- Exfiltración de datos confirmada a través del sistema de IA
- Ejecución de código de gestos en infraestructura de IA
- Robo o extracción del modelo completo.
- Acceso no autorizado a sistemas de IA de producción.
- Inyección rápida activa con impacto en los datos.
Tiempo de respuesta: inmediato: active el equipo de incidentes en 15 minutos
IGH-P1
- sospecha de ataque de inyección rápida
- patrones de llamada API habituales
- intentos de omisión de autenticación
- manipulación de la base de datos del sector
- gent actuando fuera de los parámetros definidos
Tiempo de respuesta: dentro de 1 hora
EDIUM - P2
- datos potencialmente confidenciales en mensajes
- Comportamiento de modelo inusual o alucinaciones.
- Intentos de ataque fallidos (bloqueados)
- violación de la política por salida de IA
Tiempo de respuesta: dentro de 4 horas
OW - P3
- violaciones menores de políticas
- actividad sospechosa pero no concluyente
- informes de pruebas/falsos positivos
Tiempo de respuesta: dentro de 24 horas
Fase 1: Identificación y clasificación (0-30 min)
Desencadenantes de la detección
Alertas automatizadas
- picos de uso de API anómalos
- patrones de respuesta habituales
- intentos de autenticación fallidos
- comió violaciones de límites
- disparadores de detección de oxicidad
Informes anuales
- Ser informes de salida sospechosa.
- quejas de los clientes
- preocupaciones de seguridad de los empleados
- notificaciones de terceros
Lista de verificación de clasificación inmediata
- confirme el incidente: ¿Es esto un evento de seguridad real o un falso positivo?
- lassificar la gravedad: 0-P3 basado en el impacto
- reserva de evidencia: comience a registrar todo inmediatamente
- otificar equipo: dejar que el líder de respuesta a incidentes
- línea de tiempo del documento: Registrar cuando aparecieron los primeros indicadores.
Fase 2: Contención (30 min - 2 horas)
Contención de API de LM
- otar claves API: Rote inmediatamente cualquier credencial potencialmente comprometida.
- comió limitante: Aplicar límites de tarifas agresivos a los puntos finales afectados.
- Bloqueo P: bloquear IP de origen malicioso en la puerta de enlace API
- banderas de características: Funciones de riesgo desactivables (carga de archivos, ejecución de código)
- modo de sólo lectura: Considere el modo de solo lectura para los sistemas afectados.
contención caballero
- terminar los procesos del agente: principales agentes comprometidos inmediatamente
- evocar acceso a herramientas: Inhabilitar el acceso del agente a herramientas sensibles.
- servidores solate MCP: isconnect conexiones sospechosas del servidor MCP
- invalidación de sesión: forzar cerrar sesión en todas las sesiones activas
- segmentación de la red: aislar sistemas de IA de redes críticas
contención de datos
- registros de auditoría: reservar todos los registros de acceso para análisis forense
- instantáneas de la base de datos: tomar instantáneas de un momento dado
- base de datos del sector: aislar y examinar la base de datos vectorial
- integridad de la copia de seguridad: verificar que las copias de seguridad recientes no se hayan visto comprometidas
Fase 3: Investigación (2-24 horas)
análisis
recoger y analizar:
- Registros de solicitud/respuesta de PI: Todas las llamadas a la API de LLM con marcas de tiempo.
- registros de autenticación: intentos de inicio de sesión, uso de tokens
- registros de aplicaciones: registros del servidor de servicios de procesamiento de IA
- registros de red: patrones de tráfico, IP de origen
- registros de actividad del servidor: ho accedió a qué y cuándo
Análisis de vectores de ataque
inyección rompt
- identificar patrones de inyección
- fuente de inyección de carrera
- evaluar el impacto de la manipulación
- técnica de ataque de objetos
Exfiltración de datos
- identificar los datos accedidos
- método de exfiltración etermina
- evaluar la sensibilidad de los datos
- calcular el recuento de registros
compromiso caballero
- identificar acciones comprometidas
- mal uso de la herramienta de carrera
- evaluar el acceso no autorizado
- movimiento lateral del documento
Preservación de evidencia
- Crear copias forenses: Copias it-for-bit de los sistemas afectados.
- verificación de cenizas: calcular y documentar hashes de archivos
- cadena de custodia: documento quién accedió a qué evidencia
- almacenamiento seguro: Rasgó la evidencia en un lugar seguro y de acceso controlado.
- creación de línea de tiempo: Construya un cronograma detallado del incidente
Fase 4: Remediación (24-72 horas)
Soluciones inmediatas
Vulnerabilidades de LM
- corregir las lagunas de validación de entradas
- filtrado de contenido actualizado
- fortalecer la sanitización de la salida
- detección de inyección dd
problemas de caballeros
- educar permisos del agente
- flujos de trabajo de aprobación dd
- implementar límites más estrictos
- controles de acceso a la herramienta pdate
Remediación de infraestructura
- reinicio de redencial: Forzar restablecimiento de contraseñas, rotar todas las claves API
- revisión de acceso: auditar y limpiar permisos
- endurecimiento de la red: actualizar reglas de firewall, segmentar redes
- actualizaciones del monitor: Mejore el monitoreo con nuevas reglas de detección
- verificación de copia de seguridad: verificar copias de seguridad limpias, probar restauración
Paso 5: Notificación e informes
Informes internos
- resumen ejecutivo: -página de descripción general de incidentes para liderazgo
- informe técnico: Hallazgos técnicos detallados para el equipo de seguridad.
- línea de tiempo: Cronograma completo de incidentes con eventos clave
- lecciones aprendidas: El sombrero salió bien, ¿qué necesita mejorar?
- elementos de acción: Tareas específicas con propietarios y plazos.
Notificaciones externas
órganos reguladores
- DPR: notificación de 72 horas a la DPA
- Ley U AI: Informe a la autoridad competente
- reguladores del sector (finanzas, atención sanitaria)
- leyes de notificación de incumplimiento estatal
Partes afectadas
- Notificación al cliente (si los datos están afectados)
- notificación de socio comercial
- Divulgación de VE (si corresponde)
- divulgación pública (si es necesario)
Fase 6: Actividades posteriores al incidente
Análisis de causa raíz
- Análisis de porqués: profundizar hasta la causa raíz
- mapeo de ruta de ataque: ¿Cómo logró el atacante?
- fallos de control: ¿Qué controles no funcionaron?
- brechas de detección: ¿Por qué no se detectó esto antes?
- problemas de proceso: ¿Aquí fallaron los procesos de respuesta?
Acciones de mejora
técnico
- implementar controles de seguridad faltantes
- reglas de detección de actualizaciones
- detectar vulnerabilidades
- monitoreo mejorado
proceso
- actualizar los procedimientos de respuesta a incidentes
- mejorar los protocolos de comunicación
- mejorar los programas de entrenamiento
- documentar nuevos libros de jugadas
vengativo
- pruebas del equipo educativo
- ejercicios de alto nivel
- formación en concientización sobre seguridad
- revisión de arquitectura
Referencia rápida de emergencia
Acciones críticas en caso de incidentes
- ote las claves API inmediatamente
- puntos finales afectados isable
- reservar todos los registros
- Notificar al CISO en 15 minutos
- comenzar la recopilación de pruebas
Contactos de escalada
- Equipo de seguridad: [número interno de Slack]
- Ingeniero n-call: [pagerduty]
- ISO: [línea directa]
- legal: [legal@empresa]
- R/Comunicaciones: [pr@empresa]
Lista de verificación de preparación para un nuevo incidente
- libros sencillos: Procedimientos documentados de respuesta a incidentes para incidentes comunes de IA.
- equipo: Equipo de respuesta a incidentes lluviosos con roles definidos.
- herramientas: Herramientas de registro, monitoreo y forenses listas
- comunicación: Listas de contactos y rutas de escalada documentadas.
- práctica: Ejercicios y simulaciones de mesa regulares.
- atención: retención de registros suficiente (se recomiendan más de 90 días)
- copias de seguridad: Copias de seguridad verificadas con procedimientos de restauración probados.