Piratage de l'IA
Ressources de sécurité IA

Manuel de réponse aux incidents d'IA

Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026

$4.2M
Coût moyen des incidents de sécurité de l'IA
(Coût IBM des violations de données 2025)
29 min
Délai moyen d'évasion de la criminalité électronique
(CrowdStrike 2026)
47 days
Durée moyenne de mise à jour des vulnérabilités IA
(Ponemon Institute)
🚨

Critique : agir rapidement

AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.

Classification des incidents

CRITIQUE - P0

  • Exfiltration de données confirmée via le système d'IA
  • Exécution de code à distance sur l'infrastructure d'IA
  • Vol ou extraction complet du modèle
  • Accès non autorisé aux systèmes d'IA de production
  • Injection active d'invites avec impact sur les données

Temps de réponse : Immédiat : activez l'équipe chargée de l'incident dans les 15 minutes

HIGH - P1

  • Attaque par injection rapide suspectée
  • Modèles d'appel API inhabituels
  • Tentatives de contournement d'authentification
  • Falsification de la base de données vectorielles
  • Agent agissant en dehors des paramètres définis

Temps de réponse : Dans l'heure qui suit système de post-génération pour :

MEDIUM - P2

  • Données sensibles potentielles dans les invites
  • Comportement inhabituel du modèle ou hallucinations
  • Tentatives d'attaque échouées (bloquées)
  • Violation des politiques par la sortie de l'IA

Temps de réponse : Dans les 4 heures

FAIBLE - P3

  • Violations mineures des politiques
  • Activité suspecte mais non concluante
  • Tests/rapports de faux positifs

Temps de réponse : Dans les 24 heures

Phase 1 : Identification et triage (0-30 min)

Déclencheurs de détection

Alertes automatisées

  • Pics d'utilisation anormale de l'API
  • Modèles de réponse inhabituels
  • Tentatives d'authentification échouées
  • Violations des limites de taux
  • Déclencheurs de détection de toxicité

Rapports manuels

  • Rapports d'utilisateurs sur des sorties suspectes
  • Plaintes des clients
  • Préoccupations en matière de sécurité des employés
  • Notifications tierces

Liste de contrôle de triage immédiat

  1. Confirmez l'incident : S'agit-il d'un véritable événement de sécurité ou d'un faux positif ?
  2. Classer la gravité : P0-P3 en fonction de l'impact
  3. Préserver les preuves : Commencez à tout enregistrer immédiatement
  4. Avertir l'équipe : Alerter le responsable de la réponse aux incidents
  5. Chronologie du document : Enregistrez l'apparition des premiers indicateurs

Phase 2 : Confinement (30 min - 2 heures)

Confinement de l'API LLM

  • Rotation des clés API : Permutez immédiatement toutes les informations d'identification potentiellement compromises
  • Limitation de débit : Appliquer des limites de débit agressives aux points de terminaison concernés
  • Blocage IP : Bloquer les adresses IP sources malveillantes au niveau de la passerelle API
  • Drapeaux de fonctionnalité : Désactiver les fonctionnalités à risque (téléchargements de fichiers, exécution de code)
  • Mode lecture seule : Envisager le mode lecture seule pour les systèmes concernés

Confinement des agents

  • Terminer les processus de l'agent : Arrêter immédiatement les agents compromis
  • Leçon clé Désactiver l'accès des agents aux outils sensibles
  • Isoler les serveurs MCP : Déconnecter les connexions suspectes du serveur MCP
  • Invalidation de session : Forcer la déconnexion de toutes les sessions actives.
  • Segmentation du réseau : Isoler les systèmes d'IA des réseaux critiques

Confinement des données

  • Journaux d'audit : Préserver tous les journaux d'accès pour l'analyse médico-légale
  • Instantanés de base de données : Prendre des instantanés à un moment précis
  • Base de données vectorielles : Isoler et examiner la base de données vectorielles
  • Intégrité des sauvegardes : Vérifiez que les sauvegardes récentes n'ont pas été compromises

Phase 3 : Enquête (2 à 24 heures)

Analyse des journaux

Collecter et analyser :

  • Journaux de requêtes/réponses d'API : Tous les appels d'API LLM avec horodatage
  • Journaux d'authentification : Tentatives de connexion, utilisation de jeton
  • Journaux d'application : Journaux du serveur provenant des services de traitement de l'IA
  • Journaux réseau : Modèles de trafic, adresses IP sources
  • Journaux d'activité des utilisateurs : Qui a accédé à quoi et quand

Analyse des vecteurs d'attaque

Injection rapide

  • Identifier les modèles d'injection
  • Source d'injection de trace
  • Évaluer l'impact de la manipulation
  • Technique d'attaque de documents

Exfiltration de données

  • Identifier les données consultées
  • Déterminer la méthode d'exfiltration
  • Évaluer la sensibilité des données
  • Calculer le nombre d'enregistrements

Compromission d'agent

  • Identifier les actions compromises
  • Utilisation abusive de l'outil de traçage
  • Évaluer les accès non autorisés
  • Documenter les mouvements latéraux

Préservation des preuves

  1. Créer des copies médico-légales : Copies bit par bit des systèmes concernés
  2. Vérification du hachage : Calculer et documenter les hachages de fichiers
  3. Chaîne de traçabilité : Documenter qui a accédé à quelles preuves
  4. Stockage sécurisé : Stocker les preuves dans un emplacement sécurisé et à accès contrôlé
  5. Création d'une chronologie : Créer une chronologie détaillée des incidents

Phase 4 : Correction (24 à 72 heures)

Correctifs immédiats

Vulnérabilités LLM

  • Ecarts de validation des entrées de correctifs
  • Mettre à jour le filtrage de contenu
  • Renforcer la désinfection des sorties
  • Ajouter une détection par injection

Problèmes d'agent

  • Réduire les autorisations des agents
  • Ajouter des workflows d'approbation
  • Mettre en œuvre des limites plus strictes
  • Mettre à jour les contrôles d'accès aux outils

Remédiation de l'infrastructure

  • Réinitialisation des informations d'identification : Forcer la réinitialisation des mots de passe, faire pivoter toutes les clés API
  • Révision d'accès : Autorisations d'audit et de nettoyage
  • Renforcement du réseau : Mettre à jour les règles de pare-feu, segmenter les réseaux
  • Mises à jour du moniteur : Améliorer la surveillance avec de nouvelles règles de détection
  • Vérification des sauvegardes : Vérifier les sauvegardes propres, tester la restauration

Phase 5 : Notification et reporting

Rapports internes

  • Résumé : Présentation des incidents d'une page pour les dirigeants
  • Rapport technique : Résultats techniques détaillés pour l'équipe de sécurité
  • Chronologie : Chronologie complète des incidents avec les événements clés
  • Leçons apprises : Ce qui s'est bien passé, ce qui doit être amélioré
  • Éléments d'action : Tâches spécifiques avec propriétaires et délais

Notifications externes

Organismes de réglementation

  • RGPD : notification 72 heures à DPA
  • EU AI Act : signaler à l'autorité compétente
  • Régulateurs sectoriels (finance, santé)
  • Lois de notification des violations de l'État

Parties concernées

  • Notification client (si les données sont affectées)
  • Notification des partenaires commerciaux
  • Divulgation CVE (le cas échéant)
  • Divulgation publique (si nécessaire)

Phase 6 : Activités post-incident

Analyse des causes profondes

  1. Analyse des 5 pourquoi : Explorer la cause profonde
  2. Cartographie du chemin d'attaque : Comment l'attaquant a-t-il réussi ?
  3. Échecs de contrôle : Quels contrôles n'ont pas fonctionné ?
  4. Facunes de détection : Pourquoi cela n'a-t-il pas été détecté plus tôt ?
  5. Problèmes de processus : Où les processus de réponse ont-ils échoué ?

Actions d'amélioration

Technique

  • Implémenter les contrôles de sécurité manquants
  • Mettre à jour les règles de détection
  • Corriger les vulnérabilités
  • Améliorer la surveillance

Processus

  • Mettre à jour les procédures de réponse aux incidents
  • Améliorer les protocoles de communication
  • Améliorer les programmes de formation
  • Documenter les nouveaux playbooks

Préventive

  • Tests de l'équipe rouge
  • Exercices théoriques
  • Formation de sensibilisation à la sécurité
  • Révision de l'architecture

Référence rapide d'urgence

Actions en cas d'incident critique

  1. Faites pivoter immédiatement les clés API
  2. Désactiver les points de terminaison concernés
  3. Préserver tous les journaux
  4. Avertir le RSSI dans les 15 minutes
  5. Commencer la collecte de preuves

Contacts d'escalade

  • Équipe de sécurité : [numéro Slack interne]
  • Ingénieur de garde : [pagerduty]
  • CISO : [ligne directe]
  • Juridique : [legal@entreprise]
  • RP/Communications : [pr@company]

Liste de contrôle de préparation avant incident

  • Playbooks : Procédures de réponse aux incidents documentées pour les incidents d'IA courants
  • Équipe : Équipe de réponse aux incidents formée avec des rôles définis
  • Outils : Outils de journalisation, de surveillance et d'investigation prêts
  • Communication : Listes de contacts et chemins d'escalade documentés
  • Pratique : Exercices et simulations réguliers sur table
  • Rétention : Conservation suffisante des journaux (plus de 90 jours recommandés)
  • Sauvegardes : Sauvegardes vérifiées avec des procédures de restauration testées
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.