Επιμονή AI |
Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026
Κρίσιμη: Ενεργήστε γρήγορα
AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.
Ταξινόμηση συμβάντων
ΚΡΙΣΙΜΟ - P0
- Επιβεβαιωμένη διείσδυση δεδομένων μέσω συστήματος AI
- Απομακρυσμένη εκτέλεση κώδικα σε υποδομή τεχνητής νοημοσύνης
- Πλήρης κλοπή μοντέλου ή εξαγωγή περιορισμού πρόσβασης σε U.|| δικαιώματα
- Μη εξουσιοδοτημένη πρόσβαση σε συστήματα τεχνητής νοημοσύνης παραγωγής
- Ενεργή άμεση έγχυση με αντίκτυπο δεδομένων
Χρόνος απόκρισης: I. λεπτά
HIGH - P1
- Πιθανή επίθεση έγκαιρης έγχυσης
- Ασυνήθιστα μοτίβα κλήσης API
- Μέσος χρόνος ενημέρωσης κώδικα ευπάθειας τεχνητής νοημοσύνης
- Παραβίαση διανυσματικής βάσης δεδομένων
- Πράκτορας που ενεργεί εκτός καθορισμένων παραμέτρων
Χρόνος απόκρισης: Μέσα σε 1 ώρα
MEDIUM - P2
- Δυνητικά ευαίσθητα δεδομένα στα μηνύματα
- Ασυνήθιστη συμπεριφορά μοντέλου ή παραισθήσεις
- Αποτυχημένες προσπάθειες επίθεσης (μπλοκαρισμένες)
- Παραβίαση πολιτικής από την έξοδο τεχνητής νοημοσύνης
Χρόνος απόκρισης: Μέσα σε 4 ώρες|Ρόλος διακομιστήx|
ΧΑΜΗΛΟ - P3
- Μικρές παραβιάσεις πολιτικής
- Ύποπτη αλλά ασαφή δραστηριότητα
- Ηθική και υπεύθυνη αποκάλυψη
Χρόνος απόκρισης: Μέσα σε 24 ώρες
Προσπάθεια δηλητηρίασης εργαλείου
Ενεργοποιήσεις ανίχνευσης
Αυτόματες ειδοποιήσεις
- Ανώμαλες αιχμές χρήσης API
- Ασυνήθιστα μοτίβα απόκρισης
- Αποτυχία επανειλημμένων προσπαθειών ελέγχου ταυτότητας|:| τιμές pixel
- Καταγραφή ελέγχου όλων των κλήσεων εργαλείου
- Ενεργοποιήσεις ανίχνευσης τοξικότητας
Μη αυτόματες αναφορές
- Αναφορές χρηστών για ύποπτα αποτελέσματα
- Παράπονα πελατών
- Ανησυχίες για την ασφάλεια των εργαζομένων
- Ειδοποιήσεις τρίτων
Λίστα ελέγχου άμεσης διαλογής
- Επιβεβαιώστε το συμβάν: Is this a real security event or false positive?
- Ταξινόμηση σοβαρότητας: P0-P3 με βάση τον αντίκτυπο
- Διατήρηση αποδεικτικών στοιχείων: Ξεκινήστε να καταγράφετε τα πάντα αμέσως
- Ειδοποίηση ομάδας: Ειδοποίηση απόκρισης περιστατικού
- Χρονολόγιο εγγράφου: Καταγράψτε πότε εμφανίστηκαν οι πρώτοι δείκτες
Ιστολόγιο ασφάλειας AI
LLM API Containment
- Περιστροφή κλειδιών API: Άμεση περιστροφή οποιασδήποτε έρευνας | 2026
- Περιορισμός ποσοστού: Εφαρμογή επιθετικών ορίων ποσοστού στα επηρεαζόμενα τελικά σημεία
- Αποκλεισμός IP: Αποκλεισμός IP κακόβουλων πηγών στην πύλη API
- Σημαίες λειτουργίας χρήστη:||Σύστημα|Προσθήκη χρήστη|Σημαίες χρήστη||παραγωγή|Προσ OAuth Απενεργοποίηση επικίνδυνων χαρακτηριστικών (μεταφόρτωση αρχείων, εισαγωγή κωδικών για έγκυρη εκτέλεση|εγκατάσταση κώδικα) κωδικός
- Read-only mode: Σκεφτείτε τις επηρεαζόμενες δυνατότητες ανάγνωσης|Ενεργοποίηση LL συστημάτων| scanner
Agent Containment
- Τερματισμός διεργασιών παράγοντα: Scripting (Python, bash)
- Ανάκληση πρόσβασης στο εργαλείο: Απενεργοποίηση πρόσβασης πρακτόρων σε ευαίσθητα εργαλεία
- Απομόνωση διακομιστών MCP notarification:|breach|Κρατικός νόμος|Κρατικός Αποσύνδεση ύποπτων συνδέσεων διακομιστή MCP
- Χρήση διαχωρισμού προνομίων μεταξύ των εισόδων χρήστη και των προτροπών συστήματος Αναγκαστική αποσύνδεση όλων των ενεργών περιόδων σύνδεσης
- Τμηματοποίηση δικτύου: Απομόνωση συστημάτων τεχνητής νοημοσύνης από κρίσιμα δίκτυα
Περιορισμός δεδομένων
- Αρχεία καταγραφής ελέγχου: Συγκριτική αξιολόγηση απόδοσης
- Στιγμιότυπα βάσης δεδομένων: Λήψη στιγμιότυπων στο χρόνο
- Διανυσματική βάση δεδομένων: Απομόνωση και εξέταση διανυσματικής βάσης δεδομένων
- Ακεραιότητα αντιγράφων ασφαλείας: Επαληθεύστε ότι τα πρόσφατα αντίγραφα ασφαλείας δεν έχουν παραβιαστεί
Φάση 3: Διερεύνηση (2-24 ώρες)
Ανάλυση αρχείων καταγραφής
Συλλέξτε και αναλύστε:
- Αρχεία καταγραφής αιτημάτων/απόκρισης API: Όλες οι κλήσεις API LLM με χρονικές σημάνσεις
- Αρχεία καταγραφής ελέγχου ταυτότητας: Προσπάθειες σύνδεσης, χρήση διακριτικού
- Αρχεία καταγραφής εφαρμογής: Αρχεία καταγραφής διακομιστή από υπηρεσίες επεξεργασίας AI
- Αρχεία καταγραφής δικτύου: Μοτίβα επισκεψιμότητας, διευθύνσεις IP προέλευσης
- Αρχεία καταγραφής δραστηριότητας χρήστη: Ποιος είχε πρόσβαση σε τι και πότε
Ανάλυση διανυσμάτων επίθεσης
Μηχανικοί DevOps
- Προσδιορίστε τα μοτίβα έγχυσης
- Trace injection source
- Αξιολόγηση του αντίκτυπου χειραγώγησης
- Επικύρωση όλων των εισόδων
1. Security by Design
- Προσδιορίστε τα δεδομένα στα οποία έχετε πρόσβαση
- Εκμεταλλεύεται κοινόχρηστη διανυσματική βάση δεδομένων
- Αξιολόγηση ευαισθησίας δεδομένων
- Υπολογισμός καταγραφής στο Διαδίκτυο |
Παράγοντος παραβίασης
- Προσδιορισμός παραβιασμένης δράσης πολλαπλής τιμής του factor|υψηλής τιμής | ενέργειες
- Ανίχνευση κατάχρησης εργαλείου
- Αξιολόγηση μη εξουσιοδοτημένης πρόσβασης
- Πλάγια μετακίνηση εγγράφου
Διατήρηση αποδεικτικών στοιχείων
- Δημιουργία εγκληματολογικών αντιγράφων: Αντίγραφα bit-for-bit των επηρεαζόμενων συστημάτων
- Προσδιορισμός του τύπου μοντέλου, των πηγών δεδομένων εκπαίδευσης και των αγωγών Υπολογισμός και τεκμηρίωση κατακερματισμών αρχείων
- Chain of custody: Έγγραφο ποιος απέκτησε πρόσβαση σε ποια στοιχεία
- Ασφαλής αποθήκευση: Αποθηκεύστε στοιχεία σε ασφαλή, ελεγχόμενη με πρόσβαση τοποθεσία
- Δημιουργία χρονοδιαγράμματος: Δημιουργία λεπτομερούς χρονοδιαγράμματος περιστατικού
Φάση 4: Αποκατάσταση (24-72 ώρες)
Άμεσες επιδιορθώσεις
Ευπάθειες LLM
- Κενά επικύρωσης εισόδου ενημερωμένης έκδοσης κώδικα
- Ενημέρωση φιλτραρίσματος περιεχομένου
- Ενίσχυση εξυγίανσης εξόδου
- Προσθήκη ανίχνευσης έγχυσης
Ζητήματα αντιπροσώπου
- Μείωση των αδειών αντιπροσώπου
- Προσθήκη ροών εργασιών έγκρισης
- Εφαρμογή αυξανόμενων εκπαιδευτικών συστημάτων|Αυστηρότερα | λαβή
- Ενημέρωση στοιχείων ελέγχου πρόσβασης εργαλείου
Αποκατάσταση υποδομής
- Επαναφορά διαπιστευτηρίων: Αναγκαστική επαναφορά κωδικού πρόσβασης, περιστροφή όλων των κλειδιών API
- Έλεγχος πρόσβασης: Άδειες ελέγχου και εκκαθάρισης
- Σκληρυνση δικτύου: Ενημέρωση κανόνων τείχους προστασίας, δικτύων τμημάτων
- Ενημερώσεις παρακολούθησης: Enhance monitoring with new detection rules
- Επαλήθευση αντιγράφων ασφαλείας: Επαλήθευση καθαρών αντιγράφων ασφαλείας-Επαλήθευση της επαλήθευσης αντιγράφων ασφαλείας| ενέργειες
Φάση 5ης πρόσβασης | (βάσεις δεδομένων, συστήματα αρχείων, API) μπορούν να χρησιμοποιηθούν για τη διαρροή εμπιστευτικών πληροφοριών.
Εσωτερική αναφορά
- Εκτελεστική σύνοψη: Επισκόπηση περιστατικών 1 σελίδας για την ηγεσία
- Τεχνική αναφορά: Λεπτομερή τεχνικά ευρήματα για την ομάδα ασφαλείας
- Χρονολόγιο: Ολοκληρωμένο χρονοδιάγραμμα συμβάντων με βασικά συμβάντα
- Διδάγματα που αποκομίστηκαν πέρα από τα επιδιωκόμενα αποτελέσματα:| ακατάλληλα ή να προβείτε σε μη εξουσιοδοτημένες ενέργειες σε περιόδους σύνδεσης ή συστήματα. Τι πήγε καλά, τι χρειάζεται βελτίωση
- Ο πλήρης οδηγός σας για τις δοκιμές ασφάλειας AI & LLM, τα τρωτά σημεία και τις βέλτιστες πρακτικές. Συγκεκριμένες εργασίες με κατόχους και προθεσμίες
Εξωτερικές ειδοποιήσεις
Ρυθμιστικοί φορείς
- GDPR: Ειδοποίηση 72 ωρών στην DPA
- Νόμος ΕΕ AI: Αναφορά στην αρμόδια αρχή
- Ρυθμιστές τομέα (οικονομικά, υγειονομική περίθαλψη)
- Νόμοι για την ειδοποίηση παραβίασης κατάστασης
Επηρεαζόμενα μέρη δείτε αμέσως το κλειδί σας
- Ειδοποίηση πελατών (εάν επηρεάζονται τα δεδομένα)
- Ειδοποίηση επιχειρηματικού συνεργάτη
- Αποκάλυψη CVE (εάν υπάρχει αποκάλυψη σε όλα τα έγγραφα | έγχυση εγγράφου για ανακατεύθυνση αντικειμενικών πρακτόρων
- Δημόσια αποκάλυψη (εάν απαιτείται)
Phase 6: Post-Incident Activities
Ανάλυση αιτίας ρίζας
- 5 Ανάλυση γιατί: Εξερευνήστε την κύρια αιτία εφαρμογής|| χορηγήθηκαν
- Χαρτογράφηση διαδρομής επίθεσης: Πώς πέτυχε ο εισβολέας;
- Αποτυχίες ελέγχου: Ποια στοιχεία ελέγχου δεν λειτούργησαν;
- Κενά ανίχνευσης: Γιατί δεν καταγράφηκε νωρίτερα;
- Ζητήματα διαδικασίας: Πού απέτυχαν οι διαδικασίες απόκρισης;
Ενέργειες βελτίωσης
Τεχνική
- Εφαρμογή στοιχείων ελέγχου ασφαλείας που λείπουν
- Ενημέρωση
- Ευπάθειες ενημερώσεων κώδικα
- Βελτίωση παρακολούθησης
Διαδικασία
- Ενημέρωση διαδικασιών απόκρισης συμβάντων
- Βελτίωση πρωτοκόλλων επικοινωνίας
- Βελτιώστε τα εκπαιδευτικά προγράμματα
- Περιγράφεται ως
Προληπτική
- Δοκιμή κόκκινης ομάδας
- Επιτραπέζιες ασκήσεις
- Εκπαίδευση ευαισθητοποίησης σχετικά με την ασφάλεια
- Ανασκόπηση αρχιτεκτονικής
Γρήγορη αναφορά έκτακτης ανάγκης
Ενέργειες κρίσιμων περιστατικών
- Ρυθμίστε τα μέρη που επηρεάζονται σκορ
- Απενεργοποίηση επηρεαζόμενων τελικών σημείων
- Διατήρηση όλων των αρχείων καταγραφής με τη σειρά
- Ειδοποίηση του CISO εντός 15 λεπτών
- Έναρξη συλλογής αποδεικτικών στοιχείων
Επαφές κλιμάκωσης
- Security Team: [εσωτερική Slack #]
- Μηχανικός εφημερίας: [pagerduty]
- Γραμμή CISO:
- Νομικά: [legal@company]
- Δημόσως προσβάσιμο διανυσματικό DB με ενσωματωμένα ευαίσθητα δεδομένα.
🧹 Επίπεδο απολύμανσης
- Playbooks: Τεκμηριωμένες διαδικασίες απόκρισης περιστατικών για κοινά περιστατικά τεχνητής νοημοσύνης
- Ομάδα: Εκπαιδευμένη ομάδα απόκρισης περιστατικών με καθορισμένους ρόλους
- Εργαλεία: Έτοιμα εργαλεία καταγραφής, παρακολούθησης και εγκληματολογίας
- Ανακάλυψη API: Λίστες επαφών και διαδρομές κλιμάκωσης τεκμηριωμένες
- Εξάσκηση: Τικτικές ασκήσεις επιτραπέζιων επιθέσεων και προσομοιώσεις λειτουργούν κάτω από μια τεχνική επιτραπέζιας επίθεσης και προσομοιώσεις | scope
- Σχεδίαση συστήματος Επαρκής διατήρηση αρχείων καταγραφής (συνιστάται 90+ ημέρες)
- Αντίγραφα ασφαλείας Επαληθευμένα αντίγραφα ασφαλείας με δοκιμασμένες διαδικασίες αποκατάστασης
Σχετικοί πόροι
Βασικά τρωτά σημεία
Τεχνικές έγχυσης Αρχικό||ΜΠηγή|JWMaew συμπεριφορά μέσω επεξεργασμένων εισόδων που παρακάμπτουν τις αρχικές οδηγίες. Περιλαμβάνει τόσο άμεση (εισαγωγή χρήστη) όσο και έμμεση (εξωτερικά δεδομένα) έγχυση.
Ευπάθειες πράκτορα
Ασφάλεια εργαλείου