Poradnik reagowania na incydenty AI
Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026
$4.2M
Średni koszt incydentów związanych z bezpieczeństwem AI
(IBM Cost of Data Breach 2025)
29 min
Średni czas ucieczki z przestępstwa elektronicznego
(CrowdStrike 2026)
47 days
Średni czas łatania luk w zabezpieczeniach AI
(Ponemon Institute)
🚨
Krytyczny: działaj szybko
AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.
Klasyfikacja incydentów
KRYTYCZNY – P0
- Potwierdzona eksfiltracja danych przez system AI
- Zdalne wykonywanie kodu w infrastrukturze AI
- Całkowita kradzież lub ekstrakcja modelu
- Nieautoryzowany dostęp do produkcyjnych systemów AI
- Aktywne natychmiastowe wstrzykiwanie danych z wpływem na dane
Czas odpowiedzi: Natychmiastowe — aktywuj zespół ds. incydentów w ciągu 15 minut
WYSOKI - P1
- Podejrzany atak polegający na natychmiastowym wstrzyknięciu
- Nietypowe wzorce wywołań API
- Próby obejścia uwierzytelnienia
- Manipulowanie wektorowymi bazami danych
- Agent działający poza zdefiniowanymi parametrami
Czas odpowiedzi: W ciągu 1 godziny
ŚREDNI - P2
- Potencjalne wrażliwe dane w podpowiedziach
- Nietypowe zachowanie modelu lub halucynacje
- Nieudane próby ataku (zablokowane)
- Naruszenie zasad przez dane wyjściowe AI
Czas odpowiedzi: W ciągu 4 godzin
NISKI - P3
- Drobne naruszenia zasad
- Podejrzana, ale niejednoznaczna działalność
- Raporty z testów/fałszywie pozytywne
Czas odpowiedzi: W ciągu 24 godzin
Faza 1: Identyfikacja i selekcja (0-30 min)
Wyzwalacze wykrywania
Automatyczne alerty
- Nietypowe skoki użycia interfejsu API
- Nietypowe wzorce reakcji
- Nieudane próby uwierzytelnienia
- Naruszenia limitów szybkości
- Wyzwalacze wykrywania toksyczności
Ręczne raporty
- Raporty użytkowników dotyczące podejrzanych wyników
- Skargi klientów
- Obawy dotyczące bezpieczeństwa pracowników
- Powiadomienia stron trzecich
Lista kontrolna natychmiastowej selekcji
- Potwierdź incydent: Czy jest to prawdziwe zdarzenie związane z bezpieczeństwem, czy fałszywy alarm?
- Klasyfikacja ważności: P0-P3 w oparciu o wpływ
- Zachowywanie dowodów: Natychmiast rozpocznij rejestrowanie wszystkiego
- Powiadom zespół: Powiadom lidera reakcji na incydenty
- Oś czasu dokumentu: Zapisz, kiedy pojawiły się pierwsze wskaźniki
Faza 2: Przechowywanie (30 min - 2 godziny)
Przechowywanie interfejsu API LLM
- Zmieniaj klucze API: Natychmiast zmieniaj wszelkie potencjalnie zagrożone dane uwierzytelniające
- Ograniczenie szybkości: Zastosuj agresywne limity szybkości do punktów końcowych, których dotyczy problem
- Blokowanie adresów IP: Blokowanie złośliwych źródłowych adresów IP na bramce API
- Flagi funkcji: Wyłącz ryzykowne funkcje (przesyłanie plików, wykonywanie kodu)
- Tryb tylko do odczytu: Rozważ tryb tylko do odczytu dla systemów, których dotyczy problem
Ochrona agentów
- Zakończ procesy agenta: Natychmiast zatrzymaj zainfekowanych agentów
- Odbierz dostęp do narzędzia: Wyłącz dostęp agentów do wrażliwych narzędzi
- Izoluj serwery MCP: Odłącz podejrzane połączenia z serwerem MCP
- Unieważnianie sesji: Wymuś wylogowanie ze wszystkich aktywnych sesji
- Segmentacja sieci: Izoluj systemy AI od sieci krytycznych
Przechowywanie danych
- Dzienniki audytu: Zachowaj wszystkie dzienniki dostępu do analizy kryminalistycznej
- Migawki baz danych: Tworzenie migawek w określonym momencie
- Baza danych wektorowych: Izoluj i badaj wektorową bazę danych
- Integralność kopii zapasowej: Sprawdź, czy najnowsze kopie zapasowe nie zostały naruszone
Faza 3: Dochodzenie (2–24 godziny)
Analiza logów
Zbieranie i analizowanie:
- Dzienniki żądań/odpowiedzi API: Wszystkie wywołania API LLM ze znacznikami czasu
- Dzienniki uwierzytelniania: Próby logowania, użycie tokena
- Dzienniki aplikacji: Dzienniki serwerów z usług przetwarzania AI
- Dzienniki sieciowe: Wzorce ruchu, źródłowe adresy IP
- Aktywność użytkownika logi: Kto uzyskał dostęp, do czego i kiedy
Analiza wektora ataku
Prompt Injection
- Zidentyfikuj wzorce wstrzykiwania
- Źródło wstrzykiwania śledzenia
- Ocena wpływu manipulacji
- Technika ataku na dokumenty
Eksfiltracja danych
- Identyfikacja danych, do których uzyskano dostęp
- Określ metodę eksfiltracji
- Ocena wrażliwości danych
- Oblicz liczbę rekordów
Naruszenie agenta
- Identyfikuj zagrożone działania
- Śledź niewłaściwe użycie narzędzia
- Oceń nieautoryzowany dostęp
- Przesunięcie dokumentu w bok
Ochrona dowodów
- Tworzenie kopii kryminalistycznych: Kopie bit po bicie systemów, których dotyczy problem
- Weryfikacja skrótu: Obliczanie i dokumentowanie skrótów plików
- Łańcuch dostaw: Dokument, kto uzyskał dostęp do jakich dowodów
- Bezpieczne przechowywanie: Przechowuj dowody w bezpiecznej lokalizacji z kontrolowanym dostępem
- Tworzenie osi czasu: Utwórz szczegółowy harmonogram incydentów
Faza 4: Naprawa (24-72 godziny)
Natychmiastowe poprawki
Luki w zabezpieczeniach LLM
- Popraw luki w sprawdzaniu poprawności danych wejściowych
- Aktualizacja filtrowania treści
- Wzmocnienie oczyszczania wyników
- Dodaj wykrywanie wstrzykiwania
Problemy z agentami
- Zmniejsz uprawnienia agentów
- Dodaj przepływy pracy zatwierdzania
- Wprowadź bardziej rygorystyczne granice
- Aktualizacja kontroli dostępu do narzędzi
Naprawa infrastruktury
- Resetowanie danych uwierzytelniających: Wymuś resetowanie haseł, obróć wszystkie klucze API
- Przegląd dostępu: Audyt i uprawnienia do czyszczenia
- Wzmocnienie sieci: Aktualizuj reguły zapory ogniowej, segmentuj sieci
- Monitoruj aktualizacje: Ulepsz monitorowanie dzięki nowym regułom wykrywania
- Weryfikacja kopii zapasowych: Weryfikacja czystych kopii zapasowych, przywracanie testów
Faza 5: Powiadomienia i raportowanie
Raportowanie wewnętrzne
- Podsumowanie: 1-stronicowy przegląd incydentów dla kierownictwa
- Raport techniczny: Szczegółowe ustalenia techniczne dla zespołu ds. bezpieczeństwa
- Oś czasu: Pełny harmonogram incydentów z kluczowymi zdarzeniami
- Wyciągnięte wnioski: Co poszło dobrze, co wymaga poprawy
- Zastosowanie skutecznych zabezpieczeń: Konkretne zadania z właścicielami i terminami
Powiadomienia zewnętrzne
Organy regulacyjne
- RODO: powiadomienie do DPA w ciągu 72 godzin
- Ustawa EU AI: Zgłoś właściwemu organowi
- Organy regulacyjne sektorowe (finanse, opieka zdrowotna)
- Przepisy dotyczące powiadamiania o naruszeniach przez państwo
Strony dotknięte
- Powiadomienie klienta (jeśli dotyczy to danych)
- Powiadomienia partnera biznesowego
- Ujawnianie CVE (jeśli dotyczy)
- Upublicznienie (jeśli wymagane)
Faza 6: Działania po incydencie
Analiza głównych przyczyn
- 5 Analiza dlaczego: Przeanalizuj pierwotną przyczynę
- Mapowanie ścieżek ataków: Jak udało się atakującemu?
- Awarie kontroli: Które kontrole nie zadziałały?
- Wykrywanie luki: Dlaczego nie wykryto tego wcześniej?
- Problemy związane z procesami: Gdzie zawiodły procesy reagowania?
Działania udoskonalające
Techniczne
- Wdrażaj brakujące mechanizmy kontroli bezpieczeństwa
- Aktualizacja reguł wykrywania
- Łatanie luk w zabezpieczeniach
- Ulepszone monitorowanie
Proces
- Zaktualizuj procedury reagowania na incydenty
- Ulepsz protokoły komunikacyjne
- Ulepsz programy szkoleniowe
- Udokumentuj nowe podręczniki
Zapobiegawcze
- Testowanie zespołu czerwonego
- Ćwiczenia praktyczne
- Szkolenie w zakresie świadomości bezpieczeństwa
- Przegląd architektury
Krótka instrukcja dotycząca sytuacji awaryjnych
Działania w przypadku incydentów krytycznych
- Natychmiast zmień klucze API
- Wyłącz dotknięte punkty końcowe
- Zachowaj wszystkie dzienniki
- Powiadom CISO w ciągu 15 minut
- Rozpocznij gromadzenie dowodów
Kontakty w sprawie eskalacji
- Zespół ds. bezpieczeństwa: [wewnętrzny Slack #]
- Inżynier dyżurowy: [pagerduty]
- CISO: [bezpośrednia linia]
- Prawo: [legal@company]
- PR/Komunikacja: [pr@firma]
Lista kontrolna przygotowania przed incydentem
- Poradniki: Udokumentowana reakcja na incydenty procedury dotyczące typowych incydentów AI
- Zespół: Przeszkolony zespół reagowania na incydenty z określonymi rolami
- Narzędzia: Gotowe narzędzia do rejestrowania, monitorowania i kryminalistyki
- Komunikacja: Udokumentowane listy kontaktów i ścieżki eskalacji
- Praktyka: Regularne ćwiczenia i symulacje na komputerze
- Przechowywanie: Wystarczające przechowywanie logów (zalecane ponad 90 dni)
- Kopie zapasowe: Zweryfikowane kopie zapasowe z przetestowanym przywracaniem procedury