Hakowanie AI
Zasoby bezpieczeństwa AI

Poradnik reagowania na incydenty AI

Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026

$4.2M
Średni koszt incydentów związanych z bezpieczeństwem AI
(IBM Cost of Data Breach 2025)
29 min
Średni czas ucieczki z przestępstwa elektronicznego
(CrowdStrike 2026)
47 days
Średni czas łatania luk w zabezpieczeniach AI
(Ponemon Institute)
🚨

Krytyczny: działaj szybko

AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.

Klasyfikacja incydentów

KRYTYCZNY – P0

  • Potwierdzona eksfiltracja danych przez system AI
  • Zdalne wykonywanie kodu w infrastrukturze AI
  • Całkowita kradzież lub ekstrakcja modelu
  • Nieautoryzowany dostęp do produkcyjnych systemów AI
  • Aktywne natychmiastowe wstrzykiwanie danych z wpływem na dane

Czas odpowiedzi: Natychmiastowe — aktywuj zespół ds. incydentów w ciągu 15 minut

WYSOKI - P1

  • Podejrzany atak polegający na natychmiastowym wstrzyknięciu
  • Nietypowe wzorce wywołań API
  • Próby obejścia uwierzytelnienia
  • Manipulowanie wektorowymi bazami danych
  • Agent działający poza zdefiniowanymi parametrami

Czas odpowiedzi: W ciągu 1 godziny

ŚREDNI - P2

  • Potencjalne wrażliwe dane w podpowiedziach
  • Nietypowe zachowanie modelu lub halucynacje
  • Nieudane próby ataku (zablokowane)
  • Naruszenie zasad przez dane wyjściowe AI

Czas odpowiedzi: W ciągu 4 godzin

NISKI - P3

  • Drobne naruszenia zasad
  • Podejrzana, ale niejednoznaczna działalność
  • Raporty z testów/fałszywie pozytywne

Czas odpowiedzi: W ciągu 24 godzin

Faza 1: Identyfikacja i selekcja (0-30 min)

Wyzwalacze wykrywania

Automatyczne alerty

  • Nietypowe skoki użycia interfejsu API
  • Nietypowe wzorce reakcji
  • Nieudane próby uwierzytelnienia
  • Naruszenia limitów szybkości
  • Wyzwalacze wykrywania toksyczności

Ręczne raporty

  • Raporty użytkowników dotyczące podejrzanych wyników
  • Skargi klientów
  • Obawy dotyczące bezpieczeństwa pracowników
  • Powiadomienia stron trzecich

Lista kontrolna natychmiastowej selekcji

  1. Potwierdź incydent: Czy jest to prawdziwe zdarzenie związane z bezpieczeństwem, czy fałszywy alarm?
  2. Klasyfikacja ważności: P0-P3 w oparciu o wpływ
  3. Zachowywanie dowodów: Natychmiast rozpocznij rejestrowanie wszystkiego
  4. Powiadom zespół: Powiadom lidera reakcji na incydenty
  5. Oś czasu dokumentu: Zapisz, kiedy pojawiły się pierwsze wskaźniki

Faza 2: Przechowywanie (30 min - 2 godziny)

Przechowywanie interfejsu API LLM

  • Zmieniaj klucze API: Natychmiast zmieniaj wszelkie potencjalnie zagrożone dane uwierzytelniające
  • Ograniczenie szybkości: Zastosuj agresywne limity szybkości do punktów końcowych, których dotyczy problem
  • Blokowanie adresów IP: Blokowanie złośliwych źródłowych adresów IP na bramce API
  • Flagi funkcji: Wyłącz ryzykowne funkcje (przesyłanie plików, wykonywanie kodu)
  • Tryb tylko do odczytu: Rozważ tryb tylko do odczytu dla systemów, których dotyczy problem

Ochrona agentów

  • Zakończ procesy agenta: Natychmiast zatrzymaj zainfekowanych agentów
  • Odbierz dostęp do narzędzia: Wyłącz dostęp agentów do wrażliwych narzędzi
  • Izoluj serwery MCP: Odłącz podejrzane połączenia z serwerem MCP
  • Unieważnianie sesji: Wymuś wylogowanie ze wszystkich aktywnych sesji
  • Segmentacja sieci: Izoluj systemy AI od sieci krytycznych

Przechowywanie danych

  • Dzienniki audytu: Zachowaj wszystkie dzienniki dostępu do analizy kryminalistycznej
  • Migawki baz danych: Tworzenie migawek w określonym momencie
  • Baza danych wektorowych: Izoluj i badaj wektorową bazę danych
  • Integralność kopii zapasowej: Sprawdź, czy najnowsze kopie zapasowe nie zostały naruszone

Faza 3: Dochodzenie (2–24 godziny)

Analiza logów

Zbieranie i analizowanie:

  • Dzienniki żądań/odpowiedzi API: Wszystkie wywołania API LLM ze znacznikami czasu
  • Dzienniki uwierzytelniania: Próby logowania, użycie tokena
  • Dzienniki aplikacji: Dzienniki serwerów z usług przetwarzania AI
  • Dzienniki sieciowe: Wzorce ruchu, źródłowe adresy IP
  • Aktywność użytkownika logi: Kto uzyskał dostęp, do czego i kiedy

Analiza wektora ataku

Prompt Injection

  • Zidentyfikuj wzorce wstrzykiwania
  • Źródło wstrzykiwania śledzenia
  • Ocena wpływu manipulacji
  • Technika ataku na dokumenty

Eksfiltracja danych

  • Identyfikacja danych, do których uzyskano dostęp
  • Określ metodę eksfiltracji
  • Ocena wrażliwości danych
  • Oblicz liczbę rekordów

Naruszenie agenta

  • Identyfikuj zagrożone działania
  • Śledź niewłaściwe użycie narzędzia
  • Oceń nieautoryzowany dostęp
  • Przesunięcie dokumentu w bok

Ochrona dowodów

  1. Tworzenie kopii kryminalistycznych: Kopie bit po bicie systemów, których dotyczy problem
  2. Weryfikacja skrótu: Obliczanie i dokumentowanie skrótów plików
  3. Łańcuch dostaw: Dokument, kto uzyskał dostęp do jakich dowodów
  4. Bezpieczne przechowywanie: Przechowuj dowody w bezpiecznej lokalizacji z kontrolowanym dostępem
  5. Tworzenie osi czasu: Utwórz szczegółowy harmonogram incydentów

Faza 4: Naprawa (24-72 godziny)

Natychmiastowe poprawki

Luki w zabezpieczeniach LLM

  • Popraw luki w sprawdzaniu poprawności danych wejściowych
  • Aktualizacja filtrowania treści
  • Wzmocnienie oczyszczania wyników
  • Dodaj wykrywanie wstrzykiwania

Problemy z agentami

  • Zmniejsz uprawnienia agentów
  • Dodaj przepływy pracy zatwierdzania
  • Wprowadź bardziej rygorystyczne granice
  • Aktualizacja kontroli dostępu do narzędzi

Naprawa infrastruktury

  • Resetowanie danych uwierzytelniających: Wymuś resetowanie haseł, obróć wszystkie klucze API
  • Przegląd dostępu: Audyt i uprawnienia do czyszczenia
  • Wzmocnienie sieci: Aktualizuj reguły zapory ogniowej, segmentuj sieci
  • Monitoruj aktualizacje: Ulepsz monitorowanie dzięki nowym regułom wykrywania
  • Weryfikacja kopii zapasowych: Weryfikacja czystych kopii zapasowych, przywracanie testów

Faza 5: Powiadomienia i raportowanie

Raportowanie wewnętrzne

  • Podsumowanie: 1-stronicowy przegląd incydentów dla kierownictwa
  • Raport techniczny: Szczegółowe ustalenia techniczne dla zespołu ds. bezpieczeństwa
  • Oś czasu: Pełny harmonogram incydentów z kluczowymi zdarzeniami
  • Wyciągnięte wnioski: Co poszło dobrze, co wymaga poprawy
  • Zastosowanie skutecznych zabezpieczeń: Konkretne zadania z właścicielami i terminami

Powiadomienia zewnętrzne

Organy regulacyjne

  • RODO: powiadomienie do DPA w ciągu 72 godzin
  • Ustawa EU AI: Zgłoś właściwemu organowi
  • Organy regulacyjne sektorowe (finanse, opieka zdrowotna)
  • Przepisy dotyczące powiadamiania o naruszeniach przez państwo

Strony dotknięte

  • Powiadomienie klienta (jeśli dotyczy to danych)
  • Powiadomienia partnera biznesowego
  • Ujawnianie CVE (jeśli dotyczy)
  • Upublicznienie (jeśli wymagane)

Faza 6: Działania po incydencie

Analiza głównych przyczyn

  1. 5 Analiza dlaczego: Przeanalizuj pierwotną przyczynę
  2. Mapowanie ścieżek ataków: Jak udało się atakującemu?
  3. Awarie kontroli: Które kontrole nie zadziałały?
  4. Wykrywanie luki: Dlaczego nie wykryto tego wcześniej?
  5. Problemy związane z procesami: Gdzie zawiodły procesy reagowania?

Działania udoskonalające

Techniczne

  • Wdrażaj brakujące mechanizmy kontroli bezpieczeństwa
  • Aktualizacja reguł wykrywania
  • Łatanie luk w zabezpieczeniach
  • Ulepszone monitorowanie

Proces

  • Zaktualizuj procedury reagowania na incydenty
  • Ulepsz protokoły komunikacyjne
  • Ulepsz programy szkoleniowe
  • Udokumentuj nowe podręczniki

Zapobiegawcze

  • Testowanie zespołu czerwonego
  • Ćwiczenia praktyczne
  • Szkolenie w zakresie świadomości bezpieczeństwa
  • Przegląd architektury

Krótka instrukcja dotycząca sytuacji awaryjnych

Działania w przypadku incydentów krytycznych

  1. Natychmiast zmień klucze API
  2. Wyłącz dotknięte punkty końcowe
  3. Zachowaj wszystkie dzienniki
  4. Powiadom CISO w ciągu 15 minut
  5. Rozpocznij gromadzenie dowodów

Kontakty w sprawie eskalacji

  • Zespół ds. bezpieczeństwa: [wewnętrzny Slack #]
  • Inżynier dyżurowy: [pagerduty]
  • CISO: [bezpośrednia linia]
  • Prawo: [legal@company]
  • PR/Komunikacja: [pr@firma]

Lista kontrolna przygotowania przed incydentem

  • Poradniki: Udokumentowana reakcja na incydenty procedury dotyczące typowych incydentów AI
  • Zespół: Przeszkolony zespół reagowania na incydenty z określonymi rolami
  • Narzędzia: Gotowe narzędzia do rejestrowania, monitorowania i kryminalistyki
  • Komunikacja: Udokumentowane listy kontaktów i ścieżki eskalacji
  • Praktyka: Regularne ćwiczenia i symulacje na komputerze
  • Przechowywanie: Wystarczające przechowywanie logów (zalecane ponad 90 dni)
  • Kopie zapasowe: Zweryfikowane kopie zapasowe z przetestowanym przywracaniem procedury
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.