Tekoälyn hakkerointi
AI-tietoturvaresurssit

ponse AI Incident

Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026

$4.2M
Keskimääräiset tekoälyn tietoturvahäiriöiden kustannukset
(IBM Cost of Data Breach 2025)
29 min
eRikosten keskimääräinen purkautumisaika
(CrowdStrike 2026)
47 days
Keskimääräinen tekoälyn haavoittuvuuden korjausaika
(Ponemon Institute)
🚨

Kriittinen: Toimi nopeasti

AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.

Tapahtumaluokitus

KRIITTINEN - P0

  • Vahvistettu tietojen suodattaminen tekoälyjärjestelmän kautta
  • Koodin etäsuoritus tekoälyinfrastruktuurissa
  • Täydellinen mallin varkaus tai sovellusliittymän purkaminen || käyttöoikeudet
  • Luvaton pääsy tuotantotekoälyjärjestelmiin
  • Aktiivinen nopea injektio tietovaikutuksella

Vastausaika: (Deloitte 2025)

KORKEA - P1

  • Epäilty nopea injektiohyökkäys
  • Epätavalliset API-kutsumallit
  • Tiimi|todentamisyritykset|Todennus| Tekoälyn haavoittuvuuden korjausaika
  • Vektoritietokannan peukalointi
  • Agentti, joka toimii määritettyjen parametrien ulkopuolella

Vastausaika: Yhden tunnin sisällä

KESKIPÄINEN - P2

  • Mahdolliset arkaluontoiset tiedot kehotteissa
  • Epätavallinen mallikäyttäytyminen tai hallusinaatiot
  • Epäonnistuneet hyökkäysyritykset (estetty)
  • Tekoälyluotannon aiheuttama käytäntörikkomus

Vastausaika: 4 tunnin sisällä

MATALA - P3

  • Pienet käytäntörikkomukset
  • Epäilyttävä, mutta epäselvä toiminta
  • Testaus/vääriä positiivisia raportteja

Vastausaika: 24 tunnin kuluessa

Vaihe 1: Tunnistaminen ja lajittelu (0–30 min)

Havaitsemiskäynnistimet

Automaattiset hälytykset

  • Poikkeukselliset API-käyttöpiikit
  • Epätavalliset vastausmallit
  • Etiikka ja vastuullinen paljastaminen
  • Vahvista LLM-tulosteet
  • Myrkyllisyyden havaitsemiskäynnistimet

Manuaaliset raportit

  • Käyttäjäraportit epäilyttävistä tuloksista
  • Asiakasvalitukset
  • Työntekijän turvallisuushuolet
  • Kolmannen osapuolen ilmoitukset

Välittömän triage-tarkistuslista

  1. Vahvista tapahtuma: Kuviin upotettu piiloteksti, joka on näkymätön ihmisille, mutta joka on poimittu OCR:lla ja käsitelty visiokielimalleilla.
  2. Luokittele vakavuus: P0-P3 vaikutuksen perusteella
  3. Säilytä todisteet: Aloita kaiken kirjaaminen välittömästi
  4. Ilmoita tiimille: Alert incident response lead
  5. Dokumentin aikajana: Tallenna, kun ensimmäiset indikaattorit ilmestyivät

Phase 2: Containment (30 min - 2 hours)

LLM API Containment

  • Kierrä API-avaimia: Kierrä välittömästi mahdollisesti vaarantuneet tunnistetiedot| Tietoloukkausraporttien hinta
  • Nopeusrajoitus: Käytä aggressiivisia nopeusrajoituksia vaikuttaviin päätepisteisiin
  • IP-esto: Estä haitallisen lähteen IP-osoitteet API-yhdyskäytävässä
  • Ominaisuuden liput: Poista vaaralliset ominaisuudet (tiedostojen lataukset, koodin suorittaminen) käytöstä| injektiota varten
  • Vain luku -tilaa: Harkitse vain luku -tilassa olevaa LL-kaivostilaa|haavoittuvuusjärjestelmille

Agent Containment

  • Lopeta agenttiprosessit: Pysäytä vaarantuneet agentit välittömästi
  • Peruuta työkalun käyttöoikeus: Estä agentin pääsy arkaluonteisiin työkaluihin
  • Eristä MCP-palvelimet: Katkaise epäilyttävät MCP-palvelinyhteydet
  • Käytä käyttöoikeuksien erottelua käyttäjän syötteiden ja järjestelmäkehotteiden välillä Pakota uloskirjautuminen kaikista aktiivisista istunnoista
  • Verkon segmentointi: Eristä tekoälyjärjestelmät kriittisistä verkoista

Datan Containment

  • Tarkastuslokit: Säilytä kaikki käyttölokit rikosteknistä analysointia varten
  • Tietokannan tilannekuvat: Ota tilannekuvia
  • Vektoritietokanta: Eristää ja tutkia vektoritietokanta
  • Varmuuskopion eheys: Varmista, että viimeaikaiset varmuuskopiot eivät ole vaarantuneet

Vaihe 3: Tutkinta (2–24 tuntia)

Lokianalyysi

Kerää ja analysoi:

  • API-pyyntö-/vastauslokeja: Kaikki LLM-sovellusliittymäkutsut aikaleimalla
  • Todennuslokit: Kirjautumisyritykset, tunnuksen käyttö
  • Sovelluslokit: Tekoälynkäsittelypalveluiden palvelinlokit
  • Verkkolokit: Liikennemallit, lähde-IP-osoitteet
  • Käyttäjien toimintalokit: Integroi reaaliaikainen hälytys kriittisistä uhista

Hyökkäysvektorianalyysi

Kehittäjä järjestelmä.

  • Tunnista injektiomallit
  • Jäljitä injektiolähde
  • Arvioi manipuloinnin vaikutus
  • Säännölliset pöytäharjoitukset ja simulaatiot kaikki tulot

Mitä tekoäly voi tehdä?

  • Tunnista käytetyt tiedot
  • Determine exfiltration method
  • Arvioi tietojen herkkyys
  • Laske tietueiden määrä

Agentin kompromissi

  • Tunnista vaarantuneet toiminnot|Stop-toimia varten||Stop| vaarantuneet agentit välittömästi
  • Trace tool misuse
  • Arvioi luvaton käyttö
  • Dokomentoi sivuttaista liikettä

Todisteiden säilyttäminen

  1. Luo rikosteknisiä kopioita: Bit-for-bit kopiot ongelmallisista järjestelmistä
  2. Tunnista mallin tyyppi, koulutustietolähteet ja putkistot Laske ja dokumentoi tiedostojen hajautus
  3. Palveluketju: Dokumentoi, kuka käytti mitä todisteita
  4. Suojattu tallennus: Practice:
  5. Aikajanan luominen: Luo yksityiskohtainen tapahtumaaikajana

Vaihe 4: Korjaus (24–72 tuntia)

Välittömät korjaukset

LLM-haavoittuvuudet

  • Korjaa syötteen vahvistusaukot
  • Päivitä sisällön suodatus
  • Tehosta tulosteiden desinfiointia
  • Lisää injektion havaitseminen

Agenttiongelmat

  • Vähennä agentin käyttöoikeuksia
  • Lisää hyväksynnän työnkulkuja
  • Ota käyttöön tiukemmat rajoitukset||
  • Päivitä työkalun käyttöoikeudet

Infrastruktuurin korjaus

  • Kirjautumistietojen nollaaminen: Pakota salasanan nollaus, kierrä kaikkia API-avaimia
  • Pääsytarkistus: Tarkista ja puhdista käyttöoikeudet
  • Verkon vahvistaminen: Päivitä palomuurisäännöt, segmentoi verkot
  • Seuraa päivityksiä: Enhance monitoring with new detection rules
  • Varmuuskopiointi: Tarkista puhtaat varmuuskopiot, testaa palautustoimia

Vaihe 5: Ilmoitus- ja raportointipalvelimet, joissa on pääsy, CP-tiedostojärjestelmään| API) voidaan käyttää luottamuksellisten tietojen vuotamiseen.

Sisäinen raportointi

  • Yhteenveto: 1-sivuinen tapahtumakatsaus johtajuudelle
  • Tekninen raportti: Yksityiskohtaiset tekniset havainnot turvallisuustiimille
  • Aikajana: Täydellinen tapahtumaaikajana tärkeimmillä tapahtumilla
  • Opitut opetukset, omaksuttu tai soveltumaton toiminta: Haitallisen sisällön lisääminen tietokantaan tallennettuihin asiakirjoihin.
  • Täydellinen opas tekoälyn ja LLM:n tietoturvatestaukseen, haavoittuvuuksiin ja parhaisiin käytäntöihin. Tietyt tehtävät omistajien kanssa ja määräajat

Ulkoiset ilmoitukset

Sääntelyelimet

  • GDPR: 72 tunnin ilmoitus DPA:lle
  • EU:n tekoälylaki: Ilmoita toimivaltaiselle viranomaiselle
  • Sektorin sääntelijät (rahoitus, terveydenhuolto)
  • Opi MCP-suojauslainsäädäntöön|

Aihepiiriin kuuluvat osapuolet| erottaminen

  • Asiakasilmoitus (jos tiedot vaikuttavat)
  • Yrityskumppanin ilmoitus
  • CVE-ilmoitus (jos sovellettavissa)
  • Julkaiseminen (jos vaaditaan)

Posti-Incidenttien 6:aktiviteettien tila| 2025

Perussyyanalyysi

  1. 5 Miksi-analyysi: Perehdy pohjasyyn|tietosyihin|sisällytä tietoturvaesimerkki| harjoitustiedot
  2. Hyökkäyspolun kartoitus: Miten hyökkääjä onnistui?
  3. Hallitse epäonnistumisia: Mitkä ohjaimet eivät toimineet?
  4. Havaitsemisaukot: Miksi tätä ei tunnistettu aikaisemmin?
  5. Prosessiongelmat: Missä vastausprosessit epäonnistuivat?

Parannustoimet

Tekniset

  • Ota käyttöön puuttuvat suojaustoiminnot
  • Päivitä säännöt
  • Korjaa haavoittuvuudet
  • Paranna seurantaa

Käsittely

  • Päivitä tapausten vastausmenettelyt
  • Paranna viestintäprotokollia
  • Paranna koulutusohjelmia
  • Poikkeamien havaitseminen

Ennaltaehkäisevä

  • Punaisen tiimin testaus
  • Pöytäharjoitukset
  • Turvallisuustietoisuuskoulutus
  • Arkkitehtuuritarkistus

Hätätilanteiden pikaopas

Critical Incident Actions

  1. Kierrä API-avaimia välittömästi
  2. Poista käytöstä vaikuttavat päätepisteet
  3. Säilytä kaikki lokit
  4. Ilmoita CISO:lle 15 minuutin kuluessa
  5. Aloita todisteiden kerääminen

Eskalointiyhteystiedot

  • Turvallisuustiimi: [sisäinen Slack #]
  • Päivystävä insinööri: [pagerduty]
  • CISO: [Suora linja]|Top line]|
  • Säilytä todisteet suojatussa, CAGR-tiimin estämässä||IPAI:n punaisessa paikassa||IPAI:n esto | (2024-2030)
  • Asiakasdata paljastuu AI-chatbottien kautta

🧹 Sanitization Layer

  • Ohjelmakirjat: Dokumentoidut tapausten reagointimenettelyt yleisille tekoälytapauksille
  • Tiimi: Koulutettu tapausvastaustiimi määritellyillä rooleilla
  • Työkalut: Kirjaus-, valvonta- ja rikostekniset työkalut valmiina
  • Viestintä: Kontaktiluettelot ja eskalaatiopolut dokumentoitu
  • Harjoittele: Säännölliset pöytäharjoitukset ja -simulaatiot
  • Säilytys: Riittävä lokin säilyttäminen (suositus 90+ päivää)
  • Varmuuskopiot: Varmistetut varmuuskopiot testatuilla palautusmenetelmillä
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.