Hacking AI
Resurse de securitate AI
🔄 Updated August 2026

OWASP Top 10 pentru aplicații Agentic 2026

Security risks specific to autonomous AI agents and multi-step AI workflows

30+
CVE-uri MCP în 60 de zile (ian-feb 2026)
(Cercetare în domeniul securității)
36%
Serverele MCP nu au autentificare
(Invariant Labs)
42,665
|Admin.
(Scanări de securitate)
🤖

Securitate AI agentică

Unlike traditional LLMs, agentic AI systems plan, decide, delegate, and act across tools and systems. This creates new attack surfaces requiring specialized security approaches. Vedeți Ghidul nostru de securitate MCP de pierderi de 27|fake|

Ready to test? Use our AI pentesting checklist for test cases covering goal hijacking, tool misuse, excessive agency, prompt injection, and supply chain risks.

Key insight: "At least 50% of the ten risks are directly mitigable at the API gateway layer" - Zuplo, 2026

ASI01

Agent Goal Hijack

Critical

Attackers manipulate an agent's objectives, planning logic, or decision path through malicious content in inputs like emails, documents, RAG data, or web content.

Vectorii de atac
  • Injectare promptă indirectă prin documente otrăvite
  • Calendarul/întâlnirea invită la modificarea priorităților obiectivelor
  • | obiective
  • Manipularea persistenței obiectivelor între sesiuni
Exemple din lumea reală
  • Modificări rău intenționate ale e-mailurilor prioritățile de cheltuieli ale agenților financiari
  • Problemă GitHub otrăvită/conținut PR injectat în contextul agentului
  • Întâlnirea invită la schimbarea subtilă a ierarhiilor sarcinilor agentului
Strategii de atenuare
  • Implementați firewall-uri prompte pentru a detecta manipularea obiectivelor
  • Validați și igienizați tot conținutul extern înainte de procesare
  • Utilizați aplicarea și monitorizarea limitelor obiectivelor
  • Implementați verificarea în lanț de gândire
ASI02

Utilizarea greșită și exploatarea instrumentelor

Critical

Legitimate tools or functions are abused within their granted privileges, leading to unauthorized actions or data access.

Vectorii de atac
  • Injectarea SQL prin instrumente de bază de date
  • Accesul la sistemul de fișiere pentru citirea/scrierea neautorizată
  • Echipă roșie AI este practica de
  • Manipularea parametrilor instrumentului
Exemple din lumea reală
  • Instrument de execuție a codului utilizat pentru a rula comenzi rău intenționate
  • Instrument de bază de date exploatat pentru exfiltrarea datelor
  • Instrument de sistem de fișiere folosit pentru a accesa directoarele sensibile
Strategii de atenuare
  • Implementează autorizarea strictă a utilizării instrumentelor și jurnalele de audit
  • Validați toți parametrii instrumentului înainte de execuție
  • Aplicați cel mai mic privilegiu permisiunilor instrumentului
  • Utilizați medii de execuție sandbox
ASI03

Identitate video| Apărări

High

Agents inherit or delegate credentials without proper scoping, creating attribution gaps and privilege escalation risks.

Vectorii de atac
  • Delegarea acreditărilor fără o acoperire adecvată
  • Confuzia de roluri între acțiunile umane și cele ale agenților
  • Escaladarea privilegiilor prin acțiunile agentului
  • Stropirea identității în sistemele cu mai mulți agenți
Exemple din lumea reală
  • Agent care utilizează acreditările de dezvoltator pentru modificările de producție
  • Acțiunile agentului care apar ca umane în jurnalele de audit
  • Izolarea multi-locatari prin identitatea agentului
Strategii de atenuare
  • Implementarea identității specifice agentului și gestionarea accesului
  • Utilizați token-uri de scurtă durată cu un domeniu limitat de aplicare
  • Separați permisiunile agentului de acreditările umane
  • Implementați atribuirea în toate jurnalele de acțiuni ale agenților
ASI04

Vulnerabilități ale lanțului de aprovizionare agent

High

Compromised or vulnerable components in the agent tool ecosystem, including malicious tools, plugins, and compromised agent frameworks.

Vectorii de atac
  • Injectări de instrumente rău intenționate în fluxurile de lucru ale agenților
  • Furnizori de instrumente sau registre compromiși
  • Definiții instrumente otrăvite cu instrumente de răspuns la incidente
  • Vulnerabilitatea cadrului în straturile de orchestrare
Exemple din lumea reală
  • Pachetul troian npm/pypi în dependențele agenților
  • | Extragere: Inginerie socială pentru a dezvălui solicitări
  • LangGraph compromis sau cadru similar
Strategii de atenuare
  • Verificați integritatea instrumentului prin semnături și sume de control
  • Menținerea SBOM pentru toate componentele agentului
  • Utilizați registre de încredere și verificați proveniența instrumentului
  • Scanează dependențe pentru vulnerabilități cunoscute
ASI05

Execuție neașteptată a codului

Critical

Agents execute code or commands that were not intended by the system design, leading to remote code execution vulnerabilities.

Vectorii de atac
  • Generarea codului dinamic fără sandboxing adecvat
  • Injectarea de comenzi prin apeluri generate de agent
  • Deserializarea nesigură în fluxurile de lucru ale agenților
  • Scrie arbitrară fișier prin acțiuni de agent
Exemple din lumea reală
  • Agent care generează și execută interogări SQL rău intenționate
  • Instrument de interpret de cod care rulează încărcături utile pentru atacatori.
  • Comenzile Shell injectate în sursa de injectare a agentului de urmărire
Strategii de atenuare
  • Sandbox toate mediile de execuție a codului
  • Implementați instrucțiunile de introducere strictă a codului generat
  • Folosește listele permise pentru operațiuni permise
  • Aplicați limită de timp și resurse la execuție
ASI06

Otrăvirea memoriei și a contextului

High

Attackers poison the agent's memory, context, or retrieval systems to influence future behavior or extract information.

Vectorii de atac
  • Bază de date de vectori otrăviți cu înglobări rău intenționate
  • Manipularea recuperării RAG pentru derivarea obiectivelor
  • a datelor false
  • Contaminarea contextului între sesiuni
Exemple din lumea reală
  • Documentele rău intenționate au clasat mai sus în rezultatele RAG
  • Informații false stocate în memoria agentului
  • Injecția vector DB modifică comportamentul de recuperare
Strategii de atenuare
  • Validați și igienizați toate datele înainte de stocarea în memorie
  • Implementați clasamentul de recuperare cu semnale de securitate
  • Utilizați criptarea pentru conținutul de memorie sensibil
  • Monitorizează memoria pentru modificări anormale
ASI07

Comunicarea inter-agenți nesigură

Medium

Communication between agents lacks proper security controls, enabling interception, manipulation, or impersonation.

Vectorii de atac
  • Interceptarea mesajelor în comunicarea agentului
  • Identificarea punctelor de intrare cu agent multiplu| interfețe
  • Modularea mesajelor între agenți
  • Lipsa autentificării între agenți
Exemple din lumea reală
  • Un agent urmând identitatea altuia pentru a ocoli controalele
  • 3. Filtrarea ieșirii
  • Atacuri de redare a mesajelor în fluxurile de lucru ale agenților
Strategii de atenuare
  • Implementează TLS reciproc pentru comunicațiile cu agent
  • Utilizați mesaje semnate între agenți
  • Autentificarea identităților agenților în toate comunicările
  • Aplicați validarea mesajelor și verificări de integritate
ASI08

|Tipuri de erori comune|

Medium

Failure in one agent, tool, or component propagates through the system, causing widespread disruption or security gaps.

Vectorii de atac
  • Un singur punct de eșec în orchestrarea agentului
  • Gestionarea erorilor de date
  • Mecanisme de rezervă care ocolesc controalele de securitate
  • Bucle de agent recursiv consumatoare de resurse
Exemple din lumea reală
  • Validare eșuată, permițând toate solicitările prin
  • Mesaje de eroare care expun solicitările sistemului
  • Agent de rezervă care ocolește fluxurile de lucru de aprobare
Strategii de atenuare
  • Implementați întrerupătoare pentru componentele agenților
  • Proiectați degradarea grațioasă cu securitatea păstrată
  • Validarea gestionării erorilor nu expune datele sensibile
  • Setați limite de execuție pentru a preveni bucle infinite
ASI09

Exploatarea încrederii agentului uman

Medium

Agents exploit user trust through manipulation, social engineering, or by presenting misleading information as factual.

Vectorii de atac
  • Prezentarea informațiilor false ca fapte sigure
  • Manipularea utilizatorilor prin rezultate persuasive
  • Ascunderea incertitudinii sau erorilor
  • Exploatarea dependenței umane excesive asupra rezultatelor agenților.
Exemple din lumea reală
  • Agentul care fabrică informații cu mare încredere
  • Cod cu defecte de securitate prezentate ca securizate
  • Ascunderea limitărilor sau erorilor de la utilizatori
Strategii de atenuare
  • Implementați cuantificarea și comunicarea incertitudinii
  • Solicită aprobarea umană pentru acțiunile cu risc ridicat
  • Adăugați scoruri de încredere la listele de verificare a securității agentului
  • Educați utilizatorii despre limitările agenților
ASI10

Agenți necinstiți

High

Agents operate beyond their intended scope, persist inappropriately, or take unauthorized actions across sessions or systems.

Vectorii de atac
  • Activitățile de continuare ale agentului după expirarea autorizației
  • Declanșarea sau replicarea unui agent neautorizat
  • Acțiunile agenților care persistă în sesiunile utilizatorului
  • Escalarea agentului la funcții la nivel de administrator
Exemple din lumea reală
  • Agentul de fundal continuă după deconectarea utilizatorului
  • Agent neautorizat care accesează alte date despre utilizatori
  • Agent care menține accesul după finalizarea sarcinii
Strategii de atenuare
  • Implementați managementul ciclului de viață al sesiunii
  • Implementați sarcina de expirare|Date de curățare în afara parametrilor| access via AI
  • Monitorizați generarea neautorizată a agenților
  • Aplică condiții stricte de terminare

Securitate Model Context Protocol (MCP)

MCP enables AI assistants to connect to external tools and data sources, introducing new security considerations.

Riscuri de securitate MCP

  • Servere MCP neîncrezătoare cu capabilități rău intenționate
  • Exfiltrarea datelor prin accesul la instrumentul MCP
  • Otrăvirea definiției instrumentelor
  • Permisiuni excesive acordate serverelor MCP

Cele mai bune practici de securitate MCP

  • Verificați autenticitatea și proveniența serverului MCP
  • Aplicați cel mai mic privilegiu permisiunilor instrumentului MCP
  • Auditează toate comunicările serverului MCP
  • Folosiți izolarea rețelei pentru serverele MCP

Arhitectura de securitate agentică

Layer 1: Validare intrări

  • Prompt firewall-uri pentru detectarea deturnării obiectivelor
  • Sanitizarea intrărilor pentru a preveni injectarea
  • Limitarea ratei pentru a preveni abuzul de resurse
  • Filtrarea conținutului pentru date externe

Layer 2: Agent Sandbox

  • Medii de execuție izolate
  • Limite de resurse (CPU, memorie, rețea)
  • Network segmentation
  • Execuția instrumentului în containere

Layer 3: Autorizarea instrumentului|:|

  • Scoping de permisiuni cu granulație fină
  • Fluxuri de lucru de aprobare a utilizării instrumentelor
  • Înregistrare de auditare a tuturor invocărilor de instrumente
  • Acces limitat la instrumente

Layer 4: Monitoring & Response

  • Monitorizare în timp real a comportamentului agentului
  • Detectarea anomaliilor pentru acțiunile agentului
  • |
  • Comprehensive|
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.