اختراق الذكاء الاصطناعي
موارد أمان الذكاء الاصطناعي

OWASP Top 10 for LLM Applications 2025/2026

The definitive list of critical security risks in LLM applications - Updated August 2026 with 2026 predicted changes

73%
تحتوي عمليات نشر الذكاء الاصطناعي على ثغرات أمنية حرجة
(حالة OWASP لأمن الذكاء الاصطناعي، 2025)
41%
يحتوي الذكاء الاصطناعي للمؤسسة على واجهات برمجة تطبيقات غير مصادق عليها
(CodeWall Research, 2025)
Virtually 100%
الحقن الفوري الذي يمكن استغلاله في عمليات نشر LLM
(OWASP LLM Top 10, 2025)
⚠

التوعية بالمخاطر الحرجة

يبقى "الحقن الفوري" هو الثغرة رقم 1. راجع دليل الحقن الفوري الشامل الخاص بنا →

🔮

OWASP LLM Top 10 2026: What's Changing

The 2025 version is still the active standard, but the 2026 draft introduces significant changes:

  • NEW: Agent Hijacking — Goal manipulation in autonomous agent workflows (merges with Agentic ASI01)
  • NEW: Multi-Modal Injection — Prompt injection via images, audio, and video in multimodal AI systems
  • NEW: Memory Persistence — Poisoning long-term agent memory/cache across sessions
  • Elevated: System Prompt Leakage — Moving from LLM07 to higher priority due to agent context exposure
  • Broadened: Excessive Agency — Expanded to cover MCP tool abuse, OAuth delegation attacks

Track OWASP LLM Top 10 2026 progress →

LLM01

الحقن الفوري

Critical

Manipulating LLM behavior through crafted inputs that override original instructions. Includes both direct (user input) and indirect (external data) injection.

أنواع الهجمات
  • الحقن المباشر: مطالبات المستخدم الضارة التي تتجاوز تعليمات النظام
  • Indirect Injection: Hidden instructions in external documents, web content, or API responses
  • التلاعب بالسياق: استغلال سياق المحادثة لتغيير السلوك
  • هجمات الهروب من السجن: تجاوز مرشحات الأمان من خلال المطالبة الإبداعية
أمثلة الهجوم
  • Ignore previous instructions and...
  • النص المضمن في أحرف unicode غير مرئية
  • الحقن الفوري عبر XSS المخزن في محتوى الويب
  • DAN (Do Anything Now) style jailbreaks
استراتيجيات التخفيف
  • تنفيذ التحقق الصارم من صحة الإدخال والتعقيم
  • استخدام فصل الامتيازات بين مدخلات المستخدم والنظام يطالب
  • تطبيق تصفية المخرجات قبل عرض النتائج
  • مراقبة أنماط الحقن في السجلات
  • تنفيذ الدفاع المتعمق باستخدام طبقات أمان متعددة
LLM02

الكشف عن المعلومات الحساسة

Critical

LLMs inadvertently revealing private, confidential, or proprietary information through model outputs.

أنواع الهجمات
  • استخراج بيانات التدريب: استرداد البيانات الحساسة من ذاكرة النموذج
  • تسرب معلومات التعريف الشخصية: الكشف عن معلومات التعريف الشخصية
  • مفتاح واجهة برمجة التطبيقات/كشف بيانات الاعتماد: الكشف عن الأسرار في الاستجابات
  • الكشف عن منطق الأعمال: الكشف عن خوارزميات أو عمليات الملكية
أمثلة الهجوم
  • استخراج عناوين البريد الإلكتروني من خلال مطالبات محددة
  • الكشف عن بيانات اعتماد SQL في رسائل الخطأ
  • الكشف عن معلومات تحديد الهوية الشخصية للعميل من بيانات التدريب
  • كشف مطالبات النظام الداخلي
استراتيجيات التخفيف
  • تنفيذ تصفية قوية للمدخلات/المخرجات
  • فرض خطوط معالجة البيانات
  • تطبيق سياسات إلغاء اشتراك المستخدم لاستخدام البيانات
  • استخدام تقنيات الخصوصية التفاضلية
  • تقييد الوصول الفوري للنظام وإمكانية الرؤية
LLM03

الثغرات الأمنية في سلسلة التوريد

High

Compromised or vulnerable components in the LLM supply chain including models, APIs, plugins, and third-party services.

أنواع الهجمات
  • التلاعب بالنماذج: نماذج مدربة مسبقًا معرضة للخطر
  • نقاط الضعف في تبعية PyPI/npm: المكتبات غير الآمنة
  • بيانات الضبط الدقيقة الضارة: مجموعات بيانات التدريب المسمومة
  • موفري واجهة برمجة التطبيقات المعرضة للخطر: خدمات LLM غير الموثوق بها
أمثلة الهجوم
  • أوزان النماذج ذات الأبواب الخلفية من مصدر غير موثوق
  • استغلال مكتبة المحولات الضعيفة
  • بيانات التدريب المسمومة مع مشغلات مخفية
  • مخزن مستندات RAG المخترق
استراتيجيات التخفيف
  • التحقق من سلامة النموذج من خلال المجاميع الاختبارية والتوقيعات
  • الحفاظ على SBOM (قائمة مواد البرنامج)
  • استخدام مراكز النماذج الموثوقة والتحقق من المصدر
  • فحص التبعيات بحثًا عن نقاط الضعف المعروفة
  • تنفيذ إدارة دورة حياة النموذج
LLM04

تسميم البيانات والنماذج

High

Introducing malicious or biased data into training pipelines, fine-tuning data, or RAG knowledge bases to compromise model integrity.

أنواع الهجمات
  • تسمم بيانات التدريب: إتلاف بيانات تدريب النموذج
  • الضبط الدقيق للتسمم: حقن الأبواب الخلفية من خلال الضبط الدقيق
  • تسمم RAG: تلويث قواعد معرفة الاسترجاع
  • التلاعب بالتضمين: إتلاف قواعد بيانات المتجهات
أمثلة الهجوم
  • إدراج أمثلة متحيزة لتغيير سلوك النموذج
  • إنشاء مشغلات خلفية في بيانات التدريب
  • تسميم مجموعات البيانات العامة المستخدمة للتدريب
  • إدخال معلومات خاطئة في مستندات RAG
استراتيجيات التخفيف
  • التحقق من مصدر البيانات وسلامة سلسلة التوريد
  • تنفيذ التحقق من صحة البيانات واكتشاف الأخطاء
  • استخدام خطوط أنابيب تنقية البيانات
  • تطبيق ضمانات ضبط دقيقة قوية
  • مراقبة انحراف سلوك النموذج
LLM05

التعامل غير السليم مع المخرجات

High

Failing to validate, sanitize, or properly handle LLM outputs before passing them to downstream systems or users.

أنواع الهجمات
  • XSS عبر إخراج LLM: البرمجة النصية عبر المواقع من النموذج الردود
  • حقن SQL: استعلامات ضارة تم إنشاؤها بواسطة LLM
  • حقن الأوامر: إنشاء LLM لأوامر نظام غير آمنة
  • اجتياز المسار: LLM يكشف أو يصل إلى المسارات غير المصرح بها
أمثلة الهجوم
  • LLM التي تنشئ JavaScript يتم تنفيذها في المتصفح
  • نموذج يخرج استعلامات SQL الضارة
  • إنشاء التعليمات البرمجية بما في ذلك مكالمات النظام غير الآمنة
  • الكشف عن مسار الملف في الاستجابات
استراتيجيات التخفيف
  • تنفيذ التحقق من صحة المخرجات وتطهيرها
  • استخدام تصفية المحتوى المدرك للسياق
  • تطبيق نفس عناصر التحكم في الأمان مثل مدخلات المستخدم
  • مخرجات Sandbox LLM قبل الاستخدام النهائي
  • تمكين أوضاع الترميز الآمنة في إنشاء التعليمات البرمجية
LLM06

الوكالة المفرطة

High

Granting LLM systems too much functionality, autonomy, permissions, or enabling unauthorized or harmful actions.

أنواع الهجمات
  • الوصول غير المحدود إلى الوظائف: أذونات واجهة برمجة التطبيقات الزائدة
  • الإجراء المستقل: تنفيذ الإجراءات دون موافقة الإنسان
  • إساءة استخدام الأداة: استغلال الأدوات الخارجية المتكاملة
  • التلاعب بسلسلة الأفكار: تغيير عمليات التفكير
أمثلة الهجوم
  • LLM مع وصول API الإداري لإجراء تغييرات غير مصرح بها
  • التنفيذ التلقائي للمعاملات المالية
  • حذف الموارد دون تأكيد
  • التلاعب ببيانات المستخدم دون موافقة
استراتيجيات التخفيف
  • تنفيذ ضوابط الوصول الأقل امتيازًا
  • يتطلب وجود إنسان في الحلقة لاتخاذ الإجراءات الحاسمة
  • تطبيق تحديد المعدل على العمليات الحساسة
  • تسجيل ومراقبة جميع الإجراءات المستقلة
  • استخدام قيود النطاق على الوصول إلى الأداة
LLM07

التسرب الفوري للنظام

Medium

Exposing confidential system prompts, instructions, or internal logic through manipulation or inadequate protections.

أنواع الهجمات
  • استخراج موجه مباشر: هندسة اجتماعية للكشف يطالب
  • تجاوز السياق: تقنيات التجاوز لكشف رسائل النظام
  • استغلال لعب الأدوار: خداع LLM للكشف عن التعليمات
  • تسرب السجل: كشف المطالبات في السجلات أو الأخطاء
أمثلة الهجوم
  • مطالبة LLM بتكرار "النص السابق" لاستخراج موجه النظام
  • استخدام تجاوز سعة نافذة السياق لتجاوز تحليل التعليمات
  • الحقن الفوري لتجاوز دور النظام
  • البحث عن المطالبات في سجلات التطبيق
استراتيجيات التخفيف
  • مطالبات نظام التعتيم حيثما أمكن
  • تنفيذ تقنيات العزل الفوري
  • استخدام معالجة منفصلة للتعليمات الحساسة
  • مراقبة محاولات الاستخراج الفوري
  • تطبيق تصفية صارمة للسجلات
LLM08

نقاط الضعف في المتجهات والتضمين

Medium

Security vulnerabilities in Retrieval-Augmented Generation (RAG) systems, vector databases, and embedding pipelines.

أنواع الهجمات
  • حقن RAG: محتوى ضار في المستندات المستردة
  • تسوية قاعدة بيانات المتجهات: مهاجمة تخزين المتجهات
  • استخراج التضمين: سرقة تمثيلات التضمين
  • التلاعب بالسياق: نتائج الاسترجاع الفاسدة
أمثلة الهجوم
  • يتم استرداد المستندات المسمومة كأفضل النتائج
  • الوصول غير المصرح به لقاعدة بيانات المتجهات
  • استخراج بيانات التدريب من التضمينات
  • معالجة الاسترجاع عبر هجمات التضمين
استراتيجيات التخفيف
  • التحقق من صحة جميع مستندات إدخال RAG وتعقيمها
  • تنفيذ عناصر التحكم في الوصول إلى قاعدة بيانات المتجهات
  • استخدام تشفير التضمين حيثما كان ذلك متاحًا
  • تطبيق إعادة الترتيب باستخدام مرشحات الأمان
  • استرداد المراقبة بحثًا عن الحالات الشاذة
LLM09

المعلومات الخاطئة

Medium

LLMs generating false, misleading, or biased content that appears credible, leading to informed decisions based on incorrect information.

أنواع الهجمات
  • الهلوسة: مخرجات موثوقة ولكن خاطئة
  • الأخطاء الفعلية: معلومات غير صحيحة مقدمة كحقيقة
  • تضخيم التحيز: تعزيز التحيزات الحالية
  • التلاعب: مخرجات مضللة متعمدة
أمثلة الهجوم
  • الاستشهاد بأوراق بحثية غير موجودة
  • تقديم نصيحة طبية غير صحيحة
  • إنشاء توصيات توظيف متحيزة
  • إنشاء أخبار أو مراجعات مزيفة
استراتيجيات التخفيف
  • تنفيذ خطوط أنابيب التحقق من الحقائق
  • استخدام نقاط الثقة وتقدير عدم اليقين
  • تطبيق التحقق من المصدر للمخرجات المهمة
  • إضافة مصدر المحتوى والإسناد
  • تصنيف المحتوى الذي تم إنشاؤه بواسطة الذكاء الاصطناعي بشكل واضح
LLM10

الاستهلاك غير المحدود

Medium

Allowing excessive or uncontrolled resource usage by LLM applications, leading to denial of service, financial exploitation, or service degradation.

أنواع الهجمات
  • إساءة استخدام معدل واجهة برمجة التطبيقات: مكالمات API المفرطة للحصص المرهقة
  • استنفاد الموارد: زيادة موارد الحوسبة إلى الحد الأقصى
  • استغلال التكلفة: إساءة استخدام الدفع لكل رمز يؤدي إلى فرض رسوم
  • هجمات الاستدلال: استخراج النموذج عبر الاستعلامات المفرطة
أمثلة الهجوم
  • الهجمات التلقائية التي تستهلك حصة واجهة برمجة التطبيقات بالكامل
  • البريد العشوائي السريع الذي يتسبب في أقصى طول حساب الإرهاق
  • استخراج النموذج من خلال ملايين الاستعلامات
  • حلقات مطالبة متكررة تستهلك الموارد
استراتيجيات التخفيف
  • تنفيذ قيود صارمة على المعدلات والحصص
  • إضافة حدود الرموز المميزة للإدخال/الإخراج
  • أنماط استخدام مراقبة الحالات الشاذة
  • استخدام ضوابط التكلفة وتنبيهات الميزانية
  • تطبيق ضوابط المهلة على العمليات طويلة الأمد

إطار اختبار OWASP

اتبع هذا الأسلوب المنظم لاختبار كل ثغرة أمنية:

1. الاستطلاع

  • رسم خريطة لبنية النظام وتدفق البيانات
  • تحديد نقاط الإدخال وواجهة برمجة التطبيقات واجهات
  • توثيق الأدوات والمكونات الإضافية المتكاملة
  • مراجعة مطالبات النظام وتكوينه

2. تعيين الثغرات الأمنية

  • اختبار كل فئة OWASP بشكل منهجي
  • سطح هجوم المستند ونقاط الإدخال
  • تحديد آليات الدفاع المعمول بها
  • تبعيات الخريطة وخدمات الجهات الخارجية

3. الاستغلال

  • إجراء هجمات إثبات المفهوم
  • قابلية استغلال المستندات وتأثيرها
  • اختبار تسلسل متعدد نقاط الضعف
  • تقييم جدوى الهجوم في العالم الحقيقي

4. إعداد التقارير

  • تحديد أولويات النتائج حسب مستوى المخاطرة
  • تقديم توصيات العلاج
  • تضمين رمز إثبات المفهوم
  • اقتراح تحسينات دفاعية
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.