AI Hacking
Tài nguyên bảo mật AI

Sách hướng dẫn ứng phó sự cố AI

Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026

$4.2M
Chi phí sự cố bảo mật AI trung bình
(Chi phí vi phạm dữ liệu của IBM 2025)
29 min
Thời gian bùng phát trung bình của tội phạm điện tử
(CrowdStrike 2026)
47 days
Thời gian vá lỗ hổng AI trung bình
(Viện Ponemon)
🚨

Quan trọng: Hành động nhanh

AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.

Phân loại sự cố

TIÊU CHUẨN - P0

  • Xác nhận lọc dữ liệu thông qua hệ thống AI
  • Thực thi mã từ xa trên cơ sở hạ tầng AI
  • Trích xuất hoặc đánh cắp hoàn toàn mô hình
  • Truy cập trái phép vào hệ thống AI sản xuất
  • Chèn nhắc nhở chủ động có tác động đến dữ liệu

Thời gian phản hồi: Ngay lập tức - Kích hoạt nhóm xử lý sự cố trong vòng 15 phút

CAO - P1

  • Cuộc tấn công tiêm nhắc nhanh bị nghi ngờ
  • Mẫu lệnh gọi API bất thường
  • Các nỗ lực bỏ qua xác thực
  • Giả mạo cơ sở dữ liệu vectơ
  • Tác nhân hoạt động bên ngoài các tham số được xác định

Thời gian phản hồi: Trong vòng 1 giờ

TRUNG BÌNH - P2

  • Dữ liệu nhạy cảm tiềm ẩn trong lời nhắc
  • Hành vi hoặc ảo giác mô hình bất thường
  • Các nỗ lực tấn công không thành công (bị chặn)
  • Vi phạm chính sách bằng đầu ra AI

Thời gian phản hồi: Trong vòng 4 giờ

THẤP - P3

  • Vi phạm chính sách nhỏ
  • Hoạt động đáng ngờ nhưng không có kết luận
  • Thử nghiệm/báo cáo dương tính giả

Thời gian phản hồi: Trong vòng 24 giờ

Giai đoạn 1: Nhận dạng & Phân loại (0-30 min)

Trình kích hoạt phát hiện

Cảnh báo tự động

  • Lượng sử dụng API bất thường tăng đột biến
  • Các mẫu phản hồi bất thường
  • Các nỗ lực xác thực không thành công
  • Vi phạm giới hạn tỷ lệ
  • Trình kích hoạt phát hiện độc tính

Báo cáo thủ công

  • Báo cáo của người dùng về kết quả đáng ngờ
  • Khiếu nại của khách hàng
  • Các mối lo ngại về bảo mật của nhân viên
  • Thông báo của bên thứ ba

Danh sách kiểm tra phân loại ngay lập tức

  1. Xác nhận sự cố: Đây có phải là sự kiện bảo mật thực sự hay dương tính giả?
  2. Phân loại mức độ nghiêm trọng: P0-P3 dựa trên tác động
  3. Lưu giữ bằng chứng: Bắt đầu ghi nhật ký mọi thứ ngay lập tức
  4. Thông báo cho nhóm: Cảnh báo trưởng nhóm ứng phó sự cố
  5. Dòng thời gian của tài liệu: Ghi lại khi các chỉ báo đầu tiên xuất hiện

Giai đoạn 2: Ngăn chặn (30 phút - 2 giờ)

Ngăn chặn API LLM

  • Xoay khóa API: Xoay vòng ngay lập tức mọi thông tin xác thực có khả năng bị xâm phạm
  • Giới hạn tỷ lệ: Áp dụng các giới hạn tỷ lệ linh hoạt cho các điểm cuối bị ảnh hưởng
  • Chặn IP: Chặn IP nguồn độc hại tại cổng API
  • Cờ tính năng: Tắt các tính năng rủi ro (tải lên tệp, thực thi mã)
  • Chế độ chỉ đọc: Xem xét chế độ chỉ đọc cho các hệ thống bị ảnh hưởng

Ngăn chặn Tác nhân

  • Chấm dứt các tiến trình tác nhân: Ngăn chặn các tác nhân bị xâm nhập ngay lập tức
  • Thu hồi quyền truy cập công cụ: Vô hiệu hóa quyền truy cập của tác nhân vào các công cụ nhạy cảm
  • Cách ly máy chủ MCP: Ngắt kết nối các kết nối máy chủ MCP đáng ngờ
  • Vô hiệu hóa phiên: Buộc đăng xuất tất cả các phiên hoạt động
  • Phân đoạn mạng: Cách ly hệ thống AI khỏi các mạng quan trọng

Ngăn chặn dữ liệu

  • Nhật ký kiểm tra: Lưu giữ tất cả nhật ký truy cập để phân tích pháp y
  • Ảnh chụp nhanh cơ sở dữ liệu: Chụp ảnh nhanh tại thời điểm
  • Cơ sở dữ liệu vectơ: Cô lập và kiểm tra cơ sở dữ liệu vectơ
  • Tính toàn vẹn của bản sao lưu: Xác minh các bản sao lưu gần đây không bị xâm phạm

Giai đoạn 3: Điều tra (2-24 giờ)

Phân tích nhật ký

Thu thập và phân tích:

  • Nhật ký yêu cầu/phản hồi API: Tất cả lệnh gọi LLM API có dấu thời gian
  • Nhật ký xác thực: Các nỗ lực đăng nhập, sử dụng mã thông báo
  • Nhật ký ứng dụng: Nhật ký máy chủ từ các dịch vụ xử lý AI
  • Nhật ký mạng: Mẫu lưu lượng truy cập, IP nguồn
  • Nhật ký hoạt động của người dùng: Ai đã truy cập nội dung và thời điểm

Phân tích vectơ tấn công

Prompt Insert

  • Xác định các kiểu chèn
  • Nguồn tiêm dấu vết
  • Đánh giá tác động thao túng
  • Kỹ thuật tấn công tài liệu

Truyền dữ liệu

  • Xác định dữ liệu được truy cập
  • Xác định phương pháp lấy cắp dữ liệu
  • Đánh giá độ nhạy của dữ liệu
  • Tính toán số lượng bản ghi

Thỏa hiệp tác nhân

  • Xác định các hành động bị xâm phạm
  • Sử dụng sai công cụ theo dõi
  • Đánh giá quyền truy cập trái phép
  • Di chuyển tài liệu theo chiều ngang

Bảo quản bằng chứng

  1. Tạo bản sao pháp y: Bản sao từng bit của các hệ thống bị ảnh hưởng
  2. Xác minh băm: Tính toán và ghi lại các hàm băm tệp
  3. Chuỗi hành trình sản phẩm: Tài liệu ai đã truy cập bằng chứng nào
  4. Lưu trữ an toàn: Lưu trữ bằng chứng ở vị trí an toàn, được kiểm soát quyền truy cập
  5. Tạo dòng thời gian: Xây dựng dòng thời gian sự cố chi tiết

Giai đoạn 4: Khắc phục (24-72 giờ)

Sửa lỗi ngay lập tức

Lỗ hổng LLM

  • Vá các khoảng trống xác thực đầu vào
  • Cập nhật lọc nội dung
  • Tăng cường vệ sinh đầu ra
  • Thêm tính năng phát hiện tiêm

Các vấn đề về tác nhân

  • Giảm quyền của tác nhân
  • Thêm quy trình phê duyệt
  • Thực hiện các ranh giới chặt chẽ hơn
  • Cập nhật các biện pháp kiểm soát quyền truy cập công cụ

Khắc phục cơ sở hạ tầng

  • Đặt lại thông tin xác thực: Buộc đặt lại mật khẩu, xoay vòng tất cả các khóa API
  • Truy cập đánh giá: Kiểm tra và dọn sạch các quyền
  • Tăng cường mạng: Cập nhật quy tắc tường lửa, mạng phân đoạn
  • Theo dõi cập nhật: Tăng cường giám sát bằng các quy tắc phát hiện mới
  • Xác minh dự phòng: Xác minh các bản sao lưu sạch, khôi phục thử nghiệm

Giai đoạn 5: Thông báo & Báo cáo

Báo cáo nội bộ

  • Tóm tắt điều hành: Tổng quan về sự cố dài 1 trang dành cho lãnh đạo
  • Báo cáo kỹ thuật: Phát hiện kỹ thuật chi tiết cho nhóm bảo mật
  • Dòng thời gian: Hoàn thành dòng thời gian sự cố với các sự kiện chính
  • Bài học rút ra: Điều gì đã diễn ra tốt đẹp, điều gì cần cải thiện
  • Các mục hành động: Nhiệm vụ cụ thể với chủ sở hữu và thời hạn

Thông báo bên ngoài

Các cơ quan quản lý

  • GDPR: Thông báo 72 giờ cho DPA
  • Đạo luật AI của EU: Báo cáo cho cơ quan có thẩm quyền
  • Các cơ quan quản lý ngành (tài chính, y tế)
  • Luật thông báo vi phạm của tiểu bang

Các bên bị ảnh hưởng

  • Thông báo cho khách hàng (nếu dữ liệu bị ảnh hưởng)
  • Thông báo đối tác kinh doanh
  • Tiết lộ CVE (nếu có)
  • Tiết lộ công khai (nếu cần)

Giai đoạn 6: Hoạt động sau sự cố

Phân tích nguyên nhân gốc

  1. 5 Phân tích lý do tại sao: Đi sâu vào nguyên nhân gốc rễ
  2. Lập bản đồ đường dẫn tấn công: Làm thế nào kẻ tấn công thành công?
  3. Kiểm soát lỗi: Các biện pháp kiểm soát nào không hoạt động?
  4. Các lỗ hổng phát hiện: Tại sao điều này không được phát hiện sớm hơn?
  5. Vấn đề về quy trình: Quy trình phản hồi không thành công ở đâu?

Các hành động cải tiến

Kỹ thuật

  • Thực hiện các biện pháp kiểm soát bảo mật còn thiếu
  • Cập nhật các quy tắc phát hiện
  • Vá lỗ hổng
  • Tăng cường giám sát

Quy trình

  • Cập nhật quy trình ứng phó sự cố
  • Cải thiện giao thức liên lạc
  • Tăng cường chương trình đào tạo
  • Sách hướng dẫn ghi tài liệu mới

Phòng ngừa

  • Thử nghiệm nhóm đỏ
  • Bài tập trên bảng
  • Đào tạo nâng cao nhận thức về bảo mật
  • Đánh giá kiến ​​trúc

Tham khảo nhanh về trường hợp khẩn cấp

Hành động xảy ra sự cố nghiêm trọng

  1. Xoay khóa API ngay lập tức
  2. Vô hiệu hóa các điểm cuối bị ảnh hưởng
  3. Bảo toàn tất cả nhật ký
  4. Thông báo cho CISO trong vòng 15 phút
  5. Bắt đầu thu thập bằng chứng

Liên hệ nâng cao

  • Nhóm bảo mật: [Slack nội bộ #]
  • Kỹ sư trực: [nhiệm vụ nhắn tin]
  • CISO: [đường trực tiếp]
  • Pháp lý: [legal@company]
  • PR/Communications: [pr@company]

Danh sách kiểm tra chuẩn bị trước sự cố

  • Playbooks: Quy trình ứng phó sự cố được ghi lại bằng tài liệu cho các sự cố AI phổ biến
  • Nhóm: Nhóm ứng phó sự cố đã được đào tạo với các vai trò xác định
  • Công cụ: Các công cụ ghi nhật ký, giám sát và điều tra đã sẵn sàng
  • Giao tiếp: Danh sách liên hệ và đường dẫn leo thang được ghi lại
  • Thực hành: Các bài tập và mô phỏng thông thường trên máy tính bảng
  • Lưu giữ: Lưu giữ nhật ký đầy đủ (khuyến nghị hơn 90 ngày)
  • Sao lưu: Các bản sao lưu đã được xác minh bằng các quy trình khôi phục đã được thử nghiệm
AH
AI Hacking Team

The AI Hacking team researches and documents AI/LLM security vulnerabilities, red teaming techniques, and defensive strategies. Our guides are based on real-world pentesting experience and continuous monitoring of the AI security landscape.

Stay Ahead of AI Security

Get the latest AI/LLM security research, OWASP updates, and new vulnerabilities delivered straight to your inbox.