Sách hướng dẫn ứng phó sự cố AI
Step-by-step procedures for responding to AI security incidents including LLM breaches, agent compromise, and prompt injection - Updated July 2026
$4.2M
Chi phí sự cố bảo mật AI trung bình
(Chi phí vi phạm dữ liệu của IBM 2025)
29 min
Thời gian bùng phát trung bình của tội phạm điện tử
(CrowdStrike 2026)
47 days
Thời gian vá lỗ hổng AI trung bình
(Viện Ponemon)
🚨
Quan trọng: Hành động nhanh
AI incidents can spread rapidly. Average eCrime breakout time is 29 minutes. Have this playbook ready BEFORE incidents occur.
Phân loại sự cố
TIÊU CHUẨN - P0
- Xác nhận lọc dữ liệu thông qua hệ thống AI
- Thực thi mã từ xa trên cơ sở hạ tầng AI
- Trích xuất hoặc đánh cắp hoàn toàn mô hình
- Truy cập trái phép vào hệ thống AI sản xuất
- Chèn nhắc nhở chủ động có tác động đến dữ liệu
Thời gian phản hồi: Ngay lập tức - Kích hoạt nhóm xử lý sự cố trong vòng 15 phút
CAO - P1
- Cuộc tấn công tiêm nhắc nhanh bị nghi ngờ
- Mẫu lệnh gọi API bất thường
- Các nỗ lực bỏ qua xác thực
- Giả mạo cơ sở dữ liệu vectơ
- Tác nhân hoạt động bên ngoài các tham số được xác định
Thời gian phản hồi: Trong vòng 1 giờ
TRUNG BÌNH - P2
- Dữ liệu nhạy cảm tiềm ẩn trong lời nhắc
- Hành vi hoặc ảo giác mô hình bất thường
- Các nỗ lực tấn công không thành công (bị chặn)
- Vi phạm chính sách bằng đầu ra AI
Thời gian phản hồi: Trong vòng 4 giờ
THẤP - P3
- Vi phạm chính sách nhỏ
- Hoạt động đáng ngờ nhưng không có kết luận
- Thử nghiệm/báo cáo dương tính giả
Thời gian phản hồi: Trong vòng 24 giờ
Giai đoạn 1: Nhận dạng & Phân loại (0-30 min)
Trình kích hoạt phát hiện
Cảnh báo tự động
- Lượng sử dụng API bất thường tăng đột biến
- Các mẫu phản hồi bất thường
- Các nỗ lực xác thực không thành công
- Vi phạm giới hạn tỷ lệ
- Trình kích hoạt phát hiện độc tính
Báo cáo thủ công
- Báo cáo của người dùng về kết quả đáng ngờ
- Khiếu nại của khách hàng
- Các mối lo ngại về bảo mật của nhân viên
- Thông báo của bên thứ ba
Danh sách kiểm tra phân loại ngay lập tức
- Xác nhận sự cố: Đây có phải là sự kiện bảo mật thực sự hay dương tính giả?
- Phân loại mức độ nghiêm trọng: P0-P3 dựa trên tác động
- Lưu giữ bằng chứng: Bắt đầu ghi nhật ký mọi thứ ngay lập tức
- Thông báo cho nhóm: Cảnh báo trưởng nhóm ứng phó sự cố
- Dòng thời gian của tài liệu: Ghi lại khi các chỉ báo đầu tiên xuất hiện
Giai đoạn 2: Ngăn chặn (30 phút - 2 giờ)
Ngăn chặn API LLM
- Xoay khóa API: Xoay vòng ngay lập tức mọi thông tin xác thực có khả năng bị xâm phạm
- Giới hạn tỷ lệ: Áp dụng các giới hạn tỷ lệ linh hoạt cho các điểm cuối bị ảnh hưởng
- Chặn IP: Chặn IP nguồn độc hại tại cổng API
- Cờ tính năng: Tắt các tính năng rủi ro (tải lên tệp, thực thi mã)
- Chế độ chỉ đọc: Xem xét chế độ chỉ đọc cho các hệ thống bị ảnh hưởng
Ngăn chặn Tác nhân
- Chấm dứt các tiến trình tác nhân: Ngăn chặn các tác nhân bị xâm nhập ngay lập tức
- Thu hồi quyền truy cập công cụ: Vô hiệu hóa quyền truy cập của tác nhân vào các công cụ nhạy cảm
- Cách ly máy chủ MCP: Ngắt kết nối các kết nối máy chủ MCP đáng ngờ
- Vô hiệu hóa phiên: Buộc đăng xuất tất cả các phiên hoạt động
- Phân đoạn mạng: Cách ly hệ thống AI khỏi các mạng quan trọng
Ngăn chặn dữ liệu
- Nhật ký kiểm tra: Lưu giữ tất cả nhật ký truy cập để phân tích pháp y
- Ảnh chụp nhanh cơ sở dữ liệu: Chụp ảnh nhanh tại thời điểm
- Cơ sở dữ liệu vectơ: Cô lập và kiểm tra cơ sở dữ liệu vectơ
- Tính toàn vẹn của bản sao lưu: Xác minh các bản sao lưu gần đây không bị xâm phạm
Giai đoạn 3: Điều tra (2-24 giờ)
Phân tích nhật ký
Thu thập và phân tích:
- Nhật ký yêu cầu/phản hồi API: Tất cả lệnh gọi LLM API có dấu thời gian
- Nhật ký xác thực: Các nỗ lực đăng nhập, sử dụng mã thông báo
- Nhật ký ứng dụng: Nhật ký máy chủ từ các dịch vụ xử lý AI
- Nhật ký mạng: Mẫu lưu lượng truy cập, IP nguồn
- Nhật ký hoạt động của người dùng: Ai đã truy cập nội dung và thời điểm
Phân tích vectơ tấn công
Prompt Insert
- Xác định các kiểu chèn
- Nguồn tiêm dấu vết
- Đánh giá tác động thao túng
- Kỹ thuật tấn công tài liệu
Truyền dữ liệu
- Xác định dữ liệu được truy cập
- Xác định phương pháp lấy cắp dữ liệu
- Đánh giá độ nhạy của dữ liệu
- Tính toán số lượng bản ghi
Thỏa hiệp tác nhân
- Xác định các hành động bị xâm phạm
- Sử dụng sai công cụ theo dõi
- Đánh giá quyền truy cập trái phép
- Di chuyển tài liệu theo chiều ngang
Bảo quản bằng chứng
- Tạo bản sao pháp y: Bản sao từng bit của các hệ thống bị ảnh hưởng
- Xác minh băm: Tính toán và ghi lại các hàm băm tệp
- Chuỗi hành trình sản phẩm: Tài liệu ai đã truy cập bằng chứng nào
- Lưu trữ an toàn: Lưu trữ bằng chứng ở vị trí an toàn, được kiểm soát quyền truy cập
- Tạo dòng thời gian: Xây dựng dòng thời gian sự cố chi tiết
Giai đoạn 4: Khắc phục (24-72 giờ)
Sửa lỗi ngay lập tức
Lỗ hổng LLM
- Vá các khoảng trống xác thực đầu vào
- Cập nhật lọc nội dung
- Tăng cường vệ sinh đầu ra
- Thêm tính năng phát hiện tiêm
Các vấn đề về tác nhân
- Giảm quyền của tác nhân
- Thêm quy trình phê duyệt
- Thực hiện các ranh giới chặt chẽ hơn
- Cập nhật các biện pháp kiểm soát quyền truy cập công cụ
Khắc phục cơ sở hạ tầng
- Đặt lại thông tin xác thực: Buộc đặt lại mật khẩu, xoay vòng tất cả các khóa API
- Truy cập đánh giá: Kiểm tra và dọn sạch các quyền
- Tăng cường mạng: Cập nhật quy tắc tường lửa, mạng phân đoạn
- Theo dõi cập nhật: Tăng cường giám sát bằng các quy tắc phát hiện mới
- Xác minh dự phòng: Xác minh các bản sao lưu sạch, khôi phục thử nghiệm
Giai đoạn 5: Thông báo & Báo cáo
Báo cáo nội bộ
- Tóm tắt điều hành: Tổng quan về sự cố dài 1 trang dành cho lãnh đạo
- Báo cáo kỹ thuật: Phát hiện kỹ thuật chi tiết cho nhóm bảo mật
- Dòng thời gian: Hoàn thành dòng thời gian sự cố với các sự kiện chính
- Bài học rút ra: Điều gì đã diễn ra tốt đẹp, điều gì cần cải thiện
- Các mục hành động: Nhiệm vụ cụ thể với chủ sở hữu và thời hạn
Thông báo bên ngoài
Các cơ quan quản lý
- GDPR: Thông báo 72 giờ cho DPA
- Đạo luật AI của EU: Báo cáo cho cơ quan có thẩm quyền
- Các cơ quan quản lý ngành (tài chính, y tế)
- Luật thông báo vi phạm của tiểu bang
Các bên bị ảnh hưởng
- Thông báo cho khách hàng (nếu dữ liệu bị ảnh hưởng)
- Thông báo đối tác kinh doanh
- Tiết lộ CVE (nếu có)
- Tiết lộ công khai (nếu cần)
Giai đoạn 6: Hoạt động sau sự cố
Phân tích nguyên nhân gốc
- 5 Phân tích lý do tại sao: Đi sâu vào nguyên nhân gốc rễ
- Lập bản đồ đường dẫn tấn công: Làm thế nào kẻ tấn công thành công?
- Kiểm soát lỗi: Các biện pháp kiểm soát nào không hoạt động?
- Các lỗ hổng phát hiện: Tại sao điều này không được phát hiện sớm hơn?
- Vấn đề về quy trình: Quy trình phản hồi không thành công ở đâu?
Các hành động cải tiến
Kỹ thuật
- Thực hiện các biện pháp kiểm soát bảo mật còn thiếu
- Cập nhật các quy tắc phát hiện
- Vá lỗ hổng
- Tăng cường giám sát
Quy trình
- Cập nhật quy trình ứng phó sự cố
- Cải thiện giao thức liên lạc
- Tăng cường chương trình đào tạo
- Sách hướng dẫn ghi tài liệu mới
Phòng ngừa
- Thử nghiệm nhóm đỏ
- Bài tập trên bảng
- Đào tạo nâng cao nhận thức về bảo mật
- Đánh giá kiến trúc
Tham khảo nhanh về trường hợp khẩn cấp
Hành động xảy ra sự cố nghiêm trọng
- Xoay khóa API ngay lập tức
- Vô hiệu hóa các điểm cuối bị ảnh hưởng
- Bảo toàn tất cả nhật ký
- Thông báo cho CISO trong vòng 15 phút
- Bắt đầu thu thập bằng chứng
Liên hệ nâng cao
- Nhóm bảo mật: [Slack nội bộ #]
- Kỹ sư trực: [nhiệm vụ nhắn tin]
- CISO: [đường trực tiếp]
- Pháp lý: [legal@company]
- PR/Communications: [pr@company]
Danh sách kiểm tra chuẩn bị trước sự cố
- Playbooks: Quy trình ứng phó sự cố được ghi lại bằng tài liệu cho các sự cố AI phổ biến
- Nhóm: Nhóm ứng phó sự cố đã được đào tạo với các vai trò xác định
- Công cụ: Các công cụ ghi nhật ký, giám sát và điều tra đã sẵn sàng
- Giao tiếp: Danh sách liên hệ và đường dẫn leo thang được ghi lại
- Thực hành: Các bài tập và mô phỏng thông thường trên máy tính bảng
- Lưu giữ: Lưu giữ nhật ký đầy đủ (khuyến nghị hơn 90 ngày)
- Sao lưu: Các bản sao lưu đã được xác minh bằng các quy trình khôi phục đã được thử nghiệm