Kiểm định bảo mật AI (ai-security)
Skill chuyên đánh giá bảo mật hệ thống AI/LLM: dò prompt injection, jailbreak, rủi ro model inversion, data poisoning và lạm dụng tool của agent, ánh xạ theo MITRE ATLAS.
Bảo mật · ReviewNâng cao★ 24,151⑂ 3,405Điểm AI 8/10Cập nhật lần cuối: 9 thg 8, 2026
Làm được gì
- Dò các dấu hiệu prompt injection (ghi đè role, trích xuất system prompt, lạm dụng tool...) kèm mức nghiêm trọng và mã kỹ thuật MITRE ATLAS.
- Tính điểm rủi ro model inversion theo mức truy cập (black/gray/white-box) và data poisoning theo phạm vi fine-tuning.
- Đề xuất guardrail tương ứng: lọc đầu vào, lọc đầu ra (PII, rò rỉ system prompt), cổng phê duyệt của con người cho tool.
- Cung cấp 3 workflow (quét nhanh 20 phút, đánh giá đầy đủ, cổng chặn trong CI/CD) và 7 anti-pattern cần tránh.
Phù hợp với ai
- Đội phát triển sản phẩm LLM cần rà soát bảo mật trước khi mở cho người dùng thật.
- Kỹ sư bảo mật xử lý rủi ro injection gián tiếp trong hệ thống RAG và agent có tool.
- Chuyên gia AppSec/red team cần báo cáo độ phủ theo khung MITRE ATLAS.
Ví dụ sử dụng
- "Quét chatbot trước khi phát hành" → chạy scanner với prompt mẫu và file prompt theo domain, chặn deploy nếu overall_risk = critical.
- "Đánh giá rủi ro đầu độc dữ liệu cho pipeline fine-tune" → nhận điểm rủi ro theo fine-tuning/RLHF/RAG và biện pháp truy xuất nguồn gốc dữ liệu.
- "Rà soát agent có quyền xoá file" → bảng vector tấn công tool cùng thiết kế cổng phê duyệt, validate tham số và audit log.
· · · Hướng dẫn cài đặt · · ·
Dùng thử ngay, không cần cài
Dán đoạn dưới vào Claude là dùng được skill này mà không cần cài đặt.
Hãy đọc hướng dẫn trong tệp này và làm theo để giúp mình: https://raw.githubusercontent.com/alirezarezvani/claude-skills/HEAD/.gemini/skills/ai-security/SKILL.md Mình muốn: (viết việc bạn cần ở đây)
Nếu Claude không mở được liên kết, hãy mở liên kết và copy nội dung vào rồi dán.
↓ Thấy hữu ích thì tải ZIP bên dưới và cài. Sau đó skill tự chạy, không phải dán lại mỗi lần.
Cài vào ứng dụng Claude (không cần terminal)
- Tải tệp ZIP bằng nút bên dưới.
- Trong Claude, mở Settings → Capabilities và bật 'Code execution and file creation'. (chỉ một lần)
- Vào Customize → Skills → + → 'Upload a skill' rồi tải tệp ZIP lên.
Cài vào Claude Code
Để Claude làm — dán câu dưới đây vào Claude Code
Hãy cài skill mình tìm thấy trên Claude Skill Mart. Copy thư mục .gemini/skills/ai-security từ repo GitHub alirezarezvani/claude-skills vào ~/.claude/skills/ai-security/ của mình. Sau khi cài xong, cho mình biết skill này làm được gì trong một câu.
Cài bằng lệnh thủ công
git clone https://github.com/alirezarezvani/claude-skills.git && mkdir -p ~/.claude/skills && cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/ai-security⚠ Đây là skill do người khác tạo. Hãy kiểm tra repo gốc trước khi cài.
- Mở terminal.
- Clone repo:
git clone https://github.com/alirezarezvani/claude-skills.git - Tạo thư mục skill:
mkdir -p ~/.claude/skills - Copy skill:
cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/ai-security - Kiểm tra nội dung:
ls ~/.claude/skills/ai-security— xem cóSKILL.md,scripts/ai_threat_scanner.py,references/không (nếu thiếu script, bạn vẫn dùng được phần phương pháp luận). - Đảm bảo có Python 3:
python3 --version(nên cài thêmjqđể đọc kết quả JSON). - Khởi động lại Claude Code và yêu cầu: "Đánh giá rủi ro prompt injection cho tính năng LLM của tôi".
Xem mã nguồn trên GitHub ↗Giấy phép: MIT