클로드스킬마트스킬 둘러보기스킬이 뭐예요?
목록으로

AI 보안 점검 (ai-security)

LLM·AI 시스템의 프롬프트 인젝션, 탈옥, 모델 인버전, 데이터 오염, 에이전트 툴 남용 위험을 MITRE ATLAS 기준으로 진단하는 스킬.

보안·리뷰고급24,1513,405AI 점수 8/10마지막 업데이트: 2026. 8. 9.

무엇을 해주나

일반 웹 취약점 점검이 아니라 AI/ML 시스템 전용 보안 평가를 담당합니다.

  • 프롬프트 인젝션 시그니처 탐지(역할 덮어쓰기, 간접 인젝션, 시스템 프롬프트 탈취, 툴 남용 등)
  • 탈옥(jailbreak) 유형 분류와 저항성 테스트 절차
  • 접근 수준(black/gray/white-box)별 모델 인버전 위험 점수
  • 파인튜닝 범위별 데이터 포이즌닝 위험 점수
  • 발견 항목을 MITRE ATLAS 기법(AML.T0051, T0056, T0020 등)에 매핑
  • 입력·출력·에이전트 단계별 가드레일 설계 패턴과 안티패턴 7가지
  • scripts/ai_threat_scanner.py CLI로 프롬프트 파일 스캔 및 종료 코드 기반 배포 차단

이런 분께 추천

  • LLM 기능을 사용자에게 공개하기 전 보안 점검이 필요한 개발팀
  • RAG·에이전트(툴 호출) 시스템을 운영하며 간접 인젝션이 걱정되는 엔지니어
  • AI 레드팀, AppSec, 보안 컴플라이언스 담당자
  • CI/CD에 적대적 프롬프트 테스트 게이트를 넣고 싶은 플랫폼 팀

활용 예시

  1. 출시 전 20분 스캔: 블랙박스 LLM에 내장 시드 프롬프트를 돌려 overall_risk를 확인하고, critical이면 배포 중단.
  2. RAG 인덱스 점검: 검색된 외부 문서를 신뢰하지 않는 입력으로 취급하도록 간접 인젝션 패턴을 점검하고 인덱싱 전 검증 규칙을 설계.
  3. CI 게이트 구성: tests/adversarial_prompts.json을 스캔해 리포트를 만들고, 위험도가 critical이면 파이프라인을 실패시키는 스크립트 작성.

· · · 설치 가이드 · · ·

Claude 앱에 설치 (터미널 필요 없음)
  1. 아래 버튼으로 ZIP 파일을 받으세요.
  2. Claude 설정 → Capabilities에서 '코드 실행 및 파일 생성'을 켭니다. (한 번만)
  3. Claude에서 Customize → Skills → + → '스킬 업로드'를 누르고 받은 ZIP을 올립니다.
ZIP 내려받기
Claude Code에 설치

Claude에게 맡기기 — 아래 문장을 Claude Code에 붙여넣으세요

클로드스킬마트에서 찾은 스킬을 설치해줘.
GitHub 저장소 alirezarezvani/claude-skills 의 .gemini/skills/ai-security 폴더를 내 ~/.claude/skills/ai-security/ 에 그대로 복사해줘.
설치가 끝나면 이 스킬로 무엇을 할 수 있는지 한 줄로 알려줘.

직접 명령으로 설치하기

git clone https://github.com/alirezarezvani/claude-skills.git /tmp/claude-skills && mkdir -p ~/.claude/skills && cp -r /tmp/claude-skills/.gemini/skills/ai-security ~/.claude/skills/

제3자가 만든 스킬입니다. 설치 전 원본 저장소를 한 번 확인하세요.

  1. 터미널을 엽니다.
  2. 저장소를 내려받습니다: git clone https://github.com/alirezarezvani/claude-skills.git
  3. 스킬 폴더를 만듭니다: mkdir -p ~/.claude/skills
  4. 스킬을 복사합니다: cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/
  5. ls ~/.claude/skills/ai-security 로 SKILL.md가 있는지 확인합니다. scripts/ai_threat_scanner.pyreferences/atlas-coverage.md가 함께 복사됐는지도 확인하세요(없다면 저장소 내 다른 경로를 검색).
  6. Claude Code를 다시 시작한 뒤 "우리 LLM 기능 프롬프트 인젝션 점검해줘"처럼 요청하면 스킬이 활성화됩니다.
  7. gray-box/white-box 테스트는 반드시 서면 승인을 받은 뒤 --authorized 옵션으로 실행하세요.