AI 보안 점검 (ai-security)
LLM·분류기·에이전트를 대상으로 프롬프트 인젝션, 탈옥, 모델 인버전, 데이터 포이즈닝 위험을 점검하고 MITRE ATLAS로 매핑해주는 AI 전용 보안 스킬.
보안·리뷰고급★ 24,151⑂ 3,405AI 점수 8/10마지막 업데이트: 2026. 8. 9.
무엇을 해주나
- 프롬프트 인젝션 시그니처(역할 무시, 시스템 프롬프트 추출, 도구 남용 등)를 정적 매칭으로 탐지하고 심각도·ATLAS 기법 ID를 붙여줍니다.
- 접근 수준(black/gray/white-box)에 따른 모델 인버전 위험, 파인튜닝 범위에 따른 데이터 포이즈닝 위험을 점수로 산출합니다.
- 발견 항목별로 입력 검증·출력 필터링·에이전트 도구 승인 게이트 등 가드레일 설계 패턴을 제안합니다.
- 20분 퀵 스캔, 전체 평가, CI/CD 배포 게이트까지 3가지 워크플로와 7가지 안티패턴을 제공합니다.
이런 분께 추천
- LLM 기능을 사용자에게 노출하기 전 보안 검토가 필요한 AI 제품/플랫폼 개발자
- RAG·에이전트 시스템의 간접 인젝션과 도구 남용 리스크를 정리해야 하는 보안 엔지니어
- MITRE ATLAS 기준으로 AI 위협 커버리지 리포트를 만들어야 하는 AppSec·레드팀 담당자
활용 예시
- "우리 챗봇을 출시 전에 인젝션 스캔해줘" → 내장 시드 프롬프트 + 도메인 프롬프트 파일로 스캔, overall_risk가 critical이면 배포 중단 판단.
- "파인튜닝 파이프라인 포이즈닝 위험 평가해줘" → 파인튜닝/RLHF/RAG 범위별 위험 점수와 데이터 출처 추적·검증 대책 제시.
- "파일 삭제 툴을 쓰는 에이전트 리스크 정리해줘" → 도구 남용 벡터 표와 사람 승인 게이트·파라미터 검증·감사 로그 설계안 제공.
· · · 설치 가이드 · · ·
설치 없이 지금 한 번 써보기
아래를 Claude에 붙여넣으면 설치하지 않고도 이 스킬을 그대로 씁니다.
이 파일의 지시를 읽고 그대로 따라서 나를 도와줘: https://raw.githubusercontent.com/alirezarezvani/claude-skills/HEAD/.gemini/skills/ai-security/SKILL.md 내가 원하는 것: (여기에 하고 싶은 일을 쓰세요)
Claude가 링크를 열지 못하면, 링크를 직접 열어 내용을 복사해 붙여넣으세요.
↓ 쓸 만하면 아래에서 ZIP을 받아 설치하세요. 그러면 매번 붙여넣지 않아도 알아서 작동합니다.
Claude 앱에 설치 (터미널 필요 없음)
- 아래 버튼으로 ZIP 파일을 받으세요.
- Claude 설정 → Capabilities에서 '코드 실행 및 파일 생성'을 켭니다. (한 번만)
- Claude에서 Customize → Skills → + → '스킬 업로드'를 누르고 받은 ZIP을 올립니다.
Claude Code에 설치
Claude에게 맡기기 — 아래 문장을 Claude Code에 붙여넣으세요
클로드스킬마트에서 찾은 스킬을 설치해줘. GitHub 저장소 alirezarezvani/claude-skills 의 .gemini/skills/ai-security 폴더를 내 ~/.claude/skills/ai-security/ 에 그대로 복사해줘. 설치가 끝나면 이 스킬로 무엇을 할 수 있는지 한 줄로 알려줘.
직접 명령으로 설치하기
git clone https://github.com/alirezarezvani/claude-skills.git && mkdir -p ~/.claude/skills && cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/ai-security⚠ 제3자가 만든 스킬입니다. 설치 전 원본 저장소를 한 번 확인하세요.
- 터미널을 엽니다.
- 저장소를 내려받습니다:
git clone https://github.com/alirezarezvani/claude-skills.git - 스킬 폴더를 만듭니다:
mkdir -p ~/.claude/skills - 스킬을 복사합니다:
cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/ai-security ls ~/.claude/skills/ai-security로SKILL.md와scripts/ai_threat_scanner.py,references/존재 여부를 확인합니다(스크립트가 없으면 표 기반 방법론만 사용됩니다).- Python 3가 설치되어 있는지 확인합니다:
python3 --version(JSON 파싱 예시용jq도 권장). - Claude Code를 다시 시작하고 "우리 LLM 기능에 대해 프롬프트 인젝션 보안 점검해줘"처럼 요청하면 스킬이 발동합니다.
GitHub에서 원본 보기 ↗라이선스: MIT