AI 보안 점검 (ai-security)
LLM·AI 시스템의 프롬프트 인젝션, 탈옥, 모델 인버전, 데이터 오염, 에이전트 툴 남용 위험을 MITRE ATLAS 기준으로 진단하는 스킬.
보안·리뷰고급★ 24,151⑂ 3,405AI 점수 8/10마지막 업데이트: 2026. 8. 9.
무엇을 해주나
일반 웹 취약점 점검이 아니라 AI/ML 시스템 전용 보안 평가를 담당합니다.
- 프롬프트 인젝션 시그니처 탐지(역할 덮어쓰기, 간접 인젝션, 시스템 프롬프트 탈취, 툴 남용 등)
- 탈옥(jailbreak) 유형 분류와 저항성 테스트 절차
- 접근 수준(black/gray/white-box)별 모델 인버전 위험 점수
- 파인튜닝 범위별 데이터 포이즌닝 위험 점수
- 발견 항목을 MITRE ATLAS 기법(AML.T0051, T0056, T0020 등)에 매핑
- 입력·출력·에이전트 단계별 가드레일 설계 패턴과 안티패턴 7가지
scripts/ai_threat_scanner.pyCLI로 프롬프트 파일 스캔 및 종료 코드 기반 배포 차단
이런 분께 추천
- LLM 기능을 사용자에게 공개하기 전 보안 점검이 필요한 개발팀
- RAG·에이전트(툴 호출) 시스템을 운영하며 간접 인젝션이 걱정되는 엔지니어
- AI 레드팀, AppSec, 보안 컴플라이언스 담당자
- CI/CD에 적대적 프롬프트 테스트 게이트를 넣고 싶은 플랫폼 팀
활용 예시
- 출시 전 20분 스캔: 블랙박스 LLM에 내장 시드 프롬프트를 돌려
overall_risk를 확인하고, critical이면 배포 중단. - RAG 인덱스 점검: 검색된 외부 문서를 신뢰하지 않는 입력으로 취급하도록 간접 인젝션 패턴을 점검하고 인덱싱 전 검증 규칙을 설계.
- CI 게이트 구성:
tests/adversarial_prompts.json을 스캔해 리포트를 만들고, 위험도가 critical이면 파이프라인을 실패시키는 스크립트 작성.
· · · 설치 가이드 · · ·
Claude 앱에 설치 (터미널 필요 없음)
- 아래 버튼으로 ZIP 파일을 받으세요.
- Claude 설정 → Capabilities에서 '코드 실행 및 파일 생성'을 켭니다. (한 번만)
- Claude에서 Customize → Skills → + → '스킬 업로드'를 누르고 받은 ZIP을 올립니다.
Claude Code에 설치
Claude에게 맡기기 — 아래 문장을 Claude Code에 붙여넣으세요
클로드스킬마트에서 찾은 스킬을 설치해줘. GitHub 저장소 alirezarezvani/claude-skills 의 .gemini/skills/ai-security 폴더를 내 ~/.claude/skills/ai-security/ 에 그대로 복사해줘. 설치가 끝나면 이 스킬로 무엇을 할 수 있는지 한 줄로 알려줘.
직접 명령으로 설치하기
git clone https://github.com/alirezarezvani/claude-skills.git /tmp/claude-skills && mkdir -p ~/.claude/skills && cp -r /tmp/claude-skills/.gemini/skills/ai-security ~/.claude/skills/⚠ 제3자가 만든 스킬입니다. 설치 전 원본 저장소를 한 번 확인하세요.
- 터미널을 엽니다.
- 저장소를 내려받습니다:
git clone https://github.com/alirezarezvani/claude-skills.git - 스킬 폴더를 만듭니다:
mkdir -p ~/.claude/skills - 스킬을 복사합니다:
cp -r claude-skills/.gemini/skills/ai-security ~/.claude/skills/ ls ~/.claude/skills/ai-security로 SKILL.md가 있는지 확인합니다.scripts/ai_threat_scanner.py와references/atlas-coverage.md가 함께 복사됐는지도 확인하세요(없다면 저장소 내 다른 경로를 검색).- Claude Code를 다시 시작한 뒤 "우리 LLM 기능 프롬프트 인젝션 점검해줘"처럼 요청하면 스킬이 활성화됩니다.
- gray-box/white-box 테스트는 반드시 서면 승인을 받은 뒤
--authorized옵션으로 실행하세요.
GitHub에서 원본 보기 ↗라이선스: MIT