클로드스킬마트스킬 둘러보기바로 쓰는 문장영상으로 배우기터미널 사용법스킬이 뭐예요?
목록으로

영상 나레이션 TTS 합성기

타임스탬프가 붙은 narration.json을 구간별 음성 파일로 합성하고, 각 시간 창에 맞춰 속도·음량을 조정해 배치 메타데이터까지 만들어 주는 스킬입니다.

이미지·영상중급52997AI 점수 7/10마지막 업데이트: 2026. 9. 21.

무엇을 해주나

  • narration.json(각 구간의 start/end/narration)을 읽어 구간마다 개별 WAV를 생성합니다.
  • 각 음성이 지정된 시간 창에 들어가도록 말하기 속도를 동적으로 조정하고 라우드니스를 정리합니다.
  • 결과물로 tts_segments/*.wav와 배치 정보가 담긴 tts_meta.json(engine, 구간별 audio_path·시간·pause_after_ms 등)을 남깁니다.
  • 엔진은 기본 MiMo TTS(mimo-v2.5-tts), 선택적으로 Fish Audio(s2.1-pro-free) 또는 자체 호스팅 IndexTTS 엔드포인트를 명시 선택할 수 있습니다.
  • 텍스트·설정·WAV의 크기/수정시각이 모두 같을 때만 캐시를 재사용하므로, 원고를 고치면 영향받은 구간만 다시 생성됩니다.
  • --preserve-approved-text 모드에서는 승인된 원고를 임의로 줄이지 않고, 시간 창을 초과하면 증거(원문·실제 낭독문·길이)를 붙여 실패 처리합니다.

이런 분께 추천

  • 해설 영상·리캡 영상 파이프라인을 자동화하려는 크리에이터/편집자
  • MiMo 또는 Fish Audio API 키를 보유하고 중국어(또는 해당 엔진 지원 언어) 나레이션을 합성해야 하는 분
  • 더빙 품질 게이트(빈 줄·겹침·길이 초과 검사)를 파이프라인에 넣고 싶은 팀

활용 예시

  1. 컷 편집이 끝난 영상의 narration.json을 넣고 python3 scripts/voiceover.py --work-dir work --narration work/narration.json으로 구간 음성 일괄 생성.
  2. MiMo 키가 없을 때 TTS_PROVIDER=fish-audio, FISH_API_KEY를 설정해 Fish Audio 음색으로 대체 합성.
  3. 검수가 끝난 확정 원고는 --preserve-approved-text로 돌려, 시간 초과 시 자동 축약 대신 실패 리포트를 받아 원고를 직접 수정.

· · · 설치 가이드 · · ·

설치 없이 지금 한 번 써보기

아래를 Claude에 붙여넣으면 설치하지 않고도 이 스킬을 그대로 씁니다.

이 파일의 지시를 읽고 그대로 따라서 나를 도와줘:
https://raw.githubusercontent.com/zenstory-ai/video-recap-skills/HEAD/skills/video-voiceover/SKILL.md

내가 원하는 것: (여기에 하고 싶은 일을 쓰세요)

Claude가 링크를 열지 못하면, 링크를 직접 열어 내용을 복사해 붙여넣으세요.

쓸 만하면 아래에서 ZIP을 받아 설치하세요. 그러면 매번 붙여넣지 않아도 알아서 작동합니다.

Claude 앱에 설치 (터미널 필요 없음)
  1. 아래 버튼으로 ZIP 파일을 받으세요.
  2. Claude 설정 → Capabilities에서 '코드 실행 및 파일 생성'을 켭니다. (한 번만)
  3. Claude에서 Customize → Skills → + → '스킬 업로드'를 누르고 받은 ZIP을 올립니다.
ZIP 내려받기
Claude Code에 설치

Claude에게 맡기기 — 아래 문장을 Claude Code에 붙여넣으세요

클로드스킬마트에서 찾은 스킬을 설치해줘.
GitHub 저장소 zenstory-ai/video-recap-skills 의 skills/video-voiceover 폴더를 내 ~/.claude/skills/video-voiceover/ 에 그대로 복사해줘.
설치가 끝나면 이 스킬로 무엇을 할 수 있는지 한 줄로 알려줘.

직접 명령으로 설치하기

git clone https://github.com/zenstory-ai/video-recap-skills.git && mkdir -p ~/.claude/skills && cp -r video-recap-skills/skills/video-voiceover ~/.claude/skills/

제3자가 만든 스킬입니다. 설치 전 원본 저장소를 한 번 확인하세요.

  1. 터미널을 열고 작업 폴더로 이동합니다.
  2. 저장소를 내려받습니다: git clone https://github.com/zenstory-ai/video-recap-skills.git
  3. 스킬 폴더를 만듭니다: mkdir -p ~/.claude/skills
  4. 스킬을 복사합니다: cp -r video-recap-skills/skills/video-voiceover ~/.claude/skills/
  5. Python 3와 필요한 오디오 도구(ffmpeg 등)가 설치돼 있는지 확인합니다.
  6. API 키를 환경변수로 등록합니다: export MIMO_API_KEY=... (또는 export TTS_PROVIDER=fish-audio; export FISH_API_KEY=...).
  7. Claude Code를 재시작한 뒤 "이 narration.json으로 해설 음성 만들어줘"처럼 요청하면 스킬이 호출됩니다.