Show GN: source-to-explainer-video - PR·책·함수를 3분 설명 영상으로 만들어 주는 에이전트 스킬
요약
AI 에이전트 스킬 'source-to-explainer-video'는 PR, 책의 절, 함수 등 원본 콘텐츠를 3분 내외의 설명 영상으로 자동 생성합니다. 이 스킬은 Gemini TTS와 Pillow/ffmpeg 등을 활용하여 나레이션과 시각 자료(MP4)를 제작하며, 특히 코드 실행 흐름을 디버거처럼 보여주어 이해도를 높이는 데 초점을 맞춥니다.
핵심 포인트
- PR, 책 절, 함수 등 원본 콘텐츠를 영상으로 자동 설명
- Gemini TTS와 이미지 처리 라이브러리를 활용하여 MP4 생성
- 코드의 동작 흐름을 시각화하여 집중력과 이해도 향상
- 영상은 보조 수단이며, 최종적인 사실 확인 과정이 중요함
안녕하세요.
AI가 만든 PR이나 책 한 절, 함수 하나를 3분 안팎의 나레이션 설명 영상으로 만들어 주는
에이전트 스킬 source-to-explainer-video를 소개합니다.
요즘 개발은 대부분 에이전트에게 맡기고 있어요.
스펙을 주고 루프를 돌리면 PR이 금방 올라옵니다.
그런데 리뷰는 여전히 제 몫이라, 하루에 볼 수 있는 양보다 올라오는 PR이 더 많아지더라고요.
(diff를 열어도 어디부터 봐야 할지 모르겠는 날도 많고요..)
생각해 보면 진짜 병목은 코드를 만드는 속도가 아니라 제 집중력이더라고요.
하루에 온전히 집중할 수 있는 시간이 네 시간 정도라면, AI 덕분에 만드는 속도는 빨라졌어도 이해하는 데 쓸 수 있는 시간은 그대로예요.
그래서 "어떻게 더 빨리 읽을까"보다 "읽기 전에 큰 그림을 먼저 잡아서 집중력을 아낄 수는 없을까"를 고민하게 됐습니다.
Claude Code나 Codex에 "이 PR이 바꾼 동작을 영상으로 설명해 줘"라고 하면,
- 원본(커밋, 파일 해시)을 고정하고
- 장면을 나눠 Gemini TTS로 나레이션을 입히고
- Pillow + ffmpeg로 MP4를 만든 뒤
- 설명이 원본과 맞는지, 영상 파일이 멀쩡한지 따로 검사합니다.
설명 방식은 원본에 따라 세 가지예요.
스킬 레포 README에 예제마다 GIF와 전체 영상(한국어·영어)을 올려 뒀습니다.
- 책·논문 → 장면마다 주장 하나, 그림 하나 (성당과 시장)
- PR·저장소 → 요청이 지나가는 흐름을 그림으로 (YC의 QM)
- 함수 → 실제로 실행하면서 줄마다 변수 값을 기록해 디버거처럼
3번에 나오는 변수 값은 AI가 쓴 게 아니라, 함수를 실제로 돌리면서 찍어 둔 값이에요.
AI가 값을 하나라도 지어내면 검사에 걸려서 영상이 아예 안 만들어집니다.
영상만 보고 코드를 다 이해할 수는 없습니다.
대신 영상을 보고 나면 어디를 모르는지, 어디부터 확인해야 하는지가 먼저 정리돼요.
저는 영상을 보면서 모르거나 확인할 건 메모해두고,
제가 유추해서 사실을 기록해두고, 다시 AI에게 맞는지 사실 확인을 합니다.
이러면 좀 더 기억에 잘 남고, 파악이 빨라지는 것 같아요.
써 보시고 의견 주시면 감사하겠습니다.
AI 자동 생성 콘텐츠
본 콘텐츠는 GeekNews의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기