
로컬 LLM에게 테트리스를 만들게 했더니 54초 만에 단번에 작동한 이야기 (Gemma 4 MTP × Claude Code)
요약
Gemma 4 26B MTP 모델과 Claude Code를 연계하여 로컬 환경에서 테트리스 게임을 제작한 검증 결과입니다. MTP 기술을 통해 초당 90토큰 이상의 빠른 속도로 단 54초 만에 버그 없는 완성된 코드를 생성했습니다.
핵심 포인트
- Gemma 4 MTP 모델 활용 시 로컬에서도 초당 90토큰 이상의 빠른 생성 속도 구현
- Claude Code의 커스텀 프로바이더 설정을 통해 로컬 LLM과 에이전트 기능 연동 가능
- 제로 베이스 상태에서 54초 만에 HTML/CSS/JS 파일 3개를 완벽히 생성
- 로컬 환경에서도 복잡한 게임 로직을 버그 없이 단번에 구현하는 성능 확인
서론

로컬 LLM의 성능은 어디까지 진화했을까요?
이번에는 얼마 전 큰 화제를 모았던 「Gemma 4 26B (MTP 버전)」를 로컬 환경에서 구동하고, AI 에이전트 도구인 「Claude Code」와 연계하여 「브라우저에서 즐길 수 있는 테트리스」를 제로 베이스에서 만들어 보게 한 검증 결과를 보고합니다.
결론부터 말씀드리면, 어떠한 버그도 없이 단 54초 만에 테트리스가 완성되었습니다.
검증 환경 및 사용 도구
LLM 서버: llama.cpp (Gemma 4 26B A4B Q4_K_XL + MTP Drafter Q8_0) -
AI 코딩 에이전트: Claude Code -
머신 환경: VRAM 16GB 환경 (RTX 5060 Ti 등)
지난 기사에서도 소개했듯이, MTP (Multi-Token Prediction)를 활성화한 Gemma 4는 로컬 환경에서도 초당 90토큰 이상의 폭발적인 생성 속도를 자랑합니다.
Claude Code와의 연계 설정

Claude Code는 통상적으로 Anthropic사의 API를 사용하지만, 커스텀 프로바이더로서 로컬의 llama-server (호환 API)를 지정하는 것이 가능합니다.
이를 통해 AI 스스로 명령을 실행하거나 파일을 자동 생성하는 에이전트 기능을 완전 무료로 로컬 LLM에서 실행할 수 있습니다.
검증 1: 테트리스를 제로 베이스에서 만들어 보기
곧바로 다음과 같은 프롬프트를 입력해 보았습니다.
"브라우저에서 즐길 수 있는 테트리스를 만들어줘. 도구를 사용하여 index.html, style.css, script.js 3개의 파일을 생성하고 저장해줘."
명확하게 "도구를 사용하여 저장하라"고 지시함으로써, Claude Code가 직접 파일을 써 내려갑니다.
경악스러운 생성 속도

백그라운드에서 작동 중인 llama-server의 로그를 확인하니, 생성 속도는 초당 90토큰 이상이었습니다.
클라우드 API의 경우 혼잡 시의 제한이나 통신 지연으로 인해 생성이 느려지는 경우가 있지만, 로컬 MTP라면 이 폭발적인 속도 그대로 안정적으로 출력을 계속할 수 있습니다.
결과적으로, 단 54초 만에 3개 파일의 생성과 저장이 완료되었습니다.
동작 확인: 단번에 작동하는가?

생성된 index.html을 브라우저에서 열어보니…… 무려, 버그 없이 완벽하게 동작했습니다!
블록의 회전, 라인 제거, 스코어 계산까지 테트리스의 기본 로직이 모두 올바르게 구현되어 있었습니다. 로컬 모델이 이를 단번에 클리어하다니, 정말 무서운 진화입니다.
검증 2: 오리지널 기능 (방해 블록) 추가
베이스가 단번에 만들어졌기에, 더욱 난이도 높은 요구를 던져 보았습니다.
"새로운 기능으로 '방해 블록 해프닝 모드'를 추가해 주세요. 일정 시간마다 통상적으로 조작하는 블록과는 별개로, 방해 블록이 무작위 위치에서 고속으로 낙하하는 사양으로 만들어 주세요."
일반적인 테트리스는 "항상 하나의 블록만 떨어진다"는 설계이지만, 다른 블록을 독립적으로 떨어뜨리려면 메인 루프(Main Loop)의 근본적인 확장이 필요합니다.
AI의 장고와 궤도 수정
1회차 실행에서는 역시 난이도가 너무 높았던 탓인지 AI가 코드 수정 지점을 좁히지 못하고, 8분 동안 끊임없이 추론 루프에 빠져버렸습니다.
그래서 일단 프로세스를 취소하고, 완전히 동일한 프롬프트를 다시 한번 던져 보았습니다.
그러자 이번에는 훌륭하게 방침을 정한 듯, 단 2분 만에 코드 수정을 완료해 버렸습니다.
동작 확인: 카오스한 해프닝 모드의 완성

다시 브라우저를 새로고침하여 플레이해 보니, 플레이 도중 갑자기 조작 불가능한 다른 블록이 하늘에서 떨어져 내려와 판에 박혔습니다!
"떨어진 블록이 판에 파고들어 있다"는 다소 해학적인 모습의 버그는 있었지만, 게임 진행(메인 루프) 자체는 망가지지 않고 완전히 다른 오브젝트를 병행하여 낙하시키는 고도의 요구 사항을 멋지게 실현해 냈습니다.
요약
"AI에게 코딩을 시키려면 클라우드 API를 써야 한다"는 상식이 급격히 뒤집히고 있습니다.
Gemma 4와 같은 고성능 모델과 MTP의 조합을 통해, 로컬 환경에서도 실용적인 AI 에이전트를 폭발적인 속도로 구동할 수 있는 시대가 도래했습니다.
여러분도 꼭 자신만의 로컬 AI 프로그래머를 소환하여 오리지널 게임 제작에 도전해 보세요!
영상으로 더 자세히 보기
본 기사의 내용은 YouTube 영상에서도 실제 화면의 움직임과 함께 전달하고 있습니다. 꼭 함께 시청해 주세요!
Discussion

AI 자동 생성 콘텐츠
본 콘텐츠는 Zenn AI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기