Frugal 개발: Claude Code 작업을 수행 가능한 가장 저렴한 모델로 라우팅하는 플러그인
요약
Claude Code 사용 시 작업 성격에 따라 가장 저렴한 모델로 라우팅하여 비용을 절감하는 'Frugal' 플러그인을 소개합니다. 단순 작업은 Haiku나 셸 명령으로 처리하고, 복잡한 작업만 상위 모델로 에스컬레이션하여 효율성을 극대화합니다.
핵심 포인트
- 작업 유형별(추출, 편집, 설계 등) 최적의 모델 자동 라우팅
- 실제 검증 실패 시에만 상위 모델로 에스컬레이션하여 비용 낭비 방지
- 예산 초과 방지를 위한 인라인 검색 호출 계산 및 티어 차단 기능
- 사용자 기기 외부로 데이터를 전송하지 않는 프라이버시 중심 설계
- 세션별 예상 절감액을 포함한 상세 비용 보고서 제공
세션 내에서 에이전트가 수행하는 작업의 대부분은 추론 (Reasoning)이 아닙니다. 파일 위치 찾기, 로그 읽기, 문서에서 필드 추출하기, 기계적인 편집 등입니다. 이러한 작업에 Opus/Fable 요율을 지불하는 것은 돈을 불태우는 것과 같습니다. Frugal은 메인 모델을 라우터 (Router)로 전환하는 Claude Code 플러그인입니다. 각 하위 작업 (Sub-task)은 성공할 수 있는 가장 저렴한 티어 (Tier)로 전달됩니다:
- 질문에 답할 수 있는 경우, 모델 호출을 전혀 하지 않고 일반 셸 명령 (grep, jq, git) 사용
- 위치 찾기 및 추출 작업을 위한 Haiku 워커 (Worker)
- 명세서 (Spec) 기반의 기계적 편집을 위한 Sonnet 워커
- 설계, 디버깅, 리뷰를 위한 메인 모델
- Fable은 오직 에스컬레이션 (Escalation) 상한선으로만 사용
이 시스템은 저렴한 모델이 스스로 의구심을 보고할 때가 아니라, 실제 검증 (테스트, 컴파일러, 스키마)이 실패했을 때만 상위 티어로 에스컬레이션합니다. 작업이 표류하지 않고 유지되도록 만드는 것은 두 가지 훅 (Hook)입니다. 하나는 메인 루프 내의 인라인 검색 호출을 계산하여 예산을 초과하면 위임하도록 지시합니다. 다른 하나는 비용이 많이 드는 티어를 강제로 차단할 수 있습니다. 두 방식 모두 실패 시 개방 (Fail open) 방식으로 작동합니다. 워커 실행당 로컬 라인 한 줄을 로그로 남기며, 티어 구성, 에스컬레이션 비율, 그리고 세션의 메인 모델 대비 예상 절감액을 포함한 비용 보고서를 제공합니다. 텔레메트리 (Telemetry)는 없으며, 아무것도 사용자의 기기를 떠나지 않습니다. 설치는 두 개의 명령어로 가능합니다. 피드백을 환영합니다! https://thomaslangbroek.github.io/frugal/ submitted by /u/StolenDrinks [link] [comments]
AI 자동 생성 콘텐츠
본 콘텐츠는 r/ClaudeAI의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기