freellmapi: 월간 74억 토큰 및 34개 무료 LLM 제공업체를 통합한 API
요약
FreeLLMAPI는 34개 이상의 무료 LLM 제공업체를 통합하고 OpenAI와 호환되는 단일 엔드포인트를 제공하는 API입니다. 이 라우터는 요청 시 최적의 모델을 선택하고, 속도 제한이나 할당량 초과 시 다른 제공업체로 자동으로 전환하여 안정적인 사용 환경을 구축합니다.
핵심 포인트
- 34개 이상의 무료 LLM 제공업체를 단일 엔드포인트로 통합
- OpenAI 호환 API를 통해 다양한 모델에 접근 가능
- 요청 실패 시 자동 라우팅 및 속도 제한 관리 기능 제공
- 최신 모델 카탈로그가 자동으로 업데이트되어 편리함
월 74억 개의 토큰. 34개의 무료 LLM 제공업체. 635개의 무료 모델 엔드포인트. OpenAI와 호환되는 단일 엔드포인트.
수십 개의 제공업체의 무료 티어를 통합하고, 사용자 정의된 OpenAI와 호환되는 채팅, 임베딩, 이미지 및 오디오 엔드포인트를 단일 /v1 API 뒤에 배치합니다. API 키는 암호화되어 저장됩니다. 라우터가 각 요청에 대해 최적의 사용 가능한 모델을 선택하고, 하나가 속도 제한(rate-limited)되면 다음 제공업체로 전환하며, 키별 사용량을 추적하여 모든 무료 티어 한도를 초과하지 않도록 합니다.
freellmapi.co · 전체 카탈로그 둘러보기: 474개 모델 패밀리, 635개 무료 엔드포인트
영어 · 简体中文
라우터는 자체적으로 서명된 피드(signed feed)에서 모델 카탈로그를 업데이트합니다. 새로운 무료 모델, 할당량 변경 및 호환성 수정 사항이 git pull 없이 적용됩니다.
무료 설치본은 월간 스냅샷을 받기 때문에, 모델이 라이브 피드에 추가된 후 30일 후에야 접근할 수 있습니다. 프리미엄 라우터는 당일에 접근할 수 있습니다.
freellmapi.co에서 사용 시작 ($19/년, 언제든지 취소 가능).
- 존재 이유
- 지원되는 제공업체
- 호환 가능한 CLI 및 코딩 에이전트
- 비교 방법
- 기능
- 빠른 시작
- 데스크톱 앱
- OpenAI와 호환되는 클라이언트에서 작동
- 언어
- 프리미엄 (실시간 카탈로그)
- API 사용하기
- 스크린샷
- 작동 방식
- FAQ
- 제한 사항
- 기여
- 면책 조항
가이드: 설치 및 배포 · API 레퍼런스 · 클라이언트 및 코딩 에이전트 · 프롬프트 압축 · 아키텍처 및 내부 구조 · 문서화 색인 · 기여자 가이드
모든 진지한 AI 연구소는 이제 무료 티어를 제공하며, 월 몇백만 토큰과 하루 수천 개의 요청을 할당합니다. 각 티어 자체로는 장난감에 불과합니다. 하지만 이들을 합치면 작고 빠른 모델부터 상당히 유능한 모델까지 474개 모델 패밀리 / 635개 제공업체 엔드포인트를 통해 작동 추론 용량으로 약 월 74억 개의 토큰을 확보하게 됩니다.
문제는 이것들을 수동으로 쌓아 올리는 것이 고통스럽다는 점입니다. 34개의 다른 SDK, 34개의 다른 속도 제한(rate limits), 요청이 실패할 수 있는 34개의 지점이 있습니다. FreeLLMAPI는 이 모든 것을 단일 OpenAI 호환 엔드포인트로 통합합니다. 어떤 OpenAI 클라이언트 라이브러리든 로컬 서버를 가리키게 하면, 사용자가 키를 추가한 어느 제공업체(provider)로든 투명하게 라우팅됩니다.
그리고 무료 티어 환경은 매주 변동합니다. 제공업체들은 모델을 출시하고, 폐기하며, 통지 없이 할당량(quota)을 변경합니다. FreeLLMAPI가 이 모든 것을 추적해 줍니다. 라우터는 자체적으로 freellmapi.co에서 서명된 모델 카탈로그를 가져오므로, 사용자의 설치 환경은 git pull 없이도 최신 상태를 유지할 수 있습니다.
Premium (실시간 카탈로그)을 확인하여 얼마나 빠르게 업데이트되는지 살펴보세요.
Google |
Groq |
Cerebras |
OpenCode Zen |
Mistral |
OpenRouter |
Cloudflare |
Cohere |
Z.ai (Zhipu) |
NVIDIA |
HuggingFace |
|
ModelScopeQwen3 · DeepSeek V4 · GLM-5 (Aliyun cn 바인딩 필요) |
… 및 22개 이상의 무료 제공업체
여기에 사용자 정의(custom) 제공업체가 추가됩니다. Keys 페이지에서 채팅, 임베딩, 이미지 또는 오디오 모델을 모든 OpenAI 호환 엔드포인트(llama.cpp, LM Studio, vLLM, 로컬 Ollama 또는 원격 게이트웨이)에 연결할 수 있습니다.
전체적이고 항상 최신 목록은 freellmapi.co/models에서 확인할 수 있으며, 여기에는 모델별 속도 제한, 컨텍스트 창(context windows), 그리고 무료 토큰 예산이 명시되어 있습니다.
Claude Code |
Codex CLI |
Gemini CLI |
Cursor |
Cline |
Roo Code |
OpenCode |
Aider |
… 그리고 Continue, Goose, Qwen Code, Kilo Code, Crush, Zed, JetBrains AI, DeepSeek Harness, MiMo Code, AtomCode, OpenClaw, Hermes Agent, Pi, Reasonix 및 모든 OpenAI 호환, Anthropic, Gemini 또는 Ollama 클라이언트
대부분의 에이전트는 라이브 카탈로그를 읽고, 기존 설정을 백업한 다음 병합하는 하나의 명령어로 자체 구성됩니다:
npx freellmapi setup-claude --url http://localhost:3001 --api-key <통합된-키>
지원되는 모든 에이전트 및 설정 명령어 → · 도구별 레시피, MCP 서버 및 URL 토큰 →
공개 문서를 기반으로 작성되었으며, 2026년 7월 기준입니다. 수정 사항을 환영합니다.
모든 OpenAI 스타일 엔드포인트—/v1/chat/completions,
/v1/responses (Codex CLI가 필요로 하는 것), /v1/completions (에디터의 고스트 텍스트 자동 완성), /v1/images/generations,
/v1/videos/generations,
/v1/audio/speech,
/v1/audio/transcriptions,
/v1/embeddings,
그리고 /v1/models
— 공식 SDK 또는 모든 OpenAI 호환 클라이언트에서 스트리밍 및 비스트리밍 방식으로 지원됩니다. API 참조 →Anthropic Messages API—/v1/messages는 Anthropic의 와이어 포맷을 동일한 라우터로 처리하므로, Claude Code와 공식 Anthropic SDK가 사용자의 무료 풀(free pool)을 통해 실행됩니다. 자세히 보기 →네이티브 Gemini + Ollama 엔드포인트—Gemini CLI는 /v1beta(generateContent, 스트리밍, 토큰 계산, 모델)를 사용할 수 있으며, 옵트인 Ollama 에뮬레이션은 Zed, JetBrains 및 기타 로컬 모델 클라이언트를 위해 NDJSON 채팅/생성, 태그, 메타데이터 및 임베딩을 제공합니다. Fusion (다중 모델 합성)—가상 fusion 모델을 요청하면 라우터가 프롬프트를 다양한 무료 모델 패널에 병렬로 분산하고, 이후 판단(judge) 모델이 초안들로부터 하나의 답변을 합성합니다. 자세히 보기 →이미지, 비디오 및 음성 생성—/v1/images/generations,
/v1/videos/generations,
그리고 /v1/audio/speech는 미디어 모델을 제공하는 공급자들을 통해 라우팅됩니다. 이미지와 음성은 사용자 지정 OpenAI 호환 미디어 엔드포인트를 수용합니다. 비디오 작업은 동기식 및 대기열 기반 공급자 전반에 걸쳐 정규화되며 완료된 MP4를 반환합니다.도구 호출 및 구조화된 출력—OpenAI 스타일의 tools는 공급자들 사이에서 왕복(round-trip)하며 (일반 텍스트 도구 호출은 실제 tool_calls로 복원됨), 또한 response_format, seed, logprobs도 지원합니다.
또한 penalties와 나머지 샘플링 파라미터는 제공업체별로 전달됩니다. 스마트 라우팅, 6가지 전략— 모델별 실시간 속도/역량/신뢰도 점수로 체인을 순위화하고; 자동 폴오버(fallover)는 429/5xx 오류 발생 시 쿨다운 및 키 로테이션과 함께 다음 모델을 재시도합니다. 라우팅 상세 정보 → 통합 모델 및 프로필— 여러 제공업체에 걸친 동일한 모델은 엄격한 그룹 내 폴오버(failover)를 통해 하나의 항목으로 통합됩니다; 이름 지정된 폴백 체인 프로필(코딩 체인, 비전 체인 등)은 대시보드 또는 요청별로 auto:<profile>을 통해 전환할 수 있으며, 커스텀 체인은 체인 관리자에서 제자리에서 이름을 변경할 수 있습니다. 키별 속도 추적— (플랫폼, 모델, 키)별 RPM/RPD/TPM/TPD 카운터를 제공하여 제공업체가 보고한 상한선을 학습하고, 라우팅이 항상 모든 제한치 미만으로 유지되도록 합니다. 셀프 업데이트 모델 카탈로그— 라우터는 하루에 두 번 freellmapi.co에서 서명된 카탈로그를 동기화합니다: 새로운 모델, 할당량 변경, 제공업체 특이사항 수정 사항 등이 자동으로 반영됩니다. 무료 설치본은 월간 스냅샷을 추적하며, 각 모델은 라이브 피드에 도착한 후 30일 후에 참여합니다; 프리미엄 라우터는 당일 정보를 얻습니다. 프리미엄 → 스티키 세션 및 컨텍스트 핸드오프— 대화가 30분 동안 한 모델에 머무르도록 유지되며, 선택적 압축 핸드오프 노트는 채팅 도중 전환이 발생했을 때 스레드를 일관되게 유지합니다. 상세 정보 → 프롬프트 압축 (선택 사항)— 공유된, 실패 시 열리는(fail-open) 요청 파이프라인은 프롬프트를 중복 제거하고, 도구 출력을 필터링하며, 반복되는 JSON을 압축하고, 캐시 검색 및 라우팅 전에 오래된 컨텍스트를 자릅니다. 상세 정보 → 암호화 키, 토큰 하나로— 제공업체 키는 SQLite에서 AES-256-GCM으로 암호화되고 요청별로 메모리 내에서 복호화됩니다; 사용자의 앱은 항상 단일 통합 freellmapi-...만 보게 됩니다.
bearer 토큰.관리자 대시보드 및 분석 — 키 관리, 체인 재정렬, 플레이그라운드 실행, 24시간~90일 간의 p50/p95/TTFT 분석 확인을 위한 React UI; 로그인 게이트, 다크/라이트 테마, 60개 언어.ChatGPT용 MCP 서버 및 대화형 문서 — ChatGPT 및 기타 MCP 클라이언트는 FreeLLMAPI 추론 호출, 사용 가능한 모델 목록 조회, 제공업체 상태/사용량/캐시/라우팅 메타데이터 검사, 그리고 /mcp를 통해 라우팅 전략을 관리할 수 있습니다.
; 의존성 없는 OpenAPI 뷰어가 /v1/docs에 위치합니다.
. ChatGPT 및 코딩 에이전트 →운영 편의 기능 — 옵트인 응답 캐시, 암호화된 DB 백업, 주기적인 키 상태 확인, 대량 키 가져오기/내보내기, 선언적 시작 구성. 설치 및 배포 →Node 20+가 실행되는 모든 곳에서 작동 — Windows, macOS, Linux 서버 또는 소형 ARM SBC(Raspberry Pi 포함). PM2 / systemd / 선호하는 어떤 감독 도구 뒤에서도 유휴 상태 시 약 40 MB RSS를 사용합니다.
범위는 의도적으로 좁습니다. 아직 지원되지 않는 기능을 확인해 보세요.
한 줄 명령어 (Docker 필요 — ~/freellmapi 설정, 암호화 키 생성, 이미지 풀링, 컨테이너 시작):
curl -fsSL https://freellmapi.co/install.sh | bash
bash로 파이프하기 전에 읽는 것을 선호하시나요? 스크립트는 여기에 있습니다. 재실행해도 안전합니다: .env (및 암호화 키)가 보존되고 컨테이너는 :latest로 업데이트됩니다.
.
http://localhost:3001을 열고 키(Keys) 페이지에 제공업체 키를 추가하고, 취향에 따라 폴백 체인(Fallback Chain) 순서를 재정렬한 다음, 키 페이지 헤더에서 통합 API 키를 가져옵니다. 이 통합 키가 OpenAI SDK가 가리킬 대상입니다.
Windows에서는 데스크톱 릴리스의 .exe 설치 프로그램(아래)이 가장 쉽습니다. Android에서는 실험적인 Termux 가이드를 참고하세요.
나머지 모든 것 — Docker Compose, 로컬 개발, 선언적 시작 구성, 프로덕션 빌드, LAN 액세스 및 백업 — 은 docs/en/install/01-install.md에 있습니다.
네이티브 메뉴바 앱은 desktop/에 위치합니다: 전체 라우터 + 대시보드가 트레이에서 로컬로 실행되며, 실시간 요청 통계를 보여주는 유리 같은 팝오버가 표시됩니다.
릴리스에서 다운로드 — macOS용 .dmg 파일과 Windows용 .exe 설치 프로그램이 모든 릴리스에 첨부되어 있습니다. 계정이나 비밀번호 설정이 필요하지 않습니다. 필요한 유일한 자격 증명은 트레이 팝오버에서 얻는 통합 API 키입니다. 소스 코드 빌드 단계와 데이터 저장 위치는 docs/en/install/01-install.md#desktop-app을 참고하세요.
macOS 12 Monterey 이상에서는 arm64 (Apple Silicon) 또는 x64 (Intel) 중 하나를 선택하세요. 두 Mac 빌드 모두 ZIP 다운로드를 포함합니다.
OpenAI와 호환되는 기본 URL을 대상으로 할 수 있는 모든 것이 작동합니다: 대시보드에서 얻은 통합 키를 사용하여 이를 http://localhost:3001/v1로 설정하세요. 모든 생성기는 --dry-run을 지원합니다.
npx freellmapi launch (Claude Code) 및 launch-codex (Codex)는 자격 증명을 구성 파일에서 완전히 분리합니다. 라우터는 또한 에이전트가 세션 중간에 내부 검사(introspect)할 수 있는 MCP 서버 역할도 수행합니다.
ChatGPT는 비공개 Secure MCP 터널을 통해 동일한 로컬 라우터에 연결됩니다. ask_freellmapi MCP 도구는 ChatGPT가 요청한 작업을 /v1/chat/completions를 통해 라우팅하고, served-model, fallback, cache, execution 및 토큰 메타데이터와 함께 답변을 반환합니다. 기본 URL과 bearer 인증은 터널 클라이언트 구성에 저장되며, 기본 모델은 MCP_INFERENCE_DEFAULT_MODEL (설정되지 않은 경우 auto)로 설정됩니다. 키는 Git이나 MCP URL에 포함되어서는 안 됩니다. ChatGPT 설정 →
제공자 키는 터미널에서도 관리할 수 있습니다. 대시보드 세션 토큰(FREELLMAPI_DASHBOARD_TOKEN 또는 --token)을 사용하여 다음 명령어를 실행합니다: npx freellmapi keys add|list|remove|test <platform> 여기서 keys test는 저장된 키를 재확인합니다. cli/README.md를 참조하세요.
FreeLLMAPI는 설계상 로컬 우선(local-first)이며 단일 사용자용입니다. 제공자 키는 암호화되어 SQLite 데이터베이스에 보관되며, 요청은 사용자가 활성화한 상위 제공자(upstream providers)로 전송됩니다.
대시보드는 60개 언어를 지원하며 (데스크톱 트레이 메뉴는 6개). UI는 첫 로드 시 브라우저/시스템 언어를 자동으로 감지하고, **⋯ → 설정(Settings)**에서 언제든지 변경할 수 있으며 선택 사항은 기억됩니다. 오른쪽에서 왼쪽으로 쓰는 언어(العربية, עברית, فارسی, اردو)의 경우 전체 레이아웃이 자동으로 뒤집히고, 활성화된 언어의 사전만 로드되므로 나머지 부분은 대역폭을 전혀 사용하지 않습니다.
전체 지역화 목록(locales)은 client/src/i18n/locale-config.ts에 있습니다.
원래 6개 언어는 사람이 검토했으며, 새로운 언어들은 기계 번역된 후 원어민들이 수정 사항을 보내면서 개선됩니다. 한 문자열 PR(Pull Request)은 훌륭한 첫 번째 기여가 될 수 있습니다.
번역 파일은 client/src/i18n/locales/에 평면 JSON 파일 형태로 존재합니다. 문자열을 수정하려면 해당 지역화의 JSON 파일에서 값을 편집하면 됩니다. 언어를 추가하려면 en.json을 복사하여 값을 번역하고, client/src/i18n/locale-config.ts(트레이 문자열용으로는 desktop/src/i18n.ts)에 해당 지역화를 등록하면 됩니다. npm test는 모든 지역화의 키/플레이스홀더 일치 여부를 확인하므로 PR을 환영합니다.
라우터는 자체적으로 모델 카탈로그를 최신 상태로 유지합니다. 하루에 두 번 freellmapi.co에서 서명된(signed) 카탈로그를 가져와 로컬 DB에 새로운 모델, 할당량 변경 사항, 제공업체 특이사항 수정 등을 적용합니다. 사용자가 설정한 활성화/비활성화 선택 및 사용자 지정 제공업체는 절대 건드리지 않으며, 모든 다운로드는 적용되기 전에 고정된 Ed25519 키와 검증됩니다.
현재 카탈로그는 34개 제공업체, 474개의 모델 패밀리, 635개의 무료 제공업체/모델 엔드포인트 (채팅 584개, 임베딩 41개, 전사(transcription) 7개, 비디오 3개), 그리고 목록화된 무료 티어 용량으로 월 약 74억 토큰을 추적하고 있습니다. 전체 세트는 freellmapi.co/models에서 확인하세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 GitHub Trending TypeScript (weekly)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기