비용카드 없이 사용할 수 있는 9가지 LLM API 비교: 속도 제한, 규칙 및 주의사항 (2026)
요약
본 기사는 신용카드 없이 프로토타이핑 가능한 9가지 LLM API를 비교 분석합니다. Google Gemini, Groq, OpenRouter 등 주요 플랫폼들이 제공하는 무료 티어의 속도 제한, 크레딧 정책, 사용 가능 모델 등을 상세히 다룹니다. 각 서비스별로 무료 이용 범위와 주의사항을 숙지하여 비용 부담 없이 AI 개발 초기 단계를 진행할 수 있도록 돕는 실용적인 가이드입니다.
핵심 포인트
- Gemini API: Flash 및 Pro 모델의 속도 제한 내 무료 토큰 제공.
- Groq: OpenAI 호환 오픈 모델에 대한 높은 할당량과 Free 플랜 제공.
- OpenRouter: 다양한 모델을 테스트할 수 있는 무료 변형 세트와 요청 한도를 제시.
- 각 서비스별로 무료 티어 정책이 상이하므로, 사용 전 반드시 공식 문서를 확인해야 함.
LLMs를 돈을 내지 않고 프로토타이핑할 수 있지만, '무료 티어(free tier)'는 제공업체에 따라 매우 다르게 해석됩니다. 어떤 곳은 영구적인 속도 제한 접근을 제공하고, 어떤 곳은 월별 크레딧을 제공하며, 또 어떤 곳은 소수의 모델만 무료로 제공합니다.
여기에는 가입 시 신용카드가 필요 없는 9가지 LLM API와 각각에서 실제로 얻을 수 있는 것 및 주의사항이 나와 있습니다. 약관은 2026년 9월 13일에 마지막으로 확인되었으며, 무료 라인업은 변경될 수 있으므로 구축하기 전에 반드시 제공업체 페이지를 확인하세요.
요약
| API | 무료로 이용 가능한 것 | 카드 필요 여부 | 주의사항 |
| :--- | :--- | :--- |
| Google Gemini | Flash 모델 + Gemini 2.5 Pro, 속도 제한 적용 |
| ... |
Google Gemini Developer API
Gemini API와 Google AI Studio를 통해 Gemini Flash 모델, Gemini 2.5 Pro, Gemma 4, 임베딩(embeddings), TTS/실시간 미리 보기 전반에 걸쳐 개별 모델의 속도 제한 내에서 무료 입력 및 출력 토큰을 사용할 수 있습니다. Google 검색 접지(Google Search grounding)는 Gemini 2.5 모델에서 하루 최대 500 요청까지 무료입니다.
주의사항: 이미지 생성(Nano Banana), Veo, Imagen, Lyria 및 Pro 미리 보기 기능은 무료 티어에 포함되지 않습니다.
Groq
모든 계정은 Free 플랜으로 시작하며, OpenAI와 호환되는 API를 통해 호스팅된 오픈 모델에 대한 속도 제한 접근을 제공합니다. gpt-oss-120b, gpt-oss-20b 및 Qwen 모델의 경우 분당 30 요청, 일일 1K 요청, 분당 8K 토큰, 일일 200K 토큰이 할당됩니다. Whisper도 포함되어 있습니다(분당 20 요청, 일일 2K 요청).
주의사항: 제한은 키별이 아닌 조직(organization)별로 적용되며, Groq는 이 내용이 변경될 수 있다고 명시했습니다.
OpenRouter
비용 없이 사용할 수 있는 엄선된 무료 모델 변형 세트입니다. 모든 모델에 대해 분당 20 요청까지 가능합니다.
주의사항: 최소 10 크레딧을 구매하기 전까지는 하루 50 요청만 가능하며, 이후에는 일일 1,000 요청이 제공됩니다. 추가 계정이나 키를 만든다고 해서 제한이 늘어나지는 않으며, 무료 라인업은 변경되어 마지막 확인 시점에서는 세 가지 모델만 이용 가능했습니다.
NVIDIA NIM
네 가지 미리 보기 모델에 대한 무료 추론 엔드포인트: kimi-k3, deepseek-v4-pro-0813, nemotron-3.5-lightning-30b-a3b 및 nemotron-3-ultra-550b-a55b.
주의사항: 키를 받으려면 NVIDIA 계정을 생성하고 인증해야 하며, 무료 등급에 대한 속도 제한(rate limits)이나 서비스 수준 계약(SLA)이 공지되어 있지 않습니다.
Mistral
무료 플랜에는 월 $10 상당의 API 크레딧이 포함되며, 모델 테스트 및 웹/모바일에서 Vibe 에이전트를 위한 Studio도 제공됩니다.
주의사항: 무료 플랜에서는 메시지, 웹 검색, 코딩 세션에 제한이 있습니다.
Cohere
가입 시 개발 및 비상업적 프로토타이핑을 위해 무료로 속도 제한이 적용된 평가판(Trial) API 키를 제공합니다.
주의사항: 평가판 키는 운영 환경이나 상업적 사용에 명시적으로 허용되지 않으며, 실제 서비스 개시는 유료 결제가 필요합니다.
Z.AI (GLM)
GLM-4.7-Flash, GLM-4.5-Flash 및 GLM-4.6V-Flash는 입력(input), 캐시된 입력(cached input) 및 출력(output)에 대해 $0의 가격이 책정되어 있습니다. 가격 페이지에는 사용량 제한이 명시되어 있지 않습니다.
주의사항: Flash 모델만 무료입니다.
LLM7.io
무료 토큰을 통해 OpenAI와 호환되는 API로 하루 최대 1,000,000 토큰까지 사용할 수 있습니다(초당 2 요청, 분당 40 요청, 시간당 100 요청). 키가 없어도 낮은 요청 속도로 하루 500,000 토큰을 얻을 수 있습니다.
주의사항: 입력 및 출력 토큰이 일일 한도에 합산됩니다.
Pollinations
사전 등록 없이 일반 HTTP를 통해 텍스트, 이미지, 오디오 및 비디오 생성이 가능합니다. 익명 사용자는 기본 모델을 초당 1회 요청으로 사용할 수 있으며, 무료 등록 시 이를 5초당 1회 요청으로 늘리고 표준 모델을 사용할 수 있게 됩니다.
주의사항: 익명 속도가 느리며, 무료 등급 이미지는 워터마크가 포함될 수 있습니다(등록하면 제거됨).
간 전환하기
Groq와 OpenRouter 모두 OpenAI API를 사용하므로, 대부분의 SDK 및 코딩 에이전트는 기본 URL과 키를 교체하여 작동합니다:
from openai import OpenAI
# Groq
...
무엇부터 시작해야 할까요?
- 무료로 가장 성능이 뛰어난 모델: Gemini (2.5 Pro가 무료 등급에서 사용 가능함).
- 가장 빠른 응답 속도: Groq.
- 일일 최대 토큰 수: LLM7.io (1M/day).
- 어떤 모델에든 사용할 수 있는 월별 크레딧: Mistral ($10/month).
- 회원가입이 전혀 필요 없는 경우: Pollinations 또는 키 없이 사용하는 LLM7.io.
이 중 어느 것도 프로덕션 트래픽을 위한 것은 아니므로, 프로토타이핑 예산으로 간주해야 합니다.
제공업체의 약관이 변경될 때마다 업데이트되는 이 비교의 실시간 정렬 가능한 버전은 aifree.dev/compare/free-llm-apis에서 확인할 수 있습니다. 일회성 가입 크레딧은 free API credits list를 참고하세요.
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기