NVIDIA, 70개가 아닌 100개 이상의 AI 모델에 대해 조용히 무료 API 액세스 개방
요약
NVIDIA가 DeepSeek, Llama, Mistral 등 100개 이상의 AI 모델에 대해 무료 API 액세스를 개방했습니다. OpenAI 호환 엔드포인트를 통해 최대 1M 토큰의 컨텍스트를 지원하며, Cursor나 Claude Code 같은 도구에서 즉시 활용 가능합니다.
핵심 포인트
- 100개 이상의 다양한 오픈 모델을 하나의 엔드포인트로 제공
- OpenAI 호환 방식으로 Cursor, Claude Code 등에서 사용 가능
- 최대 1M 토큰의 컨텍스트 및 원본 모델과 동일한 출력 크기 지원
- 보안을 위해 기밀 코드보다는 프로토타이핑 및 학습 용도로 권장
NVIDIA가 단 70개가 아닌 100개 이상의 AI 모델에 대해 조용히 무료 API 액세스 (API access)를 개방했습니다.
GLM-5.1/5.2, DeepSeek V3/R1/V4 Pro, Qwen, Kimi, Nemotron, Llama, Mistral, Gemma 등이 모두 하나의 OpenAI 호환 엔드포인트 (OpenAI-compatible endpoint)를 통해 제공됩니다.
컨텍스트 (Context) 및 출력 크기 (output sizes)는 원본 모델과 정확히 일치하며, 인위적인 절단은 없습니다. 지원되는 모델의 경우 최대 1M 토큰 (tokens)까지 가능합니다.
설정 방법: https://t.co/iQNdAcEBKp 에 접속하여 무료로 가입한 후, 6개월 동안 유효한 nvapi-로 시작하는 키를 생성하세요. OpenAI 호환 클라이언트 (OpenAI-compatible client)인 Cursor, Cline, Aider, OpenCode, Claude Code를 base_url https://t.co/M9pfqrjyzo 로 설정하면 됩니다.
속도 제한 (Rate limit)은 분당 약 40회 요청 (requests per minute) 수준이며, 최선(best-effort)을 다하지만 보장되지는 않습니다.
민감한 정보를 보내기 전에 알아두어야 할 점이 있습니다. NVIDIA 자체 문서에서도 로그 기록 제로 (zero logging)를 명확하게 약속하지 않으므로, 이를 기밀 코드를 다루는 곳이 아닌 프로토타이핑 (prototyping) 및 학습 환경으로 취급하십시오.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @cyrilxbt (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기