AI 앱을 서버비와 API 비용 '0원'으로 배포 가능해지며 개발자들 열광
요약
Google DeepMind가 'EmbeddingGemma 2'를 공개하며 AI 앱 개발의 패러다임을 바꿨습니다. 이 모델은 API 호출 비용 없이 사용자의 로컬 장치(스마트폰/브라우저)에서 임베딩 계산을 수행하여, 트래픽 증가에 따른 서버 운영 비용 부담을 완전히 해소합니다.
핵심 포인트
- API 호출 비용이 0원이며, 모든 임베딩 계산이 사용자 로컬 장치에서 이루어집니다.
- 텍스트, 코드, 사진 등 다양한 데이터를 하나의 모델로 검색할 수 있습니다.
- 별도의 벡터 DB 서버가 필요 없고, 로컬 장치에 압축 저장하여 구동합니다.
- Apache 2.0 라이선스로 상업적 이용이 가능하며, 오프라인 구동을 지원합니다.
지금까지는 AI 검색이나 추천 기능 하나를 추가하려고만 해도 사용자가 늘어날 때마다 급증하는 API 비용 때문에 적자를 보는 인디 해커들이 셀 수 없이 많았습니다. 하지만 이제 아무리 많은 사용자가 몰려와도 제 지출은 정확히 '0원'입니다.
이 모든 것은 Google DeepMind가 깜짝 공개한 'EmbeddingGemma 2' 덕분입니다.
• API 호출 비용 0원 (사용자 스마트폰/브라우저에서 직접 계산)
• 텍스트, 코드, 사진, 비디오, 오디오를 모두 하나의 모델로 검색 가능
• 스마트폰 RAM 191MB만으로 완전히 오프라인 구동
• 값비싼 벡터 DB 서버 불필요 (사용자 로컬 장치에 1/6 용량으로 압축 저장)
• Apache 2.0 무료 오픈소스 라이선스 하에 상업적 목적 사용 가능
AI 앱을 0원으로 출시하는 핵심 원리와 Hugging Face 다운로드 링크(스레드)
개발자들이 AI 앱에 대해 이렇게 열광하는 이유는 무엇일까요?
- '트래픽 증가 = 손실 증가' 공식의 종말
모든 AI 임베딩 계산은 사용자의 휴대폰이나 브라우저(WebGPU)에서 실행됩니다. 서버를 거치지 않기 때문에, 사용자가 10,000명이든
AI 자동 생성 콘텐츠
본 콘텐츠는 X 토픽: 한국 AI/LLM의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기