Android에서 Hermes 사용 후기 (Graphene OS)
요약
Graphene OS 환경에서 Hermes를 구동한 후기를 공유하며, 원격 게이트웨이와 로컬 LLM(Llama.cpp, Qwen 3.6 35b)을 결합한 고성능 세팅을 소개합니다. 휴대용 GPU와 eGPU 조합으로 높은 프롬프트 및 생성 처리 속도를 달성했으며, 전체 시스템이 100% 로컬로 작동하는 점을 강조했습니다.
핵심 포인트
- Graphene OS에서 Hermes를 매끄럽게 구동 가능하며 음성 받아쓰기 기능도 우수함.
- 휴대용 GPU(5070ti)와 eGPU(RTX 3090) 조합으로 높은 성능을 달성함.
- 2500 tps의 프롬프트 처리 속도와 80-150 tps의 생성 속도를 기록함.
- 전체 시스템이 로컬에서만 작동하여 보안성과 독립성을 확보함.
AI 자동 생성 콘텐츠
본 콘텐츠는 r/LocalLLaMA의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기