본문으로 건너뛰기

© 2026 Molayo

Insights

AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.

llama.cpp PR을 통해 x86 CPU에서 Q2_0 속도가 3.0~3.6배 향상, 8B 디코딩이 2.39 → 8.20 tok/s로 개선 - Insights | Molayo | Molayo