본문으로 건너뛰기

© 2026 Molayo

Insights

AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.

Qwen3.6 35B A3B와 llama.cpp MTP를 사용한 12GB VRAM에서의 80 tok/sec 및 128K 컨텍스트 성능 - Insights | Molayo | Molayo