
Ascend에서의 DeepSeek-V4 사후 학습 (post-training)
요약
Ascend 환경에서 진행된 DeepSeek-V4 사후 학습(post-training) 성과를 다룹니다. SLAI T-Rex를 통해 속도를 2.93배 향상시켰으며, 운영 연구 분야에서 GPT-5.4-Mini를 능가하는 성능을 기록했습니다.
핵심 포인트
- SLAI T-Rex를 통한 2.93배의 속도 향상 달성
- 34.22%의 MFU(Model Flops Utilization) 기록
- 운영 연구(Operations Research) 특화 모델 성능 입증
- GPT-5.4-Mini 대비 4포인트 높은 성능 기록
SLAI T-Rex는 2.93배의 속도 향상과 함께 34.22%의 MFU (Model Flops Utilization)를 달성했습니다. 운영 연구 (Operations Research)에 특화된 이 모델은 GPT-5.4-Mini를 4포인트 차이로 앞섭니다. https://t.co/BiAECzuWkk
AI 자동 생성 콘텐츠
본 콘텐츠는 X @huggingpapers (검증됨)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기