Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
하드웨어 설계 경험이 없는 개발자들이 TPU의 작동 원리를 직접 이해하기 위해 추론과 학습이 모두 가능한 장난감 TPU를 재발명한 프로젝트입니다. 외부 자료에 의존하기보다 스스로 메커니즘을 도출하는 '재발명' 철학을 바탕으로 딥러닝 기초와 하드웨어 설계를 학습하는 과정을 담고 있습니다.

NVIDIA가 Ampere, Lovelace, Hopper GPU 아키텍처에서 LLM 추론 성능을 최적화하기 위한 오픈 소스 소프트웨어인 TensorRT-LLM을 도입했습니다. 이 도구는 최적화된 커널과 멀티 GPU 통신 기능을 제공하며, 인플라이트 배칭 및 양자화 등의 기술을 통해 H100 GPU 사용 시 A100 대비 최대 8배의 성능 향상을 구현합니다.