Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
CHIA는 에이전트 기반 AI를 활용하여 하드웨어와 소프트웨어를 공동 설계할 수 있는 오픈 소스 프레임워크입니다. SoC 설계 도구와 AI 모델을 유향 순환 그래프로 연결하여 복잡한 설계 워크플로우를 자동화하고 확장 가능한 연구 환경을 제공합니다.
KernelSight-LM은 LLM의 추론 성능을 커널 수준에서 정밀하게 시뮬레이션하는 도구입니다. 하드웨어 사양과 마이크로벤치마크를 활용해 다양한 GPU 환경에서의 지연 시간과 처리량을 정확하게 예측합니다.
칩렛 기반 이기종 시스템의 통신 복잡성을 해결하기 위해 연산 노드와 데이터를 함께 재배치하는 SHIFT 프레임워크를 제안합니다. ML 지원 정책과 다층 라우팅을 통해 지연 시간과 에너지 효율을 획기적으로 개선하며, 특히 LLM 워크로드에서 탁월한 성능 향상을 입증했습니다.
NVIDIA Blackwell GPU의 10비트 4:2:2 하드웨어 인코더를 활용하여 고충실도 V-PCC 스트리밍을 가속화하는 연구를 다룹니다. 분할 프레임 인코딩(SFE) 방식을 통해 8K 해상도와 122 fps의 처리량을 달성하며 실시간 볼륨 비디오 스트리밍의 가능성을 입증했습니다.
엣지 디바이스의 AI 칩 유휴 자원을 활용하여 범용 연산 효율을 높이는 프레임워크를 제안합니다. NAS를 통해 일반 연산을 신경망 모델로 변환하고, AI 엔진의 유휴 시간에 이를 배치하여 전체 시스템 성능을 향상시킵니다.
LLM 추론의 프리필과 디코드 단계를 각각 GDDR 기반 가속기와 HBM 기반 GPU로 분리하여 운영하는 MemHA 기반 서빙 시스템 HMA-Serve를 제안합니다. 단계별 양자화와 연산-전송 파이프라인을 통해 성능 저하 없이 비용 효율성을 극대화합니다.
Mega는 에너지 효율적인 에지 비전 처리를 위해 설계된 22nm 컨볼루션 스파이킹 신경망(SNN) 디지털 아키텍처입니다. 기존 SNN 가속기의 병렬성 부족과 메모리 유연성 문제를 해결하여 기존 기술 대비 4배 향상된 에너지 효율을 달성했습니다.
FPGA 기반 엣지 신경망을 위해 자원 효율성을 극대화하는 새로운 양자화 및 프루닝 방법론인 RQP를 제안합니다. 기존의 단조적인 방식 대신 원샷 프루닝과 양방향 베타 스케줄링을 사용하여 탐색 비용을 획기적으로 줄이면서도 최적의 성능을 달성합니다.
모바일 기기에서 PIM(Processing-in-Memory)과 CPU의 동시 실행을 최적화하는 협력적 스케줄링 프레임워크 COSM을 제안합니다. CPU의 메모리 액세스 유휴 시간을 활용하여 PIM 명령을 통합함으로써, CPU 성능 저하를 최소화하면서 PIM 처리량을 대폭 향상시킵니다.
Intel의 3.5D 이종 패키징 기술을 위한 사전 실리콘 펌웨어 최적화 연구를 다룹니다. 열-전기 공동 시뮬레이션을 통해 워크로드 밀도 기반의 선제적 전압 조절로 성능 저하를 완화하는 XRM-SSD 프레임워크를 제안합니다.
RTL 기술을 기반으로 하드웨어 회로도를 생성하는 멀티모달 LLM의 성능을 평가하기 위한 벤치마크 MultModLM을 제안합니다. 실험 결과, 모델들이 시각적 회로도는 생성할 수 있으나 기능적 정확성은 낮으며, LLM 기반 평가 방식의 신뢰성 문제도 확인되었습니다.
유연 소자(Flexible Electronics) 환경에서 저전력 함수 근사를 위해 개발된 아날로그 Kolmogorov-Arnold Networks(AKANs)를 소개합니다. 하드웨어-소프트웨어 공동 최적화와 가지치기 기법을 통해 회로 결함 속에서도 정확한 연산을 수행하며 전력과 면적을 획기적으로 절감합니다.
멀티 프리시전 공간 아키텍처에서 혼합 정밀도 DNN을 최적화하기 위한 새로운 방법론 SEADA를 제안합니다. SEADA는 시스템 수준의 비용 모델과 비트 수준 엔트로피 기반의 정밀도 선택을 통해 효율적인 매핑을 지원합니다.
Snapdragon 8 Elite SoC 환경에서 모바일 VLM 추론의 단계별 하드웨어 특성을 분석한 연구입니다. NPU 활용 시 프리필과 디코드 단계의 성능 차이, 열 안정성 및 에너지 효율성을 검증하고 최적화된 포팅 방법을 제시합니다.
하드웨어 성능 측정값의 신뢰성을 보장하기 위해 해시 연결 증거 그래프를 활용한 자가 검증형 기록 방식을 제안합니다. 이 방식은 변조 방지가 가능하며, 독립적인 감사와 확률적 항등식을 통해 하드웨어의 조용한 오류를 효과적으로 탐지합니다.
본 논문은 현대 기술 시스템 설계의 복잡성을 해결하기 위해 딥러닝과 생성형 AI를 활용한 계산 설계 합성(CDS) 프레임워크를 제안합니다. e-drive 시스템과 공간 차원 결정 사례를 통해 시뮬레이션 기반 최적화를 넘어선 자율 설계의 가능성을 제시합니다.
뉴로모픽 컴퓨팅을 위한 비매개변수적 1-Bit 희소 모델의 고주파 기하학적 노이즈 완화 방법을 제안합니다. 8-bit 변환 행렬을 통해 초희소 이진 코드를 생성하며, 하드웨어 레벨의 저역 통과 필터로 재구성 오차를 최소화하는 프레임워크를 제시합니다.
DRAM의 비용 문제를 해결하기 위한 신흥 메모리 기술인 LtRAM의 단점을 극복하기 위한 새로운 하드웨어/소프트웨어 인터페이스 설계를 제안합니다. 애플리케이션 읽기 전용 메모리(AROM) 개념을 도입하여 LtRAM 관리 책임을 하드웨어에서 운영체제로 전환함으로써 성능과 비용 효율성을 동시에 달성하고자 합니다.
궤도 데이터 센터(ODC)에서 LLM 학습 시 발생하는 열 간섭 문제를 해결하기 위한 연구를 소개합니다. 열 인지형 이질성 테제를 바탕으로 워크로드를 최적의 냉각 유닛으로 이동시키는 TLB 프레임워크를 제안합니다.
Intel의 3.5D 이종 패키징 기술을 위한 사전 실리콘 펌웨어 및 하드웨어 공동 최적화 연구를 다룹니다. 열-전기 공동 시뮬레이션을 통해 워크로드 밀도 기반의 열 힌팅 기술이 전압 안정성과 HBM 누설 전류 억제에 미치는 효과를 입증했습니다.