Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 엣지 LLM 추론을 위해 iGPU와 NPU 같은 이종 자원을 효과적으로 활용하는 스케줄링 프레임워크인 HeteroMosaic를 제안합니다. HeteroMosaic는 이종 루프라인 모델과 마이크로 배치 분해를 통해 크로스-가속기 오버랩을 노출하고, 메모리 경합 등 실제 효과를 고려하여 공동 최적화를 수행합니다.
본 논문은 마이크로아키텍처 이벤트 간의 복잡한 상호작용을 분석하는 관측성 프레임워크인 Microflow를 제안합니다. Microflow는 실행 트레이스를 MFIR로 변환하여 소프트웨어 의미론, 명령어, 하드웨어 리소스 전반의 의존성을 포착합니다. 이를 통해 성능 병목 현상의 근본 원인을 체계적으로 분석하고 하드웨어-소프트웨어 공동 설계를 지원합니다.
본 논문은 데이터 교란 오류인 ColumnDisturb 문제를 다루며, 특히 인접 서브어레이 간의 비트 플립(inter-subarray bitflips)을 완화하는 새로운 기법 CODA를 제안합니다. 기존 방식이 유발하던 과도한 오버헤드를 줄여 성능 저하 없이 ColumnDisturb 허용을 가능하게 합니다.
본 연구는 Job-Shop Scheduling Problem의 산업 변형을 세 가지 플랫폼(IBM Quantum, D-Wave, Fujitsu)에서 양자 및 고전적 방식으로 비교 분석했습니다. 그 결과, 솔루션 품질과 확장성을 위해서는 하드웨어와 소프트웨어를 공동 설계하는 것이 필수적임을 입증했습니다.
본 논문은 LLM의 계산 및 메모리 요구 사항으로 인한 전반적인 추론 효율성 문제를 해결하기 위해 CIMERA라는 새로운 가속기를 제안합니다. CIMERA는 컴퓨팅, 인터커넥트, 메모리를 통합하고 재구성 가능한 정밀도를 활용하여 에너지 효율성을 극대화했습니다.
본 논문은 비디오 확산 트랜스포머(vDiTs)가 가진 높은 컴퓨팅 비용 문제를 해결하기 위해 알고리즘과 하드웨어를 공동 설계한 Kaleido를 제안합니다. Kaleido는 잠재 공간의 시공간적 상관관계를 활용하여 중복 계산을 건너뛰고, 이를 효율적으로 지원하는 시스틱 어레이 가속기를 포함합니다.
본 논문은 생의학 신호 획득 및 인코딩에 최적화된 이벤트 기반 아날로그 프론트 엔드(AFE) ASIC을 제시합니다. 이 칩은 적응형 비동기 델타 변조기(aADM)와 펄스 주파수 변조(PFM)를 결합한 이중 모드 인코딩 메커니즘을 갖추고 있습니다. 이를 통해 저전력으로 높은 데이터 압축률의 신경 신호 처리가 가능하며, BCI 및 SNN 프로세서와의 호환성을 제공합니다.
본 논문은 오픈소스 EDA 툴의 설계 공간 탐색(DSE)을 공개 노브를 넘어 소스 레벨 메커니즘으로 확장하는 ReviewDSE 프레임워크를 제안합니다. 이 보호된 화이트박스 DSE는 재사용 가능한 검색 지식을 기록하고, OpenROAD에 구현하여 최종 HPWL을 평균 1.78% 감소시키는 성능 향상을 입증했습니다.
본 연구는 LLM이 컴퓨터 아키텍처 논문을 단순 요약하는 것을 넘어, 핵심 메커니즘을 비판적으로 분석하고 구조화된 이해를 수행할 수 있는지 Gauntlet이라는 오픈 소스 파이프라인으로 검증했습니다. 20개 최신 학회 논문 분석 결과, Gauntlet은 인간 전문가의 분석보다 '비판적 엄밀성' 측면에서 유의미하게 우수한 성능을 보였습니다.
본 논문은 학습된 실행기의 신뢰성을 높이기 위해 트레이스 기반 심볼릭 신경 CPU(trace-supervised symbolic neural CPU)를 제안합니다. 이 아키텍처는 재귀적 제어, 명시적인 연산 라우터, 목적지 마스크 레지스터 쓰기백 등을 결합하여 상태 전이를 가시화하고 정확한 실행을 목표로 합니다.
본 논문은 인-DRAM Rowhammer 방어 기법의 한계점을 지적하며, 런타임 온도 변화에 따라 변하는 실제 Rowhammer 임계값(TRHD)을 관리하기 위한 '동적 Rowhammer 임계값 관리'를 제안합니다. 이 방법은 관측된 온도를 기반으로 각 방어 기법의 임계값을 재소스화하여 물리적 TRHD 조정의 비일관성을 해결하고, 다양한 위반 사례에서 성능 개선을 입증했습니다.
본 논문은 다양한 안정자 코드와 노이즈 환경에 대응하는 통합 메타-디코딩 프레임워크를 제안했습니다. 이 프레임워크는 기존의 Meta-MLP 기반 모델과 하드웨어 인식 VQC 메타-디코더를 비교하며, 특히 신뢰도 게이팅 폴백을 적용했을 때 성능 향상을 입증했습니다.
본 논문은 정적 Pre-Charge Half Buffer (PCHB) 회로의 소프트 에러 특성을 체계적으로 분석했습니다. 결함 주입 프레임워크를 통해 취약 노드를 식별하고, 이중/단일 측 Schmitt 트리거, 전송 게이트 강화 등 네 가지 완화 전략을 평가했습니다. 이를 바탕으로 지연 시간, 에너지, 면적 관점의 경화 트레이드오프 가이드라인을 제시합니다.
본 논문은 전기차(EV)의 적응형 전력 관리를 위해 온디바이스 학습 기반의 배터리 전력 예측 모델을 제안합니다. 기존 딥러닝 모델이 데이터 분포 변화에 취약한 문제를 해결하기 위해, 사전 학습된 지식을 유지하며 새로운 환경에 지속적으로 적응하는 방법을 제시했습니다.
본 논문은 칩 개발의 병목 현상인 프론트엔드 설계 분야에서 LLMs가 가진 잠재력을 탐구합니다. LLMs는 단순 사양 이해를 넘어 HDL 생성, 테스트벤치 구성 등 핵심 작업을 수행하며 에이전트적 AI 형태로 진화하고 있습니다. 본 논문은 이러한 발전 과정을 검토하고, 실제 적용 시의 과제와 미래 기회를 제시합니다.
본 논문은 기존 변이 기반 퍼징의 한계를 극복하기 위해 HiFuzz라는 새로운 계층적 강화학습(HRL) 프레임워크를 제안합니다. 이 프레임워크는 전역 레이아웃과 명령어 채우기를 구조화된 두 개의 에이전트로 분리하여 처리하며, 적응형 보상 메커니즘을 통해 효율적인 버그 탐지를 가능하게 합니다.
본 논문은 생성형 AI의 메모리 요구 증가에 대응하여, 광학 섬유를 활용한 새로운 아키텍처인 Fiber Memory를 제안합니다. 이 시스템은 LLM 가중치와 같은 불변 데이터를 위한 지연 라인 메모리로 기능하며, 기존 HBM3e 대비 에너지 효율성을 크게 개선할 수 있음을 입증했습니다.
본 논문은 산업 제어 시스템(ICS)에서 발생하는 '배포 격차' 문제를 다룹니다. 기존의 무한 정수 기반 검증기는 실제 16비트 MCU와 유한 해상도 ADC를 사용하는 환경에서 오버플로우로 인한 거짓 경보 및 결함 탐지 실패를 보였습니다. 이를 해결하기 위해 하드웨어 충실 검증(hardware-faithful verification) 방법을 제시합니다.
본 연구는 칩렛 기반 DNN 가속기를 위한 열 인지 및 포괄적인 설계 공간 탐색 프레임워크인 ThermoDSE를 제안합니다. 이 프레임워크는 아키텍처, 작업 오케스트레이션, 칩렛 간 통신을 통합적으로 고려하며, 엄격한 열/면적 제약 하에서 최적화를 수행합니다. 실험 결과, 기존 최고 성능 모델 대비 에너지-지연-수율(E $\times$ D $\times$ 1/Y) 측면에서 최대 3.5배 향상을 보였습니다.
본 논문은 파킨슨병(PD)의 적응형 심부 뇌 자극(aDBS)을 위해 CMOS 기술 기반 뉴로모픽 실리콘 뉴런 컨트롤러인 SiLIF-DBS를 제안합니다. 이 시스템은 베타 대역 STN-LFPs를 활용하여 병리학적 베타 활동을 효과적으로 억제하는 동시에, 기존 방식 대비 전력 소모를 크게 줄여 저전력 이식형 aDBS의 실현 가능성을 입증했습니다.