Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
AMD Ryzen AI NPU 프로그래밍을 위한 시각적 데이터플로우 설계 환경인 IRONSmith를 소개합니다. 이 도구는 사용자가 코딩 없이 인터랙티브 캔버스에서 와이어 연결 블록으로 ML 데이터플로우를 설계할 수 있게 합니다. IRONSmith는 구조적 완성, 종속성 관리 등을 자동 처리하여 AMD Ryzen AI NPU에서 실행 가능한 IRON Python 코드로 변환합니다.
본 논문은 오픈소스 EDA 툴의 설계 공간 탐색(DSE)을 공개 노브를 넘어 소스 레벨 메커니즘으로 확장하는 ReviewDSE 프레임워크를 제안합니다. 이 보호된 화이트박스 DSE는 재사용 가능한 검색 지식을 기록하고, OpenROAD에 구현하여 최종 HPWL을 평균 1.78% 감소시키는 성능 향상을 입증했습니다.
본 논문은 엣지 장치에 DNN 배포 시 필수적인 HW 인식 신경망 구조 탐색(HW-NAS) 과정에서 발생하는 지연 시간 측정의 병목 현상을 해결하는 방법을 제시합니다. 연구진은 그래프 어텐션 네트워크 기반의 고정밀, 저비용 지연 시간 예측기인 HiFi-LLP를 개발했습니다. 이를 통해 NAS 프로세스의 정확도를 높이고 하이브리드 프레임워크를 구축하여 기존 대비 높은 속도 향상을 달성했습니다.
본 연구는 LLM이 컴퓨터 아키텍처 논문을 단순 요약하는 것을 넘어, 핵심 메커니즘을 비판적으로 분석하고 구조화된 이해를 수행할 수 있는지 Gauntlet이라는 오픈 소스 파이프라인으로 검증했습니다. 20개 최신 학회 논문 분석 결과, Gauntlet은 인간 전문가의 분석보다 '비판적 엄밀성' 측면에서 유의미하게 우수한 성능을 보였습니다.
본 논문은 학습된 실행기의 신뢰성을 높이기 위해 트레이스 기반 심볼릭 신경 CPU(trace-supervised symbolic neural CPU)를 제안합니다. 이 아키텍처는 재귀적 제어, 명시적인 연산 라우터, 목적지 마스크 레지스터 쓰기백 등을 결합하여 상태 전이를 가시화하고 정확한 실행을 목표로 합니다.
본 기사는 LLM 추론 시 HBM 용량 제약을 극복하기 위한 새로운 공동 설계 시스템인 FlashAccel을 소개합니다. FlashAccel은 HBF(고대역폭 플래시)를 HBM 기반 GPU에 통합하여 접근 지연 시간을 완화하고, 특수 데이터 레이아웃 및 스토리지 관리 계층을 통해 대역폭 활용률과 이기종 자원 관리를 개선했습니다.
본 논문은 대규모 트랜스포머 모델을 저전력 엣지 디바이스에 배포하기 위한 적응형 모델 압축(AMC) 프레임워크를 제안합니다. 이 시스템은 토큰 중요도에 따라 하드웨어 자원을 동적으로 할당하여, 중요한 정보는 고정밀로 처리하고 덜 중요한 데이터는 비트 폭을 줄여 에너지 효율성을 극대화했습니다.
본 논문은 하드웨어 검증의 복잡성 증가에 대응하여 LLM의 의미론적 추론 능력을 활용한 새로운 퍼징 프레임워크인 ChipFuzzer를 제안합니다. ChipFuzzer는 커버리지 가이드와 버그 가이드를 결합한 2단계 워크플로우로, 테스트 케이스 생성 및 우선순위화에 LLM을 적용하여 검증 효율성을 극대화했습니다.
본 기사는 IEC 61131-3 래더 다이어그램의 안전성을 향상시키기 위한 새로운 실행 가능한 형식 의미론 K-ESBMC를 소개합니다. K-ESBMC는 접점, 코일 등 PLC 요소를 모델링하며, 단일 정의로 인터프리터와 연역적 검증기를 모두 생성하여 표준에 충실한 오라클 역할을 합니다. 이를 통해 기존 변환 기반 검증기의 건전성을 감사하고 결함을 노출시킵니다.
본 논문은 인-DRAM Rowhammer 방어 기법의 한계점을 지적하며, 런타임 온도 변화에 따라 변하는 실제 Rowhammer 임계값(TRHD)을 관리하기 위한 '동적 Rowhammer 임계값 관리'를 제안합니다. 이 방법은 관측된 온도를 기반으로 각 방어 기법의 임계값을 재소스화하여 물리적 TRHD 조정의 비일관성을 해결하고, 다양한 위반 사례에서 성능 개선을 입증했습니다.
본 논문은 다양한 안정자 코드와 노이즈 환경에 대응하는 통합 메타-디코딩 프레임워크를 제안했습니다. 이 프레임워크는 기존의 Meta-MLP 기반 모델과 하드웨어 인식 VQC 메타-디코더를 비교하며, 특히 신뢰도 게이팅 폴백을 적용했을 때 성능 향상을 입증했습니다.
본 논문은 정적 Pre-Charge Half Buffer (PCHB) 회로의 소프트 에러 특성을 체계적으로 분석했습니다. 결함 주입 프레임워크를 통해 취약 노드를 식별하고, 이중/단일 측 Schmitt 트리거, 전송 게이트 강화 등 네 가지 완화 전략을 평가했습니다. 이를 바탕으로 지연 시간, 에너지, 면적 관점의 경화 트레이드오프 가이드라인을 제시합니다.
본 논문은 대규모 언어 모델(LLMs)의 메모리 및 연산 요구 증가에 따른 병목 현상을 해결하기 위한 아키텍처 개선 방안인 StreamDQ를 제안합니다. StreamDQ는 HBM 베이스 다이에 DeQuantization Blocks (DQBs)를 통합하여, 온디바이스 디양자화를 인라인으로 수행함으로써 고처리량 LLM 추론 가속을 목표로 합니다.
본 논문은 전기차(EV)의 적응형 전력 관리를 위해 온디바이스 학습 기반의 배터리 전력 예측 모델을 제안합니다. 기존 딥러닝 모델이 데이터 분포 변화에 취약한 문제를 해결하기 위해, 사전 학습된 지식을 유지하며 새로운 환경에 지속적으로 적응하는 방법을 제시했습니다.
본 논문은 칩 개발의 병목 현상인 프론트엔드 설계 분야에서 LLMs가 가진 잠재력을 탐구합니다. LLMs는 단순 사양 이해를 넘어 HDL 생성, 테스트벤치 구성 등 핵심 작업을 수행하며 에이전트적 AI 형태로 진화하고 있습니다. 본 논문은 이러한 발전 과정을 검토하고, 실제 적용 시의 과제와 미래 기회를 제시합니다.
본 논문은 기존 변이 기반 퍼징의 한계를 극복하기 위해 HiFuzz라는 새로운 계층적 강화학습(HRL) 프레임워크를 제안합니다. 이 프레임워크는 전역 레이아웃과 명령어 채우기를 구조화된 두 개의 에이전트로 분리하여 처리하며, 적응형 보상 메커니즘을 통해 효율적인 버그 탐지를 가능하게 합니다.
본 논문은 생성형 AI의 메모리 요구 증가에 대응하여, 광학 섬유를 활용한 새로운 아키텍처인 Fiber Memory를 제안합니다. 이 시스템은 LLM 가중치와 같은 불변 데이터를 위한 지연 라인 메모리로 기능하며, 기존 HBM3e 대비 에너지 효율성을 크게 개선할 수 있음을 입증했습니다.
본 논문은 산업 제어 시스템(ICS)에서 발생하는 '배포 격차' 문제를 다룹니다. 기존의 무한 정수 기반 검증기는 실제 16비트 MCU와 유한 해상도 ADC를 사용하는 환경에서 오버플로우로 인한 거짓 경보 및 결함 탐지 실패를 보였습니다. 이를 해결하기 위해 하드웨어 충실 검증(hardware-faithful verification) 방법을 제시합니다.
본 연구는 칩렛 기반 DNN 가속기를 위한 열 인지 및 포괄적인 설계 공간 탐색 프레임워크인 ThermoDSE를 제안합니다. 이 프레임워크는 아키텍처, 작업 오케스트레이션, 칩렛 간 통신을 통합적으로 고려하며, 엄격한 열/면적 제약 하에서 최적화를 수행합니다. 실험 결과, 기존 최고 성능 모델 대비 에너지-지연-수율(E $\times$ D $\times$ 1/Y) 측면에서 최대 3.5배 향상을 보였습니다.
본 논문은 하드웨어 검증 작업인 논리 동치 검사(LEC)의 성능 저하 문제를 해결하기 위한 miter-aware 매핑 프레임워크를 제안합니다. 이 방법은 기존 넷리스트 대신 LUT 기반의 miter를 구성하여 구조적 대응 관계와 고수준 논리 관계를 명시적으로 보존합니다. 이를 통해 SAT 솔버가 효율적으로 작동하도록 LEC 성능을 크게 향상시킬 수 있음을 입증했습니다.