Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
본 논문은 칩 개발의 병목 현상인 프론트엔드 설계 분야에서 LLMs가 가진 잠재력을 탐구합니다. LLMs는 단순 사양 이해를 넘어 HDL 생성, 테스트벤치 구성 등 핵심 작업을 수행하며 에이전트적 AI 형태로 진화하고 있습니다. 본 논문은 이러한 발전 과정을 검토하고, 실제 적용 시의 과제와 미래 기회를 제시합니다.
본 논문은 기존 변이 기반 퍼징의 한계를 극복하기 위해 HiFuzz라는 새로운 계층적 강화학습(HRL) 프레임워크를 제안합니다. 이 프레임워크는 전역 레이아웃과 명령어 채우기를 구조화된 두 개의 에이전트로 분리하여 처리하며, 적응형 보상 메커니즘을 통해 효율적인 버그 탐지를 가능하게 합니다.
본 논문은 생성형 AI의 메모리 요구 증가에 대응하여, 광학 섬유를 활용한 새로운 아키텍처인 Fiber Memory를 제안합니다. 이 시스템은 LLM 가중치와 같은 불변 데이터를 위한 지연 라인 메모리로 기능하며, 기존 HBM3e 대비 에너지 효율성을 크게 개선할 수 있음을 입증했습니다.
본 논문은 산업 제어 시스템(ICS)에서 발생하는 '배포 격차' 문제를 다룹니다. 기존의 무한 정수 기반 검증기는 실제 16비트 MCU와 유한 해상도 ADC를 사용하는 환경에서 오버플로우로 인한 거짓 경보 및 결함 탐지 실패를 보였습니다. 이를 해결하기 위해 하드웨어 충실 검증(hardware-faithful verification) 방법을 제시합니다.
본 연구는 칩렛 기반 DNN 가속기를 위한 열 인지 및 포괄적인 설계 공간 탐색 프레임워크인 ThermoDSE를 제안합니다. 이 프레임워크는 아키텍처, 작업 오케스트레이션, 칩렛 간 통신을 통합적으로 고려하며, 엄격한 열/면적 제약 하에서 최적화를 수행합니다. 실험 결과, 기존 최고 성능 모델 대비 에너지-지연-수율(E $\times$ D $\times$ 1/Y) 측면에서 최대 3.5배 향상을 보였습니다.
본 논문은 파킨슨병(PD)의 적응형 심부 뇌 자극(aDBS)을 위해 CMOS 기술 기반 뉴로모픽 실리콘 뉴런 컨트롤러인 SiLIF-DBS를 제안합니다. 이 시스템은 베타 대역 STN-LFPs를 활용하여 병리학적 베타 활동을 효과적으로 억제하는 동시에, 기존 방식 대비 전력 소모를 크게 줄여 저전력 이식형 aDBS의 실현 가능성을 입증했습니다.
본 연구는 모바일 장치에서의 LLM 추론 효율성을 분석하며, 기존의 측정 방식을 넘어 백엔드별 에너지 기여도를 제공하는 PowerBench를 개발했습니다. 분석 결과, NPU가 컴퓨팅 바운드 프리필링에는 강점을 보이지만, 메모리 바운드 디코딩에서는 CPU가 더 우수하다는 점을 발견했습니다. 또한, 최적화되지 않은 스케줄링으로 인한 에너지 낭비 가능성도 제시하며 개선 방안을 제안합니다.
본 연구는 LLM을 활용하여 연산 트랜스컨덕턴스 증폭기(OTA) 설계를 위한 멀티모달 프레임워크 NEMESIS를 제안합니다. NEMESIS는 해석적 모델과 SPICE 평가 간의 균형을 맞추며, 회로 입력으로부터 점진적으로 정확한 성능 방정식을 생성합니다. 이 프레임워크는 기존 결과를 활용하거나 LLM으로 초기 방정식을 도출하고, SPICE 기반 루프를 통해 정제하여 높은 효율성을 입증했습니다.
본 논문은 FPGA 설계에서 BRAM과 DSP 간 데이터 전송 병목 현상을 해결하기 위해, 두 블록 사이에 전용 직접 연결을 도입하는 아키텍처 개선 방안을 제안합니다. 이 방법은 데이터를 글로벌 인터커넥트를 거치지 않고도 효율적으로 전달하여 성능 향상에 기여합니다.
본 논문은 3D IC의 전력 공급 네트워크(PDN) 문제를 다루며, 신뢰성 확보에 필수적인 관통 실리콘 비아(TSV)의 유효 저항 분석을 위한 GPU 가속 프레임워크를 제안합니다. 이 프레임워크는 기존 직접 해법 대비 5~6 자릿수의 속도 향상을 달성하며 높은 정확도를 유지합니다.
Belle II 실험의 FPGA 기반 GNN 트리거 시스템을 대상으로 RTL 결함 주입 연구를 수행했습니다. 방사선 노출로 인한 데드락, 타임아웃, 패킷 무결성 위반 등의 고장 모드를 분석하여 하드웨어 신뢰성을 평가했습니다.
컴퓨터 아키텍처 설계 및 최적화 분야에서 LLM 에이전트의 능력을 평가하기 위한 새로운 벤치마크인 ArchEval을 소개합니다. 8개의 시뮬레이터를 활용해 CPU, 메모리, 가속기 등 다양한 설계 챌린지를 제공하며 에이전트의 자율성을 측정합니다.
ELiTeFormer는 FPGA 배포를 위해 하이브리드 선형 어텐션과 초저정밀도(ternary) 선형 투영을 결합한 새로운 Transformer 아키텍처입니다. 알고리즘과 하드웨어 아키텍처를 공동 설계하여 모델 가중치와 KV 캐시를 획기적으로 압축하고 연산 효율을 극대화했습니다.
SABLE은 산업용 EDA 워크플로우에서 보안을 유지하며 아날로그 회로를 최적화하는 LLM 프레임워크입니다. 민감한 PDK 및 회로 정보를 정제하여 클라우드에 노출하지 않으면서도, 폐쇄 루프 방식으로 회로 설계를 자동화합니다.
SPICE netlist를 사람이 읽을 수 있는 회로도(Schematic)로 변환하는 결정론적 컨버터 Weave를 소개합니다. 계층적 그래프 레이아웃과 round-trip 검증 방식을 통해 기존 LLM 기반 방식보다 높은 연결성 보존력과 정확도를 제공합니다.
대규모 입도 메모리 시스템(LGMS)에서 발생하는 읽기 증폭 문제를 해결하기 위해 타일 중심 레이아웃을 제안하는 TileLens 연구를 소개합니다. 2차원 메모리 레이아웃을 통해 LLM 추론 성능 저하를 방지하며, 소프트웨어와 하드웨어 확장을 통해 효율적인 데이터 액세스를 지원합니다.
Ascend NPU에서 LLM 추론을 최적화하기 위해 학습 없이 4-bit FlashAttention을 구현하는 HiFA4 기술을 제안합니다. Smooth-QK와 P-Reordering 메커니즘을 통해 양자화로 인한 정확도 손실을 최소화하고 연산 효율을 높입니다.
디지털 회로의 신뢰성 분석을 위해 머신러닝과 몬테카를로 시뮬레이션을 결합한 SMART 프레임워크를 제안합니다. 랜덤 포레스트와 베이지안 최적화를 활용하여 공정 변동 및 트랜지스터 노화 문제를 신속하고 정확하게 분석합니다.
HackRF One과 Raspberry Pi 5를 결합하여 실내외 및 수풀 환경에서 RF 데이터를 수집할 수 있는 소형 배터리 구동 시스템을 제안합니다. SigMF 형식으로 IQ 데이터를 기록하며, 다양한 환경에서의 전파 특성과 간섭 패턴을 분석하는 연구를 수행했습니다.
KernelSight-LM은 LLM의 추론 성능을 커널 수준에서 정밀하게 시뮬레이션하는 새로운 프레임워크입니다. 하드웨어 사양과 커널 모델을 활용하여 GPU 세대가 바뀌더라도 낮은 오차로 지연 시간을 예측하고 병목 현상을 분석할 수 있습니다.