Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
LLM 기반 에이전트의 EDA 워크플로우 자동화 능력을 평가하기 위한 벤치마크인 FluxBench를 제안합니다. RTL 생성부터 GDS 도달까지의 엔드투엔드 과정을 분석하며, 에이전트 아키텍처와 비용 효율성(Token ROI)의 중요성을 입증합니다.
RAG의 병목 현상인 밀집 벡터 검색을 해결하기 위해 하드웨어-소프트웨어 공동 설계된 인-스토리지 가속기 D-NOVA를 제안합니다. NAND 메모리 내부에 검색 기능을 직접 통합하여 데이터 이동을 최소화하고 에너지 효율을 극대화했습니다.
질량 분석(MS)의 개방형 수정 검색(OMS) 워크로드를 가속하기 위한 다양한 컴퓨팅 플랫폼 간의 성능 및 트레이드오프를 분석한 연구입니다. 이진 하이퍼디멘셔널 컴퓨팅(HDC)을 활용하여 차세대 메모리 및 스토리지 중심 아키텍처에서 높은 효율성을 달성했습니다.
광 OFDM 트랜시버의 FFT IP 코어를 위해 저정밀도 부동 소수점 형식을 적용하는 새로운 공동 설계 방법론을 제안합니다. 12nm FinFET 공정 실험 결과, 기존 고정 소수점 방식 대비 전력은 최대 19.8%, 면적은 12.0% 절감하면서도 우수한 성능을 입증했습니다.
SEAM-V는 RISC-V 벡터 확장을 위한 하이브리드 분리형 실행 아키텍처를 제안합니다. 태스크 수준의 분리와 실행 패킷(EP) 컨텍스트를 활용하여 벡터 명령어 공급 공백을 줄이고 처리량을 극대화합니다.
AI 모델의 의도를 제어하기 위해 하드웨어 수준에서 성능을 동적으로 제한하는 새로운 마이크로아키텍처 메커니즘을 제안합니다. L2 캐시 및 공유 메모리 포트 제어를 통해 소프트웨어 보안 우회를 방지하는 최후의 방어선을 구축합니다.
자원이 제한된 엣지 장치에서 효율적인 온디바이스 모델 적응을 위해 Hailo-8L 가속기를 활용한 이기종 적응 파이프라인을 제안합니다. 백본은 가속기에서 INT8로 실행하고 분류 헤드만 CPU에서 미세 조정하여 연산 효율과 에너지 절감을 동시에 달성했습니다.
CV-QKD의 고속 LDPC 디코딩을 위한 고정 소수점 산술 기반의 하드웨어 가속 프레임워크를 연구합니다. SPA, MSA, NMS 디코더의 성능을 수치 정밀도와 비교 분석하여 최적의 균형점을 제시합니다.
OpenROAD 프로젝트의 일부로 개발된 ORRAM은 표준 셀을 활용하여 RAM 블록을 생성하는 통합 메모리 생성기입니다. PDK에 종속되지 않고 사용자 정의 비트셀 없이도 배치 및 라우팅이 완료된 RAM을 생성하여 ASIC 설계 흐름을 최적화합니다.
FPGA SoC 환경에서 CNN 가속기의 결함 허용을 위해 제안된 계층적 디지털 트윈 프레임워크인 EIR을 소개합니다. 프로세싱 시스템(PS)의 유휴 자원을 활용하여 하드웨어 중복 없이도 효율적인 결함 탐지와 정밀한 복구를 구현합니다.
ArchSim은 컴퓨터 구조 시뮬레이션 연구의 복잡성을 해결하기 위해 제안된 새로운 프레임워크입니다. 선언적 그래프와 상태가 없는 러너를 통해 시뮬레이션 과정을 자동화하고 구조화하여 연구의 재현성과 확장성을 높였습니다.
ViT의 추론 지연 시간을 줄이기 위해 하드웨어와 소프트웨어를 공동 설계한 N:M 희소 트랜스포머 프레임워크를 제안합니다. MD-SpMM CUDA 커널과 3단계 휴리스틱 탐색을 통해 정확도를 유지하면서도 2.2배 이상의 속도 향상을 달성했습니다.
3D IC 설계 초기 단계에서 열, 배선, 캐시 효과를 통합적으로 평가할 수 있는 CLIP-3D 프레임워크를 제안합니다. 기존 시뮬레이터의 한계를 극복하여 실제 구현 가능한 BIPS를 예측하고 최적의 3D 레이아웃을 탐색합니다.
HeteroMosaic은 엣지 SoC의 CPU, iGPU, NPU를 효율적으로 활용하기 위한 이기종 우선 스케줄링 프레임워크입니다. 마이크로 배치 분해와 트레이스 가이드 공동 최적화를 통해 LLM 추론 속도를 높이고 에너지 소비를 크게 절감합니다.
임베디드 시스템의 안전성을 위해 Systolic Array 기반의 새로운 하드웨어 및 양자화 방식을 제안합니다. MSB를 우선 처리하는 좌측-우측 산술을 통해 실시간 적응형 정밀도 양자화와 결함 주입 공격에 대한 회복탄력성을 동시에 확보합니다.
부채널 공격 방어용 하드웨어 설계를 위해 개발된 오픈 소스 Verilog 시뮬레이터 Vogls를 소개합니다. 기존 시뮬레이터보다 빠르고 정확한 풀-타이밍 시뮬레이션을 지원하며, Python 인터페이스를 통해 효율적인 트레이스 수집이 가능합니다.
Diffusion Transformers(DiTs)의 추론 효율성을 높이기 위해 공간적·시간적 중복성을 줄이는 DSTAR 프레임워크를 제안합니다. 혼합 정밀도 양자화와 희소 어텐션 재사용을 결합한 소프트웨어-하드웨어 공동 설계 방식을 통해 성능 저하 없이 가속화를 달성했습니다.
하드웨어 및 메모리 결함으로 인한 DNN의 신뢰성 저하 문제를 해결하기 위해 CoG(무게 중심) 유도 가중치 교정 방법을 제안합니다. 재학습 없이 거리 인식 교정 규칙을 통해 결함을 탐지하고 복구하며, 다양한 네트워크 구조에서 높은 결함 허용 능력을 입증했습니다.
상위 수준 명세로부터 FPGA용 효율적인 하드웨어 파서를 자동 생성하는 오픈 소스 도구를 제안합니다. PIR(Parsing Intermediate Representation)을 통해 최적화된 SystemVerilog를 생성하며, 기존 방식 대비 높은 동작 주파수와 적은 리소스 사용량을 달성했습니다.
본 글은 현대 워크로드의 자원 활용 및 병목 현상을 단계별로 분석하는 시각화 기법인 캠페인 다이어그램을 제안합니다. 이 다이어그램은 컴퓨팅 처리량, 메모리 대역폭, 트래픽 볼륨, 지연 시간 등을 단일 그림에 통합하여 보여줍니다. 이를 통해 기존 도구들이 놓치기 쉬운 최적화 기회를 발견할 수 있습니다.