Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
HLS 설계를 위해 계약 정렬형 멀티 에이전트 워크플로우인 ContractHIL-HLS를 제안합니다. 자연어 요구사항을 구조화된 계약으로 변환하고, 하드웨어 피드백 루프를 통해 설계의 정확도와 성능을 최적화합니다.
LLM 추론 성능을 최적화하기 위해 연산자 스케줄링과 가중치 레이아웃을 공동 최적화하는 DOPS 프레임워크를 제안합니다. NPU와 PIM 등 이기종 하드웨어 환경에서 Prefill-Decode 분리 방식보다 뛰어난 속도 향상을 입증했습니다.
VPR-Evolve는 LLM 멀티 에이전트를 활용하여 FPGA 배치 및 라우팅 엔진인 VPR의 소스 코드를 설계별로 최적화하는 프레임워크입니다. 하이퍼파라미터 튜닝을 넘어 코드 수준의 진화를 통해 회로 성능과 도구 실행 시간을 획기적으로 개선합니다.
배터리가 없는 간헐적 컴퓨팅 시스템의 시간 유지를 위해 스핀트로닉스 메모리인 MTJ의 확률적 유지 손실을 활용한 FLINT 기술을 제안합니다. 기존 커패시터 방식보다 에너지 효율이 11배 높고 면적은 작으면서도, 소자 노화에 영향을 받지 않고 정밀한 시간 추적이 가능합니다.
MoE 추론 시 발생하는 라우팅 분포 왜곡 문제를 해결하기 위한 분포 인식 프레임워크와 DA-MoE 런타임을 제안합니다. 실시간 라우팅 히스토그램을 활용해 최적의 fused-MoE 커널을 선택함으로써 DeepSeek-V3 등에서 추론 지연 시간을 크게 개선했습니다.
CircuitWeave는 텍스트 명세와 회로도(Schematics)를 결합하여 실행 가능한 RTL을 생성하는 멀티모달 프레임워크입니다. 회로의 토폴로지와 동작 계약을 통합한 '회로 계약'을 통해 텍스트 기반 LLM의 구조적 한계를 극복합니다.
SPARC은 프리실리콘 단계에서 프로세서의 전력 부채널 누설(PSCL)을 자동으로 탐지하고 근본 원인을 분석하는 프레임워크입니다. 정보 흐름 추적(IFT) 기술을 통해 누설을 특정 하드웨어 신호와 소프트웨어 명령어로 매핑하며, 기존 방식보다 8배 빠른 시뮬레이션 속도를 제공합니다.
PIMID는 다양한 메모리 기술과 실행 모델을 지원하는 풀 시스템 시뮬레이터입니다. 기존 시뮬레이터의 한계를 넘어 메모리 계층 구조와 호스트-디바이스 간의 엔드 투 엔드 시간 및 에너지 분석을 제공합니다.
칩렛 설계 시 발생하는 신호 무결성 문제를 해결하기 위해, gem5 시뮬레이터 내에서 런타임 PHY 동작을 정밀하게 모델링하는 DICE 프레임워크를 제안합니다. 기존의 단순화된 모델이 간과하던 채널 상태 변화와 패킷 재전송 등의 동적 효과를 반영하여 시뮬레이션 정확도를 높였습니다.
멀티태스크 RF 신호 인식을 위해 설계된 이기종 신경망 가속기를 제안합니다. CNN과 LSDec 기술을 결합하여 AMR, HT-CC 탐지, GNSS 재밍 분류를 효율적으로 수행하며, 저전력 및 저지연 특성을 갖추어 에지 장치 활용에 최적화되었습니다.
RED-PIM은 Processing-in-Memory(PIM) 기술을 활용하여 Transformer 모델의 어텐션 연산 시 발생하는 데이터 이동 문제를 해결하는 알고리즘-아키텍처 공동 설계 연구입니다. 뱅크 간 통신을 최소화하고 중간 행렬 크기를 축소하여 추론 성능과 확장성을 크게 개선했습니다.
LLM 추론의 병목 현상을 해결하기 위해 정적 프루닝(SP)과 동적 프루닝(DP)을 통합한 SPDP 프레임워크를 제안합니다. 새로운 Tiled-CBC 형식과 GPU 커널 설계를 통해 메모리 대역폭 효율과 연산 강도를 동시에 최적화합니다.
Mamba-2와 같은 SSD 모델의 추론 오버헤드를 해결하기 위해 이기종 메모리 중심 가속기인 HEMERA를 제안합니다. 스트리밍-재귀적 데이터플로우를 통해 중간 저장 공간을 줄이고 에너지 효율을 극대화합니다.
Mammal은 보호자가 착용하는 컴퓨팅 의류를 통해 영아의 수유 상태를 모니터링하는 연구입니다. 신체 간 신호 전달 기술을 활용하여 영아에게 센서를 부착하지 않고도 심박수, 젖물림 지속 시간, 우유 섭취량 등을 정밀하게 추정합니다.
비볼록 및 볼록 최적화를 결합한 새로운 다단계 칩 플로어플래닝 프레임워크를 제안합니다. 이차 배치, Adam 기반 투영 경사법, 로그 변환 모델을 순차적으로 적용하여 와이어 길이와 모듈 중첩을 효과적으로 최소화합니다.
디지털 파형 데이터에 대한 LLM의 시계열 추론 능력을 평가하기 위한 오픈 소스 벤치마크인 WaveformQA를 제안합니다. 다중 신호 상관관계와 이벤트 순서 등 8개 카테고리의 질문을 통해 모델의 한계를 분석합니다.
DNN 추론 시 비트 위치별 결함 민감도를 분석하여, 중요도가 낮은 비트는 보호하지 않고 상위 비트만 선택적으로 보호하는 불균등 오류 보호(UEP) 기법을 제안합니다. 이를 통해 ECC 면적을 줄이고 에너지 효율을 높이면서도 모델의 성능을 유지할 수 있음을 입증했습니다.
AlphaRoute는 VLSI 글로벌 라우팅의 복잡한 조합 최적화 문제를 해결하기 위해 LLM을 의미론적 정책 최적화 도구로 활용하는 새로운 프레임워크입니다. SHAP 기반 오버플로 분해와 동적 페널티 조정을 통해 기존 방식보다 월등한 성능을 보여줍니다.
GPU 메모리 계층의 NUMA 아키텍처를 분석하기 위한 새로운 방법론인 DGNA를 제안합니다. NVIDIA A100 및 H100 GPU를 대상으로 마이크로벤치마킹과 가우시안 혼합 모델을 활용해 L2 캐시 및 DRAM의 지연 시간과 메모리 할당 전략을 규명했습니다.
본 논문은 순차적 프로그래밍 모델을 유지하면서도 세밀한 파이프라인 제어가 가능한 새로운 HLS 도구를 제안합니다. 가시성 제어(Visibility Control) 기술을 통해 스톨링, 바이패싱 등 해저드 해결 전략을 통합하여 RTL 수준의 성능을 달성합니다.