Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
RTL 기술을 기반으로 하드웨어 회로도를 생성하는 멀티모달 LLM의 성능을 평가하기 위한 벤치마크 MultModLM을 제안합니다. 실험 결과, 모델들이 시각적 회로도는 생성할 수 있으나 기능적 정확성은 낮으며, LLM 기반 평가 방식의 신뢰성 문제도 확인되었습니다.
유연 소자(Flexible Electronics) 환경에서 저전력 함수 근사를 위해 개발된 아날로그 Kolmogorov-Arnold Networks(AKANs)를 소개합니다. 하드웨어-소프트웨어 공동 최적화와 가지치기 기법을 통해 회로 결함 속에서도 정확한 연산을 수행하며 전력과 면적을 획기적으로 절감합니다.
멀티 프리시전 공간 아키텍처에서 혼합 정밀도 DNN을 최적화하기 위한 새로운 방법론 SEADA를 제안합니다. SEADA는 시스템 수준의 비용 모델과 비트 수준 엔트로피 기반의 정밀도 선택을 통해 효율적인 매핑을 지원합니다.
Snapdragon 8 Elite SoC 환경에서 모바일 VLM 추론의 단계별 하드웨어 특성을 분석한 연구입니다. NPU 활용 시 프리필과 디코드 단계의 성능 차이, 열 안정성 및 에너지 효율성을 검증하고 최적화된 포팅 방법을 제시합니다.
하드웨어 성능 측정값의 신뢰성을 보장하기 위해 해시 연결 증거 그래프를 활용한 자가 검증형 기록 방식을 제안합니다. 이 방식은 변조 방지가 가능하며, 독립적인 감사와 확률적 항등식을 통해 하드웨어의 조용한 오류를 효과적으로 탐지합니다.
본 논문은 현대 기술 시스템 설계의 복잡성을 해결하기 위해 딥러닝과 생성형 AI를 활용한 계산 설계 합성(CDS) 프레임워크를 제안합니다. e-drive 시스템과 공간 차원 결정 사례를 통해 시뮬레이션 기반 최적화를 넘어선 자율 설계의 가능성을 제시합니다.
뉴로모픽 컴퓨팅을 위한 비매개변수적 1-Bit 희소 모델의 고주파 기하학적 노이즈 완화 방법을 제안합니다. 8-bit 변환 행렬을 통해 초희소 이진 코드를 생성하며, 하드웨어 레벨의 저역 통과 필터로 재구성 오차를 최소화하는 프레임워크를 제시합니다.
DRAM의 비용 문제를 해결하기 위한 신흥 메모리 기술인 LtRAM의 단점을 극복하기 위한 새로운 하드웨어/소프트웨어 인터페이스 설계를 제안합니다. 애플리케이션 읽기 전용 메모리(AROM) 개념을 도입하여 LtRAM 관리 책임을 하드웨어에서 운영체제로 전환함으로써 성능과 비용 효율성을 동시에 달성하고자 합니다.
궤도 데이터 센터(ODC)에서 LLM 학습 시 발생하는 열 간섭 문제를 해결하기 위한 연구를 소개합니다. 열 인지형 이질성 테제를 바탕으로 워크로드를 최적의 냉각 유닛으로 이동시키는 TLB 프레임워크를 제안합니다.
Intel의 3.5D 이종 패키징 기술을 위한 사전 실리콘 펌웨어 및 하드웨어 공동 최적화 연구를 다룹니다. 열-전기 공동 시뮬레이션을 통해 워크로드 밀도 기반의 열 힌팅 기술이 전압 안정성과 HBM 누설 전류 억제에 미치는 효과를 입증했습니다.
CVA6 코어를 실시간 시스템에 최적화하여 확장한 CVA6-RT 프로세서를 소개합니다. TLB 파티셔닝과 스크래치패드 모드 등을 통해 실행 가변성을 줄이고 결정론적 성능을 제공합니다.
SOLAR는 PyTorch 및 JAX 소스 코드로부터 AI 모델의 이론적 최소 실행 시간인 광속(Speed-of-Light) 경계를 자동으로 도출하는 프레임워크입니다. LLM과 결정론적 흐름을 결합하여 검증된 경계를 생성하며, 모델 최적화 및 하드웨어 프로비저닝을 위한 통찰력을 제공합니다.
기밀 가상 머신(CVM) 환경에서 발생하는 데이터베이스 쿼리 성능 저하 문제를 해결하기 위해 CVM 인지 비용 보정 방식을 제안합니다. 기존 옵티마이저의 비용 모델이 비암호화 VM에 맞춰져 있는 문제를 물리적 프록시를 통한 모델링으로 해결하여 성능을 최대 48% 개선했습니다.
첨단 패키징 환경에서 발생하는 하드웨어 보안 위협에 대응하기 위해 나노전기기계 시스템(NEMS)을 활용한 새로운 보안 메커니즘을 제안합니다. NEMS 기반의 PUF와 공진 지문 등을 통해 역공학 및 부채널 공격에 강한 물리적 보안 솔루션을 제공합니다.
GRAINS는 대규모 게놈 그래프 분석 시 발생하는 데이터 이동 오버헤드를 줄이기 위해 스토리지 인식 알고리즘-아키텍처 공동 설계를 제안합니다. 인스토리지 및 인플래시 프로세싱을 통해 기존 시스템 대비 성능과 에너지 효율을 획기적으로 개선했습니다.
SegFold는 SpGEMM(희소 행렬-행렬 곱셈)의 효율성을 높이기 위해 미세 조정된 동적 데이터플로우를 사용하는 새로운 가속기입니다. 동적 스케줄링과 리매핑 기술을 통해 데이터 재사용을 최적화하고 부하 균형 문제를 해결합니다.
Apple M4 Pro 칩셋에서 GPU 작업 종료 후 남겨지는 잔류 캐시 상태를 분석한 연구입니다. GPU 커널 실행 후 CPU 성능에 미치는 캐시 변위 현상을 규명하고, 이를 완화할 수 있는 소프트웨어 복구 메커니즘을 제안합니다.
초저전력 에지 컴퓨팅을 위해 IMPLY 기반 멤리스티브 인메모리 컴퓨팅(IMC) 아키텍처와 ISA를 제안합니다. 폰 노이만 병목 현상을 해결하기 위해 RV32I 표준을 기반으로 설계되었으며, 시뮬레이션을 통해 기존 마이크로컨트롤러 대비 에너지 효율성을 입증했습니다.
CHIA는 에이전트 기반 AI를 활용하여 하드웨어와 소프트웨어를 공동 설계할 수 있는 오픈 소스 프레임워크입니다. 복잡한 설계 워크플로우를 유향 순환 그래프 형태인 'CHIA 루프'로 구조화하여 대규모 시스템 설계 연구를 지원합니다.
본 논문은 에지 컴퓨팅 환경에서 CGRA의 설계 요소인 프로세싱 엘리먼트의 이질성과 Scratchpad Memory(SPM)가 연산 성능에 미치는 영향을 분석합니다. FFT, GEMM 및 트랜스포머 워크로드를 통해 데이터 이동 최적화와 에너지 효율성 간의 트레이드오프를 평가합니다.