Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
강유전체 컴퓨팅 인 메모리(CIM) 기술을 활용하여 실시간 시계열 예측을 수행하는 아날로그 뉴로모픽 시스템 FerroNDS를 소개합니다. 이 시스템은 페로다이오드를 기반으로 연속 시간 동역학을 효과적으로 처리하며, 기존 디지털 시스템 대비 면적과 에너지 효율을 크게 개선했습니다.
KATANA는 상용 NPU를 활용하여 칼만 필터(LKF, EKF)를 고속·저전력으로 실행하는 매핑 기술을 제안합니다. 대수적 그래프 재작성을 통해 연산의 100%를 NPU 행렬 엔진에서 처리함으로써 CPU 대비 에너지 효율을 극대화합니다.
SiMRA(동시 다중 행 활성화)를 활용하여 상용 DRAM 칩에서 고유한 시그니처를 생성하는 SiMRA-PUF 기술을 제안합니다. 실험을 통해 DDR4 DRAM에서 높은 반복 가능성과 장치 간 고유성을 입증하였으며, 기존 기술 대비 낮은 지연 시간을 확인했습니다.
Ramulator 2.1은 현대적인 DRAM 표준과 메모리 컨트롤러 기능을 지원하는 구성 가능한 메모리 시스템 시뮬레이터입니다. Python 기반 인터페이스를 도입하여 사용성과 확장성을 높였으며, HBM3/4 및 LPDDR5/6 등 최신 규격을 지원합니다.
하드웨어 설계 보안 검증을 자동화하기 위해 RTL 트레이스 데이터로부터 정보 흐름 경로를 구축하는 새로운 접근 방식을 제안합니다. 기존 연구가 레지스터 간 정보 흐름 탐지에 국한되었던 한계를 넘어, 민감한 정보의 전체 전파 경로를 재현하는 데 집중합니다.
AMD XDNA2 NPU에서 AWQ와 같은 양자화된 LLM을 효율적으로 추론하기 위한 커널 라이브러리 TileFuse를 제안합니다. 혼합 정밀도 커널과 데이터플로우 설계를 통해 성능과 에너지 효율을 획기적으로 개선했습니다.
멀티 칩렛 GPU의 비균일 메모리 환경에서 데이터 지역성을 최적화하기 위한 Chiplet-Contiguous Layout을 제안합니다. 이 방식은 OS나 하드웨어 변경 없이 페이지 단위 배치와 호환되며, LLM 연산 시 원격 HBM 트래픽을 획기적으로 감소시킵니다.
엣지 바이오일렉트로닉스 시스템을 위해 에너지 효율을 극대화한 준-확률적 시스톨릭 아키텍처 BenDi를 제안합니다. BenDi는 다단계 최적화를 통해 기존 기술 대비 면적과 에너지 효율을 획기적으로 개선하면서도 높은 CNN 정확도를 유지합니다.
상온에서 작동하는 10,000 노드 p-큐비트 기반 뉴로모픽 프로세서 'Apollo'를 소개합니다. 양자 엔트로피를 활용해 초고속 확률론적 전이를 구현하며, 기존 극저온 양자 어닐러보다 효율적인 최적화 성능을 보여줍니다.
본 기사는 스파이킹 신경망(SNN)의 병렬성을 극대화하기 위한 하드웨어-소프트웨어 공동 설계 프레임워크인 SupraSNN을 소개합니다. SupraSNN은 시냅스와 뉴런 계산을 물리적으로 분리하여 높은 시냅스 레벨 병렬성을 달성하는 슈퍼스칼라 아키텍처를 채택했습니다. 이 아키텍처는 Multi-Cast Tree와 Merge Tree를 활용하며, FPGA 구현 결과 이전 대비 낮은 지연 시간과 높은 에너지 효율을 입증했습니다.
본 연구는 Memristor 기반 아날로그 컴퓨팅 환경에서 위치 인코딩이 야기하는 성능 저하 문제를 다룹니다. 가중치 및 정밀도 비트 비율 조정을 통해 실행 왜곡을 약 50% 감소시켰으며, 추가적으로 특정 선형 변환 제거를 통해 성능 저하를 약 30% 줄일 수 있음을 제시합니다.
현대 워크로드의 불규칙한 메모리 액세스 패턴을 해결하기 위한 지능형 데이터 프리페칭 기술을 조사합니다. 전통적인 방식의 한계를 분석하고, 머신러닝 기반 프리페처의 분류 체계와 성능 평가 기준을 제안합니다.
항공 수색 및 구조를 위해 불확실성을 인지하는 FeFET 기반 베이지안 추론 엔진을 제안합니다. 쓰기 동작을 제거한 CLT-GRNG를 통해 에너지 효율을 극대화하여 엣지 플랫폼에 최적화된 성능을 제공합니다.
현대 저전압 CPU에서 온도가 낮아질수록 전압 요구량이 높아지는 역 온도 의존성(ITD) 현상을 분석합니다. Intel Xeon CPU를 통해 효율성이 정점에 도달하는 최적 온도가 기존보다 높음을 입증하며, 이를 활용한 데이터 센터 에너지 절감 방안을 제시합니다.
AXI4MLIR 프레임워크에서 발생하는 CPU-가속기 간의 불필요한 데이터 복사 오버헤드를 해결하기 위한 제로 카피(zero-copy) 기술을 제안합니다. MLIR dialect 확장을 통해 DMA 매핑 메모리에 직접 버퍼를 할당함으로써 데이터 이동을 최적화합니다.
개인정보 보호를 위해 트랜지스터 공정 변이를 활용한 65-nm 뉴로모픽 인코더를 제안합니다. 초고차원 컴퓨팅(HDC)을 통해 에너지 효율적이고 보안성이 뛰어난 에지 생체 의학 지능 하드웨어 플랫폼을 구현했습니다.
SRAM 기반 Compute-in-Memory(DCiM)를 위한 정확도 설정 가능 부동 소수점 곱셈기 설계를 제안합니다. 가수부 분할 기반의 근사 곱셈기를 통해 하드웨어 면적과 전력을 획기적으로 절감하면서도 높은 수치적 충실도를 유지합니다.
에지 디바이스의 LLM 추론 효율을 높이기 위해 M3D DRAM 기반의 LUT PIM 가속기인 PALUTE를 제안합니다. LUT 조회를 통해 비선형 연산 비용을 줄이고, 수직 구조를 활용해 낮은 면적 오버헤드와 높은 병렬성을 달성했습니다.
65nm CMOS 공정을 기반으로 한 고효율 SNN용 NeuDW-CIM 매크로를 제안합니다. 비선형 수상돌기 모드와 Top-K Winner 모드를 통해 높은 정확도와 0.8 pJ/SOP의 뛰어난 에너지 효율을 달성했습니다.
Transformer 모델의 효율적인 가속을 위해 광학 트랜스포머 가속기(PTA)의 하드웨어/소프트웨어 공동 설계를 지원하는 DxPTA 방법론을 제안합니다. DxPTA는 제약 조건을 고려한 설계 공간 탐색을 통해 기존 방식보다 15.2배 빠른 탐색 속도와 최적화된 아키텍처를 제공합니다.