Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
모바일 기기에서 PIM(Processing-in-Memory)과 CPU의 동시 실행을 최적화하는 협력적 스케줄링 프레임워크 COSM을 제안합니다. CPU의 메모리 액세스 유휴 시간을 활용하여 PIM 명령을 통합함으로써, CPU 성능 저하를 최소화하면서 PIM 처리량을 대폭 향상시킵니다.
Snapdragon 8 Elite SoC 환경에서 모바일 VLM 추론의 단계별 하드웨어 특성을 분석한 연구입니다. NPU 활용 시 프리필과 디코드 단계의 성능 차이, 열 안정성 및 에너지 효율성을 검증하고 최적화된 포팅 방법을 제시합니다.
하드웨어 성능 측정값의 신뢰성을 보장하기 위해 해시 연결 증거 그래프를 활용한 자가 검증형 기록 방식을 제안합니다. 이 방식은 변조 방지가 가능하며, 독립적인 감사와 확률적 항등식을 통해 하드웨어의 조용한 오류를 효과적으로 탐지합니다.
Intel의 3.5D 이종 패키징 기술을 위한 사전 실리콘 펌웨어 및 하드웨어 공동 최적화 연구를 다룹니다. 열-전기 공동 시뮬레이션을 통해 워크로드 밀도 기반의 열 힌팅 기술이 전압 안정성과 HBM 누설 전류 억제에 미치는 효과를 입증했습니다.
CVA6 코어를 실시간 시스템에 최적화하여 확장한 CVA6-RT 프로세서를 소개합니다. TLB 파티셔닝과 스크래치패드 모드 등을 통해 실행 가변성을 줄이고 결정론적 성능을 제공합니다.
첨단 패키징 환경에서 발생하는 하드웨어 보안 위협에 대응하기 위해 나노전기기계 시스템(NEMS)을 활용한 새로운 보안 메커니즘을 제안합니다. NEMS 기반의 PUF와 공진 지문 등을 통해 역공학 및 부채널 공격에 강한 물리적 보안 솔루션을 제공합니다.
GRAINS는 대규모 게놈 그래프 분석 시 발생하는 데이터 이동 오버헤드를 줄이기 위해 스토리지 인식 알고리즘-아키텍처 공동 설계를 제안합니다. 인스토리지 및 인플래시 프로세싱을 통해 기존 시스템 대비 성능과 에너지 효율을 획기적으로 개선했습니다.
SegFold는 SpGEMM(희소 행렬-행렬 곱셈)의 효율성을 높이기 위해 미세 조정된 동적 데이터플로우를 사용하는 새로운 가속기입니다. 동적 스케줄링과 리매핑 기술을 통해 데이터 재사용을 최적화하고 부하 균형 문제를 해결합니다.
초저전력 에지 컴퓨팅을 위해 IMPLY 기반 멤리스티브 인메모리 컴퓨팅(IMC) 아키텍처와 ISA를 제안합니다. 폰 노이만 병목 현상을 해결하기 위해 RV32I 표준을 기반으로 설계되었으며, 시뮬레이션을 통해 기존 마이크로컨트롤러 대비 에너지 효율성을 입증했습니다.
FPGA 네트워크를 활용하여 100만 개의 p-bits를 갖춘 대규모 프로그래밍 가능한 확률적 컴퓨터를 구현했습니다. 단일 칩의 용량 한계를 극복하고 초당 1조 번 이상의 Gibbs 샘플링 속도를 달성하며, 분산 시스템의 성능을 결정하는 설계 규칙을 제시합니다.
FPGA 상에서 MSDF Digit-Serial 산술 연산을 활용하여 U-Net 아키텍처를 에너지 효율적으로 가속하는 MMA(Merged Multiply-Add) 구조를 제안합니다. 통합 파이프라인 설계를 통해 연산 지연을 줄이고 처리량을 높여, 기존 CPU 대비 최대 10배 높은 에너지 효율을 달성했습니다.
Croc는 RISC-V 플랫폼을 기반으로 한 엔드투엔드 오픈 소스 SoC 설계 및 제작 흐름을 제공합니다. 폐쇄형 EDA 도구 대신 오픈 소스 IP와 PDK를 활용하여 도메인 특화 칩 설계 교육을 가능하게 합니다.
Kolmogorov-Arnold 네트워크(KAN)에서 영감을 받아, 아날로그 소자의 비선형성을 활용한 저전력 물리적 신경망 구조를 제안합니다. 이 방식은 연속 제어 및 로봇 운동학 분야에서 기존 MLP보다 적은 노드로 효율적인 계산이 가능하며, CMOS 구현 시 약 30μW의 초저전력 동작을 목표로 합니다.
우주 잔류 물체(RSO) 탐지를 위해 FPGA 가속을 활용한 뉴로모픽 비전 시스템을 제안합니다. 이벤트 기반 카메라와 분산 처리 아키텍처를 결합하여 저전력 및 초저지연 성능을 구현했습니다.
메모리 중심 컴퓨팅(Processing-in-DRAM) 패러다임 전환에 따른 보안적 이점과 과제를 분석합니다. DRAM 기반의 진난수 생성기 및 PUF 기술을 통한 보안 강화 가능성과 함께, 읽기 방해 및 메모리 타이밍 채널과 같은 새로운 공격 표면 문제를 다룹니다.
A3C3는 AI 알고리즘과 가속기를 개별적으로 설계하던 기존 방식에서 벗어나, 신경망 구조와 하드웨어 구현을 동시에 최적화하는 통합 방법론입니다. 이를 통해 정확도, 지연 시간, 에너지 효율성 간의 균형을 맞춘 최적의 모델-가속기 쌍을 자동으로 생성할 수 있습니다.
COMPOSE는 재귀 제한 루프 가속을 위해 정적 타이밍 정보를 활용하여 PE(Processing Element)를 동적으로 형성하는 결합 가능한 CGRA 아키텍처입니다. 루프 간 연산을 공간적으로 융합하고 타이밍 슬랙을 활용하여 처리량을 높이고 데이터 이동 오버헤드를 줄입니다.
기존 트랜지스터의 에너지 스케일링 한계를 극복하기 위해 새로운 3단자 로직 소자인 고체 상태 트랜스커패시터(TCAP)를 제안합니다. TCAP는 소산성 수송 전류 대신 변위 전류를 사용하여 CMOS의 전압 및 전류 변조 한계를 극복하고 에너지 소비를 100배 낮출 수 있는 경로를 제시합니다.
반도체 산업이 2.5D 칩렛 생태계로 전환됨에 따라 발생하는 하드웨어 보안 위협과 대응 전략을 다룹니다. 인터포저 기반 통합 환경에서 발생하는 상호 연결 공격 및 캐시 일관성 악용 문제를 해결하기 위한 능동형 인터포저 기반의 보안 방어책을 제안합니다.
DRAM 셀의 데이터 기록 방식이 읽기 방해(read disturbance) 취약성에 미치는 영향인 'DejaVu' 현상을 실험적으로 증명했습니다. 데이터를 두 번 신중하게 쓰는 것이 비트 플립을 방지하고 PUD 연산의 신뢰성을 높이는 데 필수적임을 보여줍니다.