Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화하는 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 이벤트 기반 데이터플로우 최적화와 이벤트 압축 기술을 통해 기존 FPGA 기반 가속기 대비 높은 에너지 효율을 달성했습니다.
우주 잔류 물체(RSO) 탐지를 위해 FPGA 가속을 활용한 뉴로모픽 비전 시스템을 제안합니다. 이벤트 기반 카메라와 분산 처리 아키텍처를 결합하여 저전력 및 초저지연 성능을 구현했습니다.
메모리 중심 컴퓨팅(Processing-in-DRAM) 패러다임 전환에 따른 보안적 이점과 과제를 분석합니다. DRAM 기반의 진난수 생성기 및 PUF 기술을 통한 보안 강화 가능성과 함께, 읽기 방해 및 메모리 타이밍 채널과 같은 새로운 공격 표면 문제를 다룹니다.
A3C3는 AI 알고리즘과 가속기를 개별적으로 설계하던 기존 방식에서 벗어나, 신경망 구조와 하드웨어 구현을 동시에 최적화하는 통합 방법론입니다. 이를 통해 정확도, 지연 시간, 에너지 효율성 간의 균형을 맞춘 최적의 모델-가속기 쌍을 자동으로 생성할 수 있습니다.
COMPOSE는 재귀 제한 루프 가속을 위해 정적 타이밍 정보를 활용하여 PE(Processing Element)를 동적으로 형성하는 결합 가능한 CGRA 아키텍처입니다. 루프 간 연산을 공간적으로 융합하고 타이밍 슬랙을 활용하여 처리량을 높이고 데이터 이동 오버헤드를 줄입니다.
LLM을 이용한 RTL Assertion 생성 시 발생하는 품질 문제, 증명 비용 가변성, 실패 트레이스 해석의 어려움을 해결하기 위한 경량 오픈 소스 프레임워크를 제안합니다. 변이 유도 정제, 솔버 선택, 인과적 서사 합성을 결합하여 생성된 속성의 신뢰도를 높이는 품질 인지형 폐쇄 루프를 구현했습니다.
첨단 공정 노드에서 아날로그 및 혼성 신호(AMS) 레이아웃 자동화를 위한 양자화된 행 높이 기반 합성 방법론을 제안합니다. 이 방법론은 회로 요구 사항에 맞춰 행 높이를 최적화하여 설계 격차를 줄이고 면적 효율성을 높입니다.
기존 트랜지스터의 에너지 스케일링 한계를 극복하기 위해 새로운 3단자 로직 소자인 고체 상태 트랜스커패시터(TCAP)를 제안합니다. TCAP는 소산성 수송 전류 대신 변위 전류를 사용하여 CMOS의 전압 및 전류 변조 한계를 극복하고 에너지 소비를 100배 낮출 수 있는 경로를 제시합니다.
NVIDIA L40 GPU의 L2 캐시 지연 시간이 SM(Streaming Multiprocessor) 위치에 따라 비균일하게 나타난다는 연구 결과입니다. 이를 통해 장치의 물리적 정체성을 식별하는 지문 인식(fingerprinting)이 가능하며, 지연 시간 기반 작업 분산 시 성능을 최대 11% 향상할 수 있습니다.
반도체 산업이 2.5D 칩렛 생태계로 전환됨에 따라 발생하는 하드웨어 보안 위협과 대응 전략을 다룹니다. 인터포저 기반 통합 환경에서 발생하는 상호 연결 공격 및 캐시 일관성 악용 문제를 해결하기 위한 능동형 인터포저 기반의 보안 방어책을 제안합니다.
DRAM 셀의 데이터 기록 방식이 읽기 방해(read disturbance) 취약성에 미치는 영향인 'DejaVu' 현상을 실험적으로 증명했습니다. 데이터를 두 번 신중하게 쓰는 것이 비트 플립을 방지하고 PUD 연산의 신뢰성을 높이는 데 필수적임을 보여줍니다.
2차원 분절 이온 트랩 양자 프로세서에서 T-접합을 활용한 셔틀링 효율성을 연구합니다. 1차원 선형 아키텍처와 비교하여 2D 아키텍처가 양자 회로 빌딩 블록의 확장성 측면에서 더 우수한 성능을 보임을 입증합니다.
Apple Neural Engine(ANE)의 아키텍처, 컴파일러, 펌웨어 및 데이터패스를 역공학하여 분석한 기술 보고서입니다. A11부터 M5까지의 칩셋을 대상으로 처리량, 에너지 효율, 가중치 압축 방식 등을 심층적으로 다룹니다.
AgentDSE는 LLM 코딩 에이전트를 활용하여 비효율적인 기존 아키텍처 설계 공간 탐색(DSE) 과정을 자동화하는 새로운 방법론입니다. 시뮬레이터를 블랙박스로 취급하는 대신 인간 설계자처럼 추론을 통해 탐색을 가이드함으로써 평가 횟수를 획기적으로 줄입니다.
NPU 환경에서 희소 행렬 곱셈(SpMM)의 성능을 최적화하기 위한 새로운 프레임워크 NeutronSparse를 제안합니다. 이기종 엔진 간의 협업 조율과 지역성 인식 타일 오케스트레이션을 통해 데이터 관리 병목 현상을 해결합니다.
멤리스티브 크로스바 패브릭을 활용하여 온칩 신경망을 위한 다층 저항성 시냅스 설계를 제안합니다. 이온 수송 물리 모델을 기반으로 에너지 효율적인 아날로그 VMM 연산과 인메모리 학습을 구현하여 LLM 구동에 최적화된 하드웨어 구조를 제시합니다.
SkyWater 130nm 공정을 활용하여 엣지 뉴로모픽 시스템을 위한 네 가지 디지털 IP 블록을 설계하고 구현했습니다. PVT 센서, 확률적 LIF 뉴런, STDP 컨트롤러, 멤리스티브 크로스바 컨트롤러를 포함하며, Tiny Tapeout을 통해 테이프아웃을 진행했습니다.
DRAM의 새로운 읽기 방해 현상인 ColumnDisturb 취약점을 해결하기 위한 ColumnKeeper 방법론을 제안합니다. 결정론적 방식(CK-D)과 확률적 방식(CK-P)을 통해 낮은 성능 및 면적 오버헤드로 비트 플립을 효과적으로 방지합니다.
SkyWater 130nm 공정을 활용하여 설계된 오픈 소스 확률적 Leaky Integrate-and-Fire(LIF) 뉴런에 관한 연구입니다. LFSR 기반의 무작위성을 통해 면적 효율성을 높였으며, 엣지 하드웨어에 최적화된 설계와 특성을 분석했습니다.
DRAM 내부에서 연산을 수행하는 PuD(Processing-using-DRAM) 시스템을 위한 새로운 벡터-스칼라 비교 알고리즘 Clutch를 제안합니다. 시간 코딩과 멀티 비트 청크 분할 방식을 통해 명령어 오버헤드를 줄이고 메모리 효율성을 극대화했습니다.