Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
DRAM 셀의 데이터 기록 방식이 읽기 방해(read disturbance) 취약성에 미치는 영향인 'DejaVu' 현상을 실험적으로 증명했습니다. 데이터를 두 번 신중하게 쓰는 것이 비트 플립을 방지하고 PUD 연산의 신뢰성을 높이는 데 필수적임을 보여줍니다.
2차원 분절 이온 트랩 양자 프로세서에서 T-접합을 활용한 셔틀링 효율성을 연구합니다. 1차원 선형 아키텍처와 비교하여 2D 아키텍처가 양자 회로 빌딩 블록의 확장성 측면에서 더 우수한 성능을 보임을 입증합니다.
Apple Neural Engine(ANE)의 아키텍처, 컴파일러, 펌웨어 및 데이터패스를 역공학하여 분석한 기술 보고서입니다. A11부터 M5까지의 칩셋을 대상으로 처리량, 에너지 효율, 가중치 압축 방식 등을 심층적으로 다룹니다.
AgentDSE는 LLM 코딩 에이전트를 활용하여 비효율적인 기존 아키텍처 설계 공간 탐색(DSE) 과정을 자동화하는 새로운 방법론입니다. 시뮬레이터를 블랙박스로 취급하는 대신 인간 설계자처럼 추론을 통해 탐색을 가이드함으로써 평가 횟수를 획기적으로 줄입니다.
NPU 환경에서 희소 행렬 곱셈(SpMM)의 성능을 최적화하기 위한 새로운 프레임워크 NeutronSparse를 제안합니다. 이기종 엔진 간의 협업 조율과 지역성 인식 타일 오케스트레이션을 통해 데이터 관리 병목 현상을 해결합니다.
멤리스티브 크로스바 패브릭을 활용하여 온칩 신경망을 위한 다층 저항성 시냅스 설계를 제안합니다. 이온 수송 물리 모델을 기반으로 에너지 효율적인 아날로그 VMM 연산과 인메모리 학습을 구현하여 LLM 구동에 최적화된 하드웨어 구조를 제시합니다.
SkyWater 130nm 공정을 활용하여 엣지 뉴로모픽 시스템을 위한 네 가지 디지털 IP 블록을 설계하고 구현했습니다. PVT 센서, 확률적 LIF 뉴런, STDP 컨트롤러, 멤리스티브 크로스바 컨트롤러를 포함하며, Tiny Tapeout을 통해 테이프아웃을 진행했습니다.
DRAM의 새로운 읽기 방해 현상인 ColumnDisturb 취약점을 해결하기 위한 ColumnKeeper 방법론을 제안합니다. 결정론적 방식(CK-D)과 확률적 방식(CK-P)을 통해 낮은 성능 및 면적 오버헤드로 비트 플립을 효과적으로 방지합니다.
SkyWater 130nm 공정을 활용하여 설계된 오픈 소스 확률적 Leaky Integrate-and-Fire(LIF) 뉴런에 관한 연구입니다. LFSR 기반의 무작위성을 통해 면적 효율성을 높였으며, 엣지 하드웨어에 최적화된 설계와 특성을 분석했습니다.
DRAM 내부에서 연산을 수행하는 PuD(Processing-using-DRAM) 시스템을 위한 새로운 벡터-스칼라 비교 알고리즘 Clutch를 제안합니다. 시간 코딩과 멀티 비트 청크 분할 방식을 통해 명령어 오버헤드를 줄이고 메모리 효율성을 극대화했습니다.
MOCAP은 웨이퍼 스케일 칩(WSC) 환경에서 LLM의 프리필(prefill) 단계를 가속화하기 위한 새로운 프레임워크입니다. 메모리 불균형과 지연 시간 불균형 문제를 해결하여 긴 컨텍스트 처리를 최적화합니다.
생물학적 데이터의 폭증으로 인한 기존 컴퓨팅 시스템의 한계를 분석하고, 이를 해결하기 위한 Arch4Health 이니셔티브를 소개합니다. 고성능, 에너지 효율성, 보안 및 개인정보 보호를 갖춘 의료 특화 컴퓨터 아키텍처의 필요성을 강조합니다.
HeteroViT는 차세대 X-선 검출기의 방대한 데이터를 실시간으로 축소하기 위해 설계된 단일 레이어 Vision Transformer 컨셉입니다. 하드웨어 공동 설계를 통해 ASIC, FPGA, GPU 파이프라인에 모델을 매핑하여 엣지 단계에서 데이터를 효율적으로 처리합니다.
HLS 설계 과정에서 C 명세와 HLS-C 구현체 간의 기능적 일관성을 검증하기 위한 지식 증강 에이전트 기반 프레임워크를 제안합니다. 이중 계층 일관성 확인 메커니즘과 지식 그래프를 활용하여 기존 LLM 기반 검증의 한계를 극복하고 높은 커버리지를 달성했습니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화한 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 데이터플로우 최적화와 이벤트 압축 기술을 통해 FPGA 상에서 높은 에너지 효율과 성능을 입증했습니다.
엣지 디바이스의 ML 추론 시 메모리 클록(EMC) 상태를 고려하지 않는 기존 DVFS 거버너의 한계를 지적합니다. EMC를 인지하는 재조정 모델을 통해 Jetson Orin NX 환경에서 QoS 미스율을 1.3%까지 낮추고 에너지 효율을 높일 수 있음을 입증했습니다.
에지 환경의 양자화된 신경망을 대상으로 누적된 비트 플립 결함이 미치는 영향을 분석하는 SPINE 프레임워크를 소개합니다. GDB 기반의 결함 주입을 통해 모델 재학습 없이 레이어별 결함 프로파일을 생성하고 효과적인 경화 전략을 제시합니다.
Ising 모델을 활용하여 조합 최적화 문제를 해결하기 위한 확률적 아키텍처 합성 및 시뮬레이션 도구를 제안합니다. 문제 특성에 따라 해밀토니안을 자동 구축하고 최적의 업데이트 알고리즘을 선택하는 적응형 전략을 제공합니다.
CGLA 아키텍처인 IMAX 상에서 Whisper 모델의 내적 커널을 효율적으로 오프로딩하는 설계 방안을 제안합니다. 커널 매핑과 버스트 스케줄링을 통해 에너지 효율을 극대화하며, 기존 Jetson AGX Orin 및 RTX 4090 대비 탁월한 에너지 효율성을 입증했습니다.
Tsetlin Machine(TM) 추론을 최적화하기 위해 RISC-V 기반의 저전력 축소 명령어 세트 프로세서를 설계했습니다. 이 설계는 프로그래밍 가능성을 유지하면서도 기존 BNN 대비 실행 시간을 대폭 단축하고 에너지 효율을 극대화합니다.