Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
MOCAP은 웨이퍼 스케일 칩(WSC) 환경에서 LLM의 프리필(prefill) 단계를 가속화하기 위한 새로운 프레임워크입니다. 메모리 불균형과 지연 시간 불균형 문제를 해결하여 긴 컨텍스트 처리를 최적화합니다.
생물학적 데이터의 폭증으로 인한 기존 컴퓨팅 시스템의 한계를 분석하고, 이를 해결하기 위한 Arch4Health 이니셔티브를 소개합니다. 고성능, 에너지 효율성, 보안 및 개인정보 보호를 갖춘 의료 특화 컴퓨터 아키텍처의 필요성을 강조합니다.
HeteroViT는 차세대 X-선 검출기의 방대한 데이터를 실시간으로 축소하기 위해 설계된 단일 레이어 Vision Transformer 컨셉입니다. 하드웨어 공동 설계를 통해 ASIC, FPGA, GPU 파이프라인에 모델을 매핑하여 엣지 단계에서 데이터를 효율적으로 처리합니다.
HLS 설계 과정에서 C 명세와 HLS-C 구현체 간의 기능적 일관성을 검증하기 위한 지식 증강 에이전트 기반 프레임워크를 제안합니다. 이중 계층 일관성 확인 메커니즘과 지식 그래프를 활용하여 기존 LLM 기반 검증의 한계를 극복하고 높은 커버리지를 달성했습니다.
SNN의 불규칙한 희소성을 활용하여 에너지 효율을 극대화한 범용 풀-이벤트 뉴로모픽 아키텍처 ExSpike를 제안합니다. 데이터플로우 최적화와 이벤트 압축 기술을 통해 FPGA 상에서 높은 에너지 효율과 성능을 입증했습니다.
엣지 디바이스의 ML 추론 시 메모리 클록(EMC) 상태를 고려하지 않는 기존 DVFS 거버너의 한계를 지적합니다. EMC를 인지하는 재조정 모델을 통해 Jetson Orin NX 환경에서 QoS 미스율을 1.3%까지 낮추고 에너지 효율을 높일 수 있음을 입증했습니다.
에지 환경의 양자화된 신경망을 대상으로 누적된 비트 플립 결함이 미치는 영향을 분석하는 SPINE 프레임워크를 소개합니다. GDB 기반의 결함 주입을 통해 모델 재학습 없이 레이어별 결함 프로파일을 생성하고 효과적인 경화 전략을 제시합니다.
Ising 모델을 활용하여 조합 최적화 문제를 해결하기 위한 확률적 아키텍처 합성 및 시뮬레이션 도구를 제안합니다. 문제 특성에 따라 해밀토니안을 자동 구축하고 최적의 업데이트 알고리즘을 선택하는 적응형 전략을 제공합니다.
CGLA 아키텍처인 IMAX 상에서 Whisper 모델의 내적 커널을 효율적으로 오프로딩하는 설계 방안을 제안합니다. 커널 매핑과 버스트 스케줄링을 통해 에너지 효율을 극대화하며, 기존 Jetson AGX Orin 및 RTX 4090 대비 탁월한 에너지 효율성을 입증했습니다.
Tsetlin Machine(TM) 추론을 최적화하기 위해 RISC-V 기반의 저전력 축소 명령어 세트 프로세서를 설계했습니다. 이 설계는 프로그래밍 가능성을 유지하면서도 기존 BNN 대비 실행 시간을 대폭 단축하고 에너지 효율을 극대화합니다.
CNN과 유전 알고리즘을 활용하여 3포트 Doherty 전력 증폭기용 픽셀화된 결합기를 설계하는 새로운 방법론을 제안합니다. GaN HEMT 프로토타입을 통해 높은 피크 드레인 효율과 우수한 선형성을 입증했습니다.
CNN과 유전 알고리즘을 결합하여 픽셀화된 마이크로파 필터 설계를 자동화하는 딥러닝 연구입니다. 전기-광학 측정을 통해 AI가 생성한 설계의 전기장 패턴을 검증하였으며, 시뮬레이션과 실제 측정 결과가 높은 일치성을 보였습니다.
CMOS 기반 메모리를 대체할 유망한 기술인 멤리스터(ReRAM, STT-RAM)의 특성과 신뢰성 위협을 분석합니다. 읽기/쓰기 오류 및 소프트 에러 문제를 다루며, 이를 해결하기 위한 최신 기술과 컴퓨팅 유닛으로서의 활용 가능성을 제시합니다.
CHERI의 시간적 메모리 안전성을 강화하기 위한 새로운 아키텍처 확장인 CHERI-D를 제안합니다. 객체 ID 메타데이터를 인라인으로 결합하여 기존 소프트웨어 방식의 성능 오버헤드를 줄이고 강력한 Use-After-Free 완화를 지원합니다.
Processing-using-DRAM(PuD) 연산 시 발생하는 데이터 오염 현상인 'PuDGhost'를 분석한 연구입니다. DRAM 밀도가 높아짐에 따라 비활성 행 및 인접 컬럼의 간섭으로 인해 연산 결과가 왜곡되는 문제를 실험적으로 증명했습니다.
분리형 추론(Disaggregated Inference) 아키텍처에서 발생하는 자원 경쟁과 무질서 비용(PoA)을 게임 이론으로 분석한 연구입니다. GPU 포화 상태에 따른 지연 시간 변화를 규명하고, 이를 최적화하기 위한 적응형 컨트롤러를 제안합니다.
본 논문은 GPU와 신흥 AI 가속기 간의 LLM 추론 성능을 Prefill 및 Decode 단계로 나누어 비교 분석합니다. Llama2-7B를 활용해 TTFT와 TPOT 지표를 측정하며, 각 가속기 플랫폼의 단계별 강점과 이기종 분리(disaggregation) 환경에서의 성능을 연구합니다.
HLS(고수준 합성) 설계 과정에서 Golden C와 HLS-C 구현 간의 기능적 일관성을 검증하기 위한 지식 증강 에이전트 기반 프레임워크를 제안합니다. 지식 그래프와 이중 계층 일관성 확인 메커니즘을 통해 기존 LLM 기반 검증의 한계를 극복하고 높은 커버리지를 달성했습니다.
초저사양 마이크로컨트롤러(MCU) 환경에서 FastGRNN을 효율적으로 배포하기 위한 압축 및 양자화 파이프라인을 제안합니다. Arduino와 MSP430 플랫폼에서 실시간 추론과 극도로 낮은 에너지 소비를 달성하는 엔드 투 엔드 재현 연구를 다룹니다.
열역학적 컴퓨팅을 활용하여 mRNA 코돈 최적화 문제를 해결하는 새로운 하드웨어 기반 접근 방식을 제안합니다. 기존 GPU 대비 약 10^6배의 에너지 절감 효과를 보여주며, 제약 R&D 분야의 에너지 효율적인 계산 가능성을 제시합니다.