Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
CNN과 유전 알고리즘을 활용하여 3포트 Doherty 전력 증폭기용 픽셀화된 결합기를 설계하는 새로운 방법론을 제안합니다. GaN HEMT 프로토타입을 통해 높은 피크 드레인 효율과 우수한 선형성을 입증했습니다.
CNN과 유전 알고리즘을 결합하여 픽셀화된 마이크로파 필터 설계를 자동화하는 딥러닝 연구입니다. 전기-광학 측정을 통해 AI가 생성한 설계의 전기장 패턴을 검증하였으며, 시뮬레이션과 실제 측정 결과가 높은 일치성을 보였습니다.
CMOS 기반 메모리를 대체할 유망한 기술인 멤리스터(ReRAM, STT-RAM)의 특성과 신뢰성 위협을 분석합니다. 읽기/쓰기 오류 및 소프트 에러 문제를 다루며, 이를 해결하기 위한 최신 기술과 컴퓨팅 유닛으로서의 활용 가능성을 제시합니다.
CHERI의 시간적 메모리 안전성을 강화하기 위한 새로운 아키텍처 확장인 CHERI-D를 제안합니다. 객체 ID 메타데이터를 인라인으로 결합하여 기존 소프트웨어 방식의 성능 오버헤드를 줄이고 강력한 Use-After-Free 완화를 지원합니다.
Processing-using-DRAM(PuD) 연산 시 발생하는 데이터 오염 현상인 'PuDGhost'를 분석한 연구입니다. DRAM 밀도가 높아짐에 따라 비활성 행 및 인접 컬럼의 간섭으로 인해 연산 결과가 왜곡되는 문제를 실험적으로 증명했습니다.
분리형 추론(Disaggregated Inference) 아키텍처에서 발생하는 자원 경쟁과 무질서 비용(PoA)을 게임 이론으로 분석한 연구입니다. GPU 포화 상태에 따른 지연 시간 변화를 규명하고, 이를 최적화하기 위한 적응형 컨트롤러를 제안합니다.
본 논문은 GPU와 신흥 AI 가속기 간의 LLM 추론 성능을 Prefill 및 Decode 단계로 나누어 비교 분석합니다. Llama2-7B를 활용해 TTFT와 TPOT 지표를 측정하며, 각 가속기 플랫폼의 단계별 강점과 이기종 분리(disaggregation) 환경에서의 성능을 연구합니다.
HLS(고수준 합성) 설계 과정에서 Golden C와 HLS-C 구현 간의 기능적 일관성을 검증하기 위한 지식 증강 에이전트 기반 프레임워크를 제안합니다. 지식 그래프와 이중 계층 일관성 확인 메커니즘을 통해 기존 LLM 기반 검증의 한계를 극복하고 높은 커버리지를 달성했습니다.
초저사양 마이크로컨트롤러(MCU) 환경에서 FastGRNN을 효율적으로 배포하기 위한 압축 및 양자화 파이프라인을 제안합니다. Arduino와 MSP430 플랫폼에서 실시간 추론과 극도로 낮은 에너지 소비를 달성하는 엔드 투 엔드 재현 연구를 다룹니다.
열역학적 컴퓨팅을 활용하여 mRNA 코돈 최적화 문제를 해결하는 새로운 하드웨어 기반 접근 방식을 제안합니다. 기존 GPU 대비 약 10^6배의 에너지 절감 효과를 보여주며, 제약 R&D 분야의 에너지 효율적인 계산 가능성을 제시합니다.
VLSI 물리적 설계를 위한 LLM/VLM 에이전트의 능력을 평가하는 새로운 벤치마크인 PDAGENT-BENCH를 소개합니다. 이 벤치마크는 개념적 이해부터 실제 EDA 도구 활용까지 5가지 핵심 차원을 다루며, 현재 모델들의 한계와 인간 협업 워크플로우의 효과를 분석합니다.
3D IC의 고해상도 열 시뮬레이션을 위해 GPU 가속을 지원하는 희소 행렬 솔버인 CUTh-Solver를 제안합니다. DIA 압축 저장, 병합된 메모리 액세스, 혼합 정밀도 전략을 통해 기존 범용 라이브러리 대비 탁월한 성능 향상을 달성했습니다.
ComPart는 하이퍼그래프 분할 품질을 높이기 위해 커뮤니티 탐지 기술을 사후 조밀화 단계에 통합한 새로운 프레임워크입니다. 언코어스닝 과정에서 커뮤니티 구조를 활용해 지역 최적해를 극복하고 전역적으로 더 우수한 분할 솔루션을 탐색합니다.
IMPart는 대규모 k-way 하이퍼그래프 분할을 위해 메메틱 연산을 단일 다단계 프레임워크의 언조립 단계에 통합한 새로운 프레임워크입니다. 기존 방식보다 실행 시간을 단축하면서도 국소 최적해를 효과적으로 탈출하여 더 높은 품질의 솔루션을 제공합니다.
AUTOGATE는 LLM과 ML을 결합하여 RTL 설계의 동적 전력을 최적화하는 에이전트 기반 프레임워크입니다. 파형 분석과 계층적 멀티 에이전트 아키텍처를 통해 대규모 코드베이스에서도 효율적인 클록 게이팅을 수행합니다.
CERN LHC의 jet tagging을 위해 AMD Versal AI Engine에 최적화된 양자화된 Transformer 구현을 제안합니다. Python 모델 설명으로부터 Vitis 그래프 코드를 자동 생성하는 재사용 가능한 소프트웨어 프레임워크를 소개합니다.
HAMON은 장기 시계열 예측을 위해 학습 가능한 위상 마스크와 자유 공간 회절을 활용하는 수동형 광학 시퀀스 혼합 기술을 제안합니다. 디지털 시퀀스 혼합 레이어 없이 수동형 광학 전파만으로 예측을 수행하며, 주요 벤치마크에서 기존 디지털 베이스라인보다 우수한 성능을 입증했습니다.
멀티 칩렛 GPU 환경에서 LLM의 GEMM 연산 시 발생하는 리모트 HBM 트래픽을 최소화하기 위한 타일 수준의 로컬리티 시뮬레이터를 제안합니다. 시뮬레이션 결과, CTA 순회 방식과 데이터 배치 전략에 따라 트래픽 차이가 극명하게 나타남을 확인했습니다.
Google의 TPU v2부터 Ironwood까지 5세대에 걸친 아키텍처 진화 과정을 다룬 논문입니다. AI 워크로드 변화에 대응하는 확장성, 회복 탄력성, 전력 효율성 및 지속 가능성을 중심으로 하드웨어의 비약적인 성능 향상을 분석합니다.
스마트 AR 글래스의 효율적인 1인칭 시점 인지를 위한 시스템 프레임워크 EPIC을 제안합니다. 시선, 포즈, 관성 신호를 활용해 정보량이 많은 데이터만 선별적으로 처리함으로써 메모리와 에너지 소비를 획기적으로 줄이는 알고리즘-하드웨어 공동 최적화 기술을 다룹니다.