Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
SoC 확장에 따른 AXI4 네트워크 온 칩(NoC)의 데드락 문제를 해결하기 위한 새로운 아키텍처를 제안합니다. 물리 인지형 선점형 가상 채널(Preemptive VCs)을 통해 기존 멀티플레인 방식 대비 링크 리소스를 최대 76% 절약하면서도 높은 효율을 달성했습니다.
벌크 음향파(BAW) 지연선을 활용하여 열적으로 안정적이고 저전력인 새로운 시분할 다중화 이징 머신을 제안합니다. 2,048개의 스핀을 지원하며 숫자 분할 및 스도쿠 문제 해결에서 우수한 성능을 입증했습니다.
HySpecPro는 스펙트럼 임베딩 공간에서 엔드 투 엔드 최적화를 수행하는 단일 레벨 하이퍼그래프 분할 기법입니다. 기존 멀티레벨 방식의 구조적 왜곡 문제를 해결하며, GPU 가속을 통해 선형적인 확장성과 높은 컷 품질을 동시에 제공합니다.
이온 트랩 하드웨어에서 양자 알고리즘 실행 시 발생하는 노이즈와 오버헤드를 줄이기 위해, 이산적 게이트 대신 연속적인 복합 펄스 가젯을 사용하는 통합 펄스 합성 전략을 제안합니다. GRAPE 알고리즘을 활용해 $H_2$ 분자 시뮬레이션을 수행한 결과, 실행 시간 단축과 제어 지연 시간 제거 효과를 확인했습니다.
궤도 데이터 센터(ODC)에서 LLM 학습 시 발생하는 열 간섭 문제를 해결하기 위한 연구를 소개합니다. 열 부하 분산(TLB) 프레임워크를 통해 워크로드를 최적의 냉각 유닛으로 동적 이동시켜 하드웨어 수명을 연장하고 효율을 높입니다.
중성 원자 양자 컴퓨팅의 물리적 원자 이동 문제를 해결하기 위한 BRIDGE 프레임워크를 제안합니다. 버퍼-릴레이 패브릭과 Lazy-move 컴파일러를 통해 원자 이동을 최소화하고 양자 게이트의 충실도와 실행 속도를 획기적으로 개선했습니다.
SpikON은 에너지 효율적인 스파이킹 신경망(SNN)의 온라인 학습을 위한 알고리즘-하드웨어 공동 설계 프레임워크입니다. 새로운 학습 기술과 이중 병렬 엔진을 통해 학습 지연 시간과 에너지 소비를 획기적으로 줄였습니다.
AgRefactor는 소프트웨어를 HLS 호환 코드로 변환하기 위한 LLM 기반 멀티 에이전트 워크플로우입니다. 자기 진화형 메모리 시스템과 자동화된 리팩토링 도구를 결합하여 기존 방식보다 높은 성능과 효율성을 제공합니다.
FPGA 상에서 MSDF 자릿수-직렬 산술을 활용하여 동적 정밀도로 CNN 추론을 가속하는 MINT를 제안합니다. 탐욕적 탐색을 통해 레이어별 최적 정밀도를 선택함으로써 정확도 손실을 최소화하면서도 처리량과 에너지 효율을 크게 향상시켰습니다.
PEERS는 암시적 역행렬 계산과 증강 기호 분석을 활용하여 대규모 회로의 유효 저항을 병렬로 정확하게 계산하는 새로운 솔버입니다. 기존 방식의 메모리 및 정밀도 문제를 해결하여 산업용 대규모 그래프에서도 압도적인 속도 향상을 입증했습니다.
PIM의 병렬성을 활용하여 메모리 벽 문제를 해결하는 인시츄(in-situ) 인덱싱 아키텍처 PATH를 제안합니다. 멤리스터 기반 CAM 연산을 통해 해시 인덱싱의 성능 트레이드오프를 극복하고 데이터 중심 컴퓨팅의 효율성을 높입니다.
HLS(고수준 합성) 툴체인에서 발생하는 C 코드의 합성 실패 문제를 해결하기 위해 증거 기반의 LLM 에이전트 워크플로를 제안합니다. 생성, 검증, 진단, 수정을 포함하는 폐쇄 루프 시스템을 통해 기존 모델보다 뛰어난 C-to-HLS-C 변환 성능을 입증했습니다.
CHIA는 에이전트 기반 AI를 활용하여 하드웨어와 소프트웨어를 공동 설계할 수 있는 오픈 소스 프레임워크입니다. SoC 설계 도구와 AI 모델을 유향 순환 그래프로 연결하여 복잡한 설계 워크플로우를 자동화하고 확장 가능한 연구 환경을 제공합니다.
KernelSight-LM은 LLM의 추론 성능을 커널 수준에서 정밀하게 시뮬레이션하는 도구입니다. 하드웨어 사양과 마이크로벤치마크를 활용해 다양한 GPU 환경에서의 지연 시간과 처리량을 정확하게 예측합니다.
칩렛 기반 이기종 시스템의 통신 복잡성을 해결하기 위해 연산 노드와 데이터를 함께 재배치하는 SHIFT 프레임워크를 제안합니다. ML 지원 정책과 다층 라우팅을 통해 지연 시간과 에너지 효율을 획기적으로 개선하며, 특히 LLM 워크로드에서 탁월한 성능 향상을 입증했습니다.
LLM 추론의 프리필과 디코드 단계를 각각 GDDR 기반 가속기와 HBM 기반 GPU로 분리하여 운영하는 MemHA 기반 서빙 시스템 HMA-Serve를 제안합니다. 단계별 양자화와 연산-전송 파이프라인을 통해 성능 저하 없이 비용 효율성을 극대화합니다.
FPGA 기반 엣지 신경망을 위해 자원 효율성을 극대화하는 새로운 양자화 및 프루닝 방법론인 RQP를 제안합니다. 기존의 단조적인 방식 대신 원샷 프루닝과 양방향 베타 스케줄링을 사용하여 탐색 비용을 획기적으로 줄이면서도 최적의 성능을 달성합니다.
Intel의 3.5D 이종 패키징 기술을 위한 사전 실리콘 펌웨어 최적화 연구를 다룹니다. 열-전기 공동 시뮬레이션을 통해 워크로드 밀도 기반의 선제적 전압 조절로 성능 저하를 완화하는 XRM-SSD 프레임워크를 제안합니다.
RTL 기술을 기반으로 하드웨어 회로도를 생성하는 멀티모달 LLM의 성능을 평가하기 위한 벤치마크 MultModLM을 제안합니다. 실험 결과, 모델들이 시각적 회로도는 생성할 수 있으나 기능적 정확성은 낮으며, LLM 기반 평가 방식의 신뢰성 문제도 확인되었습니다.
유연 소자(Flexible Electronics) 환경에서 저전력 함수 근사를 위해 개발된 아날로그 Kolmogorov-Arnold Networks(AKANs)를 소개합니다. 하드웨어-소프트웨어 공동 최적화와 가지치기 기법을 통해 회로 결함 속에서도 정확한 연산을 수행하며 전력과 면적을 획기적으로 절감합니다.