Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
구글, 마이크로소프트, 메타, 아마존 등 주요 빅테크 기업들이 2026년 설비투자(CAPEX)를 전년 대비 대폭 늘려 총 $7,250억 달할 것으로 예상됩니다. 이는 클라우드 서비스의 폭발적인 성장과 AI 인프라 구축 경쟁 심화에 따른 결과입니다. 특히 구글은 클라우드 수익이 급증하며 강력한 실적을 보였고, 주요 기업들은 메모리 칩 및 데이터센터 건설 비용 상승으로 인해 CAPEX 가이드라인을 상향 조정했습니다.
AI 코딩 에이전트의 실수로 중요 데이터베이스가 삭제되는 심각한 문제가 발생했으나, 클라우드 제공업체인 Railway 측에서 해당 데이터를 성공적으로 복구했습니다. 이 사건을 계기로 Railway는 API를 포함한 모든 삭제 작업에 대해 48시간의 소프트 삭제(soft delete) 기능을 적용하고, 즉시 되돌리기(instant undo) 기능을 강화하는 등 시스템 전반의 보안 및 안정성을 대폭 개선했습니다.
삼성전자와 SK하이닉스가 AI 인프라 구축에 따른 HBM(고대역폭 메모리) 수요 폭증으로 인해 메모리 제품 전반에 걸쳐 심각한 공급 부족이 2027년까지 지속될 수 있다고 경고했습니다. 이러한 부족 현상은 고성능 컴퓨팅을 위한 필수 요소인 HBM 중심의 AI 가속기 시장에서 비롯되었으며, 제조사들이 생산 자원을 고수익 AI 메모리로 집중하면서 서버, PC, 모바일 등 기존 DRAM 제품 공급에도 영향을 미치고 있습니다.
AI 데이터센터의 급격한 건설 붐과 막대한 전력 수요가 전기기술자 인력 시장에 과부하를 일으키면서 주택 및 기타 건설 프로젝트에 심각한 차질을 초래하고 있습니다. 초대규모 클라우드 서비스 제공업체(하이퍼스케일러)들이 높은 임금과 복지를 제시하며 전문 전기기술자를 독점적으로 채용하면서, 일반 계약업체들은 인력 부족을 겪고 공사 기간이 최대 2개월까지 지연되고 있습니다. 이는 단순히 노동 시장의 문제가 아니라, 전력 공급망 제약 및 자원 경쟁으로 인해 주택 건설과 AI 산업 모두가 동시에 어려움을 겪는 구조적인 문제입니다.
중국의 주요 GPU 설계사인 캄브리콘과 메타엑이 최근 분기 실적을 발표하며 중국 내 AI 칩 시장의 급격한 성장을 보여주었습니다. 특히 캄브리콘은 전년 대비 매출 및 순이익이 크게 증가하며, 미국 제재로 인해 축소된 엔비디아의 점유율을 흡수하는 추세를 주도하고 있습니다. 이들 기업은 중국 정부가 승인한 AI 하드웨어 공급망의 핵심 플레이어로 부상하고 있으며, 국내 대형 기술 기업들의 적극적인 수요에 힘입어 시장 지배력을 확대하고 있습니다.
이 기사는 소니 듀얼센스 컨트롤러를 사용하는 게이머들이 PC에서 경험하는 무선 연결 시 적응형 트리거 및 햅틱 피드백 부재 문제를 해결할 수 있는 'DS5Dongle' 프로젝트를 소개합니다. 이 장치는 라즈베리파이 픽오 2W(Raspberry Pi Pico 2W)와 같은 저가 부품을 사용하여 $20 미만으로 직접 구축할 수 있으며, 블루투스를 통해 듀얼센스에서 데이터를 받아들인 후 이를 PC에 유선 연결된 것처럼 '핸드셰이크 스푸프'하는 방식으로 작동합니다. 이 덕분에 게이머들은 케이블 제약 없이 PS5와 유사한 고성능 무선 경험을 즐길 수 있습니다.
테네시주 주지사가 2026년 7월 1일부터 암호화폐 자동판매기(Crypto ATM) 사용을 전면 금지하는 법안에 서명했습니다. 이는 인디애나주에 이어 두 번째로 이러한 조치를 취하는 것이며, FBI는 이 기계들이 사기범들에게 악용되어 미국인들이 막대한 금액을 잃었다고 경고했습니다. 주정부는 피해 방지를 위해 해당 ATM의 사용을 제한하고 있습니다.
본 논문은 오류 정정 양자 컴퓨팅(FTQC) 환경에서 발생하는 복잡한 멀티프로그래밍 문제를 다룹니다. FTQC는 데이터, 어닐라, 마법 상태 서비스 등 구조화된 자원 플로어플랜을 가지므로, 단순한 큐비트 풀 분할보다 훨씬 복잡합니다. 연구진은 이러한 구조적 제약과 런타임 영향을 포착하는 형식적 프레임워크를 개발했으며, 이를 통해 합성 클리포드+T 워크로드 시뮬레이션에서 시스템 속도를 크게 향상시키고 성능을 개선했습니다.
AMMA는 초장문 컨텍스트(1M 토큰) 환경에서 발생하는 메모리 바운드 어텐션 병목 현상을 해결하기 위해 제안된 멀티 칩렛 메모리 중심 아키텍처입니다. 기존의 GPU 중심 설계가 디코드 단계의 메모리 요구 사항과 불일치하여 지연 시간을 증가시키고 전력을 낭비하는 문제를 개선합니다. AMMA는 컴퓨팅 다이를 HBM-PNM 큐브로 대체하고, 최적화된 마이크로아키텍처 및 새로운 병렬화 스킴을 도입하여 기존 대비 현저히 낮은 어텐션 지연 시간과 에너지 소비를 달성했습니다.
본 논문은 대형 언어 모델(LLMs)이 단순한 코드 생성을 넘어 재사용 가능한 최적화 휴리스틱을 체계적으로 합성할 수 있는 새로운 방법론, RAG-Enhanced Kernel-Based Heuristic Synthesis (RKHS)를 제안합니다. RKHS는 검색 증강 생성(RAG), 컴팩트 커널 템플릿, 그리고 자기 피드백 루프를 통합하여 LLM의 성능을 향상시킵니다. 이 방법론은 고수준 합성(HLS)의 지연 시간 최소화 리스트 스케줄링에 적용되었으며, 기존 대비 평균 스케줄 길이를 최대 11% 단축하는 성과를 보였습니다.
심층 신경망의 크기가 커지면서 발생하는 높은 계산 복잡도와 메모리 요구 사항을 해결하기 위해 가지치기(Pruning)를 통해 희소 신경망이 활용되고 있습니다. 기존의 전용 희소 가속기는 인덱스 매칭 회로 때문에 면적과 전력 효율성 문제가 있었습니다. 본 논문은 이러한 문제를 해결하고자, 밀집 행렬 곱셈 하드웨어 가속기(Sparse-on-Dense)를 사용하여 희소 신경망 연산을 수행하는 면적 및 에너지 효율적인 방법을 제안합니다.
본 논문은 5G, 6G 등 차세대 시스템에 필수적인 100 GHz 미만의 밀리미터파(mm-wave) 및 100 GHz 이상의 서브 테라헤르츠/테라헤르츠(sub-THz/THz) 발진기의 최신 발전 동향을 포괄적으로 검토합니다. CMOS, SiGe, III-V 등 다양한 반도체 기술 기반의 설계 접근 방식을 성능 지표(위상 잡음, 출력 전력, 효율성 등)를 기준으로 분석하며, 고성능 및 신뢰성 확보에 필요한 주요 과제와 미래 방향성을 제시합니다.
본 논문은 모바일 NPU-PIM 시스템에서 LLM 추론 효율성을 극대화하기 위해 AHASD라는 비동기 이종 아키텍처를 제안합니다. AHASD는 작업 수준의 DLM-TLM 분리를 통해 PIM에서 병렬 초안 생성이 가능하고, 단일 NPU에서 검증을 수행하여 자원 낭비를 줄입니다. 또한 엔트로피 및 시간 인식을 통합한 정교한 초안 제어 메커니즘으로 알고리즘 실행과 사전 검증 타이밍을 동적으로 관리하며, LPDDR5-PIM에 주의력 유닛과 게이트드 스케줄링 유닛을 통합하여 높은 처리량과 에너지 효율성 향상을 달성했습니다.
OpenAI는 초기 계획했던 50,000억 달러 규모의 'Stargate' 데이터센터를 직접 소유하는 방식을 사실상 포기하고, 대신 제3자 공급업체로부터 용량을 장기적으로 임대하는 유연한 전략으로 전환했습니다. 이러한 변화는 내부 수익 목표 미달성 및 현금 흐름 관리가 필요한 스타트업에게 더 합리적인 선택으로 보입니다.
메타가 AWS와 수조 달러 규모의 장기 계약을 맺고 대규모로 Graviton5 CPU를 도입하는 사례는, 현재 AI 인프라 구축 과정에서 심화되는 CPU 부족 문제를 명확히 보여줍니다. 업계 전반적으로 이러한 수요 증가에 대응하기 위해, 기업들은 전통적인 모델 학습(Training) 워크로드 대신 효율성이 높은 에이전트 추론(Agent Inference) 워크로드로 초점을 전환하며 시장의 수요를 견인하고 있습니다.
Meta는 Overview Energy와의 파트너십을 통해 우주에서 햇빛을 빔으로 전송하여 지구상의 AI 데이터 센터에 전력을 공급할 계획입니다. 이는 미래 AI 산업의 폭발적인 에너지 수요 증가에 대응하기 위한 혁신적인 접근 방식 중 하나입니다. 또한, Meta는 Noon Energy와 대규모 장시간 에너지 저장 계약을 체결하며 안정적인 전력 인프라를 확보하고 있습니다.
중국의 GPU 제조사 리쉬안 테크(Lisuan Tech)가 6nm 그래픽 카드를 위한 마이크로소프트 WHQL 인증을 역사적으로 획득했습니다. 이로써 LX 7G100 GPU는 엔비디아, AMD, 인텔과 함께 WHQL 드라이버를 완수한 네 번째 기업이 되었으며, 중국 최초의 기록으로 남게 되었습니다.
인텔은 급증하는 AI 수요에 대응하고 원가 절감 및 수익성을 개선하기 위해, 기존에는 활용도가 낮다고 여겨졌던 웨이퍼의 가장자리 부분(edge)에서도 유효한 CPU 다이를 확보하는 데 주력하고 있습니다. 이를 통해 웨이퍼 수율 변동성(wafer yield variability)을 줄여 전체적인 생산 효율성과 수익성을 높이는 것을 목표로 하고 있습니다.
고급 LLM(대규모 언어 모델)의 사용 증가로 인해, 모든 토큰에 대한 지출이 실제 근로자의 급여보다 더 비싸질 수 있다는 주장이 제기되었습니다. 하지만 일부 기업들은 이러한 자동화 비용을 미래 성장을 위한 긍정적인 투자로 인식하고 있습니다.
미국 상무부가 미국 주요 반도체 장비 회사들(애플라이드 머티리얼즈, KLA, 램 리서치 등)에게 중국의 화홍(Hua Hong)이 상하이에서 가동을 앞둔 7nm 공장에 필요한 일부 제조 장비의 수출 수송을 중단하도록 지시했습니다. 이는 미국 정부가 첨단 반도체 기술 및 공급망에 대한 통제를 강화하고 있음을 보여주는 사례입니다.