Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
NASA는 Microchip Technology Inc.와의 파트너십을 통해 차세대 우주 비행용 시스템 온 칩(SoC) 개발을 추진합니다. 이 SoC는 기존 프로세서보다 100배 높은 컴퓨팅 용량을 제공하며, 특히 달이나 화성 같은 장기 임무를 위해 방사선 경화 버전과 저궤도 위성을 위한 방사선 내성 버전을 구축할 계획입니다. 이 시스템은 전력 효율성과 확장 가능한 아키텍처에 중점을 두어, 먼 우주에서 에너지를 절약하며 자율적인 임무 수행을 가능하게 합니다. 또한, 이 기술은 드론, 에너지 그리드, 의료 장비 등 지구 기반 응용 분야에도 활용될 예정입니다.
본 논문은 Speculative Decoding 과정에서 발생하는 'attention drift'라는 새로운 현상을 식별했습니다. 이는 drafter 모델이 추측 체인 내에서 연속적인 토큰을 생성할 때, 어텐션 메커니즘이 입력 프롬프트로부터 점진적으로 자신이 최근에 생성한 토큰들로 이동하는 현상입니다. 연구진은 이 원인을 잔차 경로의 비정규화된 누적 증가와 연결 지었으며, 이를 해결하기 위해 drafter hidden state에 Post-norm 적용 및 RMSNorm을 제안했습니다. 이러한 구조적 개선을 통해 다양한 벤치마크에서 수락 길이 및 전반적인 성능 향상을 입증했습니다.
Mog는 AI 에이전트가 스스로를 빠르고 안전하게 수정하고 확장할 수 있도록 설계된 정적 타입, 컴파일형 임베디드 프로그래밍 언어입니다. 이 언어는 LLM이 작성하기 용이하며, 네이티브 코드로 컴파일되어 저지연 플러그인 실행에 최적화되었습니다. Mog는 역량 기반 권한(capability-based permissions)을 통해 에이전트가 자신의 코드로 확장할 때도 보안성을 유지합니다.
Microsoft와 G42가 케냐에 건설하려던 10억 달러 규모의 AI 데이터 센터 프로젝트가, 해당 시설 가동을 위해 국가 전력의 상당 부분을 요구한다는 문제로 인해 중단되었습니다. 케냐 대통령은 이 프로젝트가 '국가 절반의 전원'을 차단해야 할 정도라고 언급하며 우려를 표했습니다. 이는 대규모 하이퍼스케일러들의 데이터 센터 건설 계획이 현지 전력 인프라에 미치는 과부하 문제를 수면 위로 드러냈습니다.
본 글은 사용자의 사고 흐름을 방해받지 않고 자연스러운 대화로 브라우저를 조작할 수 있는 '자연 대화 브라우저' 개발 과정을 다루고 있습니다. 기존 음성 입력 기술의 낮은 정밀도, 엄격한 커맨드 구조, 문맥 이해 부족 등의 한계를 극복하기 위해, AmiVoice API를 최고의 '귀'(음성 인식)로, GPT-4o를 똑똑한 '뇌'(의도 해석 및 명령 생성)로 활용했습니다. 최종 아키텍처는 마이크 입력 → AmiVoice API (WebSocket) → GPT-4o API → Chrome 확장 기능 순으로 구성되어, 음성을 받아 구조화된 실행 커맨드로 변환하여 브라우저를 조작합니다.
한 개발자가 인터넷 연결이나 API 사용 없이 장치 자체에서 구동되는 텍스트-음성 변환(TTS) 시스템을 개발했습니다. 이 시스템은 Raspberry Pi와 같은 저전력 장치에서도 작동하며, 비용 부담이 전혀 없는 완전 무료 오픈소스 프로젝트입니다.
본 기사는 Claude Code나 Codex 같은 로컬 AI 에이전트의 토큰 소비량과 비용을 추적하고, 이를 CLI 상태 바와 인터랙티브 대시보드를 통해 실시간으로 모니터링하는 방법을 소개합니다. 이 도구는 개발자가 AI 사용에 따른 자원 소모를 한눈에 파악할 수 있도록 돕습니다.
Hugging Face Hub의 Agent Traces에 새로운 미리보기 뷰가 추가되어 사용자가 에이전트의 작동 과정을 더 쉽게 탐색하고 이해할 수 있게 되었습니다. 이제 별도의 설정 없이도 원시 세션(raw sessions)을 허브에 업로드하여 즉시 공유하고 활용할 수 있습니다. Agent Traces는 컨텍스트를 중앙 집중화하고 흥미로운 세션을 다른 사람들과 공유하는 데 유용한 기능을 제공합니다.
본 기사는 2026년을 기점으로 Physical AI가 소프트웨어 엔지니어에게 새로운 전장이 될 것이라고 분석합니다. 과거 하드웨어 의존성 때문에 로보틱스 분야를 떠났던 필자는, 현재 소프트웨어 스택의 급속한 표준화와 발전으로 인해 소프트웨어만으로도 물리적 현실에 접근할 수 있게 되었다고 판단했습니다. 휴머노이드 시장은 인간 환경에 최적화되어 있어 자금 투자가 집중되고 있으며, VLA(Vision-Language-Action) 모델과 같은 기술이 학습 데이터의 전용을 가능하게 했습니다. 특히 Unitree와 같이 저렴한 가격으로 고성능 로봇 실기 접근성이 높아지면서, 이제는 개인 연구실에서도 물리적 실험이 가능한 시대가 왔음을 강조합니다.
본 체계적 검토는 아제르바이잔 수어(AzSL)를 사례 연구로 삼아, 자원이 부족한 수어 언어를 위한 인식 및 번역 기술 문헌을 종합합니다. 이 글은 커뮤니티 공동 설계, 방언 다양성 포착 등 8가지 실행 가능한 교훈과 함께 세 가지 주요 패러다임 전환(데이터 중심 AI, 사용자 적응형 시스템, 작업 특정적 평가)을 제안합니다. 궁극적으로 기술 로드맵은 경량화된 아키텍처와 오프라인 배포를 포함하며, 문화적 진정성과 윤리적 거버넌스를 위해 청각 장애인 커뮤니티 중심의 협력이 필수적임을 강조합니다.
Arm은 AGI(Artificial General Intelligence) CPU 시장에 진출하며 2027년 및 2028년 회계연도에 걸쳐 20억 달러 이상의 고객 수요를 확보했다고 발표했습니다. 그러나 *Mercury Research*의 분석가들은 Arm이 이 매출 목표를 달성하더라도, 기존 서버 및 데이터 센터 CPU 시장에서 차지하는 점유율은 여전히 한 자릿수 초반에 머물 것이라고 지적합니다. 이는 AMD나 Intel 같은 경쟁사들이 주도하는 거대한 시장 규모 대비 상대적으로 미미한 비중이기 때문입니다.
사용자가 @antirez의 ds4.c를 M3 max (128GB) 환경에서 테스트한 결과를 공유합니다. 62K 사전 채우기 상태의 코딩 대화에서 초당 14–15 토큰을 기록하며 높은 성능과 안정성을 보여주었습니다. 주요 제약 사항으로는 컨텍스트 압축 후 새로운 prefill 과정에 상당한 대기 시간(약 10k 컨텍스트당 1분)이 필요하다는 점을 언급했습니다.
Gemma-4-26B-A4B-NVFP4 모델이 단일 RTX 5090 GPU에서 65k 컨텍스트 길이로 구동되는 것이 확인되었습니다. 또한, 두 개의 별도 RTX 5090을 사용하여 두 개의 모델을 서빙하는 것도 가능함을 보여줍니다. 특히, vLLM을 이용해 64k 컨텍스트 환경에서 단일 RTX 5090으로 구동 시 초당 약 109.89 토큰의 속도를 기록했습니다.
Xynova가 2세대 하이브리드 다재다능한 손인 Flex 2를 출시했으며, 이 제품은 23 DOF, ±0.1mm의 반복 정밀도 등 뛰어난 사양을 자랑합니다. 또한 Xiaomi는 Xynova의 엔젤 및 Pre-A 라운드에 투자하며 전략적 파트너십을 구축하고 있습니다. 이는 Xiaomi가 휴머노이드 로봇이 실제 일상 과업을 수행하는 데 필수적인 핵심 부품 계층(component layer)에 집중적으로 자금을 투입하고 있음을 시사합니다.
본 논문은 대규모 언어 모델(LLM) 양자화의 새로운 접근 방식인 '다중 그리드'를 제안합니다. 이는 기존의 고정된 부동 소수점 그리드를 가정하는 대신, 각 값 그룹에 대해 여러 4비트 그리드 중 최적의 것을 선택할 수 있도록 확장한 개념입니다. 연구 결과, 이 다중 그리드 접근 방식은 특히 가중치와 활성화 값 모두를 처리할 때 단일 그리드 FP4 대비 정확도를 지속적으로 향상시키는 것으로 나타났습니다.
Helix-02를 활용하여 인간 수준의 수행 능력을 갖춘 휴머노이드 로봇 팀이 8시간 교대 근무를 자율적으로 수행하는 모습을 보여줍니다. 이 시스템은 소형 패키지 분류라는 특정 사용 사례에 적용되어, 바코드 감지, 패키지 집기, 방향 재설정 등의 작업을 연속적으로 처리합니다.
AMD는 Qibo 플랫폼에서 단일 AMD Instinct MI355X GPU를 사용하여 35-큐비트 양자 시뮬레이션을 성공적으로 수행했다고 발표했습니다. 이는 현재까지 AMD 하드웨어로 기록된 가장 큰 단일 GPU 기반 양자 컴퓨팅 결과입니다.
Google은 AI 서버를 우주에 배치하는 '궤도 데이터 센터' 개념을 실현하기 위해 SpaceX와 협상 중인 것으로 보입니다. 이 프로젝트는 Google의 Project Suncatcher 이니셔티브와 연관되어 있으며, 2027년부터 AI 칩(Tensor Processing Units)이 탑재된 위성을 궤도로 보내는 것을 목표로 합니다. 글은 우주 데이터 센터 구축에 필요한 막대한 비용 문제를 다루며, SpaceX가 반복적인 발사 성공과 로켓 경제학 개선을 통해 이 비용 장벽을 낮추고 있음을 분석합니다.
AMD가 Ryzen PRO 시리즈에 3D V-Cache 기술을 처음으로 도입한 6종의 새로운 Ryzen 9000 PRO 라인업을 출시했습니다. 이 워크스테이션용 CPU들은 보안과 안정성을 중시하는 전문가들을 대상으로 하며, 플래그십 모델인 Ryzen 9 PRO 9965X3D는 최대 16코어와 128MB의 L3 캐시를 탑재하고 170W TDP를 지원하며 이전 세대 대비 큰 성능 향상을 보여줍니다. 이 제품들은 일반 소매 채널이 아닌, Lenovo 같은 OEM을 통해 2026년 3분기에 만나볼 수 있습니다.
Ollama의 최신 버전은 아키텍처를 변경하여 GGML 대신 llama.cpp를 직접 지원하고 GGUF 파일 형식과의 호환성을 확보했습니다. Apple Silicon 환경에서는 MLX를 활용해 모델 추론 성능을 가속화합니다. 현재는 프리릴리스(Pre-release) 단계이므로 사용자 피드백을 요청하며, 특정 모델(laguna-xs.2, llama3.2-vision)은 지원되지 않습니다.