Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Mac 컴퓨터에서 대형 언어 모델(LLM)을 로컬로 실행할 때 속도 저하와 과도한 메모리 사용으로 인해 사용자 경험이 떨어지는 문제가 발생하고 있습니다. 이 문제는 단순히 하드웨어의 한계라기보다는, Apple Silicon 칩의 연산 능력이 충분히 활용되지 못했기 때문입니다. 최근 'Cider'라는 프로젝트가 이러한 문제를 해결하는 데 도움을 줄 것으로 기대됩니다.
새로운 GPT-Realtime-2 모델은 기존의 음성 비서들이 사용자의 의도를 정확히 파악하지 못하고 반복적인 질문에 머물던 한계를 극복했습니다. 이 모델은 실시간으로 청취하며 맥락을 추론(reasoning)하고, 사용자의 숨겨진 의도까지 포착하여 필요한 경우 외부 도구(tool calling)를 호출할 수 있습니다. 결과적으로 사용자에게 마치 전문 지식을 갖춘 사람과 대화하는 듯한 경험을 제공합니다.
Hugging Face의 `Open-OSS/privacy-filter` 모델은 실제로는 OpenAI 프라이버시 필터의 가짜 버전인 악성 인포스틸러(info-stealer) 바이러스입니다. 이 위협은 Python 기반 드롭퍼(`loader.py`)를 사용하여 악성 PowerShell 명령어를 다운로드하고, 의심스러운 EXE 파일을 Task Scheduler로 실행하는 방식으로 작동합니다. 사용자는 이미 해당 드롭퍼와 EXE 파일을 Microsoft 및 Hugging Face에 신고했습니다.
RLDX-1은 인간과 유사한 정교한 손가락 조작(dexterous manipulation)을 목표로 하는 Vision-Language-Action 모델입니다. 이 모델은 Multi-Stream Action Transformer를 기반으로 운동 인식, 장기 기억, 물리 감지 등 다양한 모달리티 정보를 통합하여 작동합니다. ALLEX 작업에서 86.8%의 높은 성능을 달성하며 기존 모델 대비 상당한 개선을 보여주었습니다.
제공된 정보는 특정 논문(https://huggingface.co/papers/2605.03269…)과 관련 컬렉션(https://huggingface.co/collections/RLWRLD/rldx-1…)에 대한 기술적 성능 보고서입니다. 핵심 내용은 해당 모델 또는 시스템이 RTX 5090 GPU에서 실시간 추론을 수행했을 때 스텝당 43.7ms, 즉 22Hz 이상의 높은 프레임 속도를 달성했다는 것입니다. 이는 효율적인 최적화가 이루어졌음을 시사합니다.
이 기사는 엔비디아(Nvidia)가 지배하는 데이터센터 시장과 달리, 애플(Apple)이 로컬 추론(local inference) 분야에서 강력한 우위를 점하고 있음을 주장합니다. 저자는 고용량 VRAM, 적절한 대역폭, 그리고 최적화된 커널을 갖춘 시스템이 사용자에게 만족스러운 경험을 제공하며, 이 조건들이 애플 기기에서 잘 구현되고 있다고 분석합니다.
본 기사는 로봇에게 반드시 인간적인 얼굴이 필요하지 않다는 점을 강조하며, 이를 통해 개발의 복잡성과 비용을 줄일 수 있음을 시사합니다. 대신, 기존에 존재하는 비인간형 얼굴 모델(Reachy Mini)을 컨트롤러로 활용하여 구현할 수 있습니다. 이 솔루션은 오픈소스이며 브라우저 환경에서 바로 실행 가능하다는 장점을 가집니다.
Hugging Face가 Reachy Mini 전용 에이전틱 로봇 앱 스토어를 출시하며 물리 AI 분야의 접근성을 크게 높였습니다. NVIDIA Isaac GR00T N과 Hugging Face LeRobot을 통합하여 개발자들이 로봇 기반 모델을 쉽게 오픈 포스트-트레인, 평가 및 배포할 수 있게 되었습니다. 이로써 과거 전문가만 가능했던 로봇 앱 구축이 누구나 몇 시간 만에 할 수 있도록 민주화되었습니다.
EO-1 모델이 LeRobot 플랫폼에 직접 통합되어 사용 가능해졌습니다. 이로써 사용자들은 LeRobot 정책 인터페이스를 통해 EO-1을 학습, 평가, 배포하는 것이 훨씬 간편해져 로봇 제어 워크플로우에서 EO-1을 쉽게 시도할 수 있게 되었습니다.

ChatGPT에 새로운 선택적 안전 기능인 'Trusted Contact'가 도입되어 배포됩니다. 이 기능을 통해 사용자는 친구나 가족 등 신뢰할 수 있는 연락처를 지정하여, 본인이 자해 위험을 보이는 민감한 대화를 나눌 경우 해당 연락처에게 알림을 받을 수 있게 됩니다. 이는 전문적인 치료를 대체하지 않으며, 시스템이 감지한 위기 상황에 대해 훈련된 인간 검토 과정을 거쳐 신뢰할 수 있는 사람에게 제한적이고 사생활 보호가 되는 방식으로 통보하는 것이 핵심입니다.
구글이 새로운 오픈 웨이트 LLM 시리즈인 Gemma 3를 출시했습니다. 이 모델은 최대 128k 토큰의 긴 컨텍스트 창을 지원하며, 이미지와 텍스트를 모두 처리할 수 있는 멀티모달 기능을 갖추고 있습니다. 또한 140개 이상의 언어를 지원하여 다국어 성능이 크게 향상되었습니다. Gemma 3는 다양한 크기(1B~27B)로 제공되며, 특히 긴 컨텍스트와 멀티모달리티를 효율적으로 구현하기 위해 RoPE 업그레이드 및 KV 캐시 최적화 등 기술적인 개선을 이루었습니다.
PDF 이력서를 업로드하는 것만으로 AI가 자동으로 개인 포트폴리오 웹사이트를 생성해주는 오픈소스(OSS) 도구가 등장했습니다. 이 도구는 사용자가 별도의 기술 지식 없이도 이력서에서 경력, 스킬, 실적 등의 정보를 추출하여 전문적인 포트폴리오 사이트를 Vercel에 즉시 호스팅할 수 있게 해줍니다.
누군가 $50,000 상당의 서비스였던 AI 에이전트를 오픈소스로 공개했습니다. 이 에이전트는 웹 애플리케이션과 API를 탐색하는 AI 공격자 팀을 구성하며, 발견된 취약점 증거와 수정 단계까지 포함한 상세 PDF 보고서를 생성합니다. 이러한 도구는 펜테스팅 업계의 기존 방식에 큰 변화를 가져올 잠재력을 지니고 있습니다.
오픈 소스로 공개된 AI 에이전트가 웹 애플리케이션과 API를 탐색하고 취약점 증거 및 개선 방안까지 포함하는 전문적인 PDF 보고서를 작성하며, 기존의 고가의 페니트레스터 서비스(5만 달러)를 대체할 수 있음을 보여줍니다. 또한, 이 글은 오랜 기간 동안 가장 짧은 경로 알고리즘 분야에서 혁신을 거듭해 온 기술적 배경 지식도 함께 언급하고 있습니다.
Suno와 Udio 같은 상업적 AI 음악 생성 플랫폼의 유료 구독 모델(월 $10-$20)이 종료되면서, 사용자들은 대안을 찾고 있습니다. 이에 따라 4GB GPU로 가정에서도 무제한으로 음성 생성이 가능한 오픈소스 도구인 ACE-Step UI가 등장했습니다. 이 도구는 월간 제한이나 로그인 요구 사항, 검열 메커니즘 없이 사용자가 자신의 컴퓨터와 규칙에 따라 자유롭게 콘텐츠를 제작할 수 있게 합니다.

Anthropic이 SpaceX/xAI가 소유한 'Colossus 데이터센터' 전체 용량을 사용하기로 계약을 체결했습니다. 이 발표는 AI 데이터센터의 환경 문제와 정치적 논란 속에서 이루어졌으며, xAI는 Grok 모델 관련 폐기 통보(deprecation notice)를 통해 사용자들에게 혼란을 주었고, Elon Musk은 Anthropic에 컴퓨팅 자원을 제공하는 과정과 조건에 대해 언급하며 새로운 형태의 공급망 리스크를 시사했습니다.
AMD가 최신 CDNA 4 아키텍처 기반의 AI 가속기 PCIe 카드인 Instinct MI350P를 출시했습니다. 이 카드는 플래그십 모델(MI350X)을 절반 크기로 축소하여, 고밀도 서버 노드를 구축하기 어려운 환경에서도 온프레미스 AI 추론이 필요한 고객들을 겨냥합니다. MI350P는 전력 소비와 물리적 크기를 줄여 공랭식 PCIe 카드에 장착할 수 있게 했으며, 이는 기존 시장의 공백을 메우고 AMD에게 중요한 경쟁 우위를 제공합니다.
CyberStrikeAI는 Go 언어로 작성된 AI 네이티브 보안 테스트 플랫폼으로, 100개 이상의 통합 보안 도구와 지능형 오케스트레이션 엔진을 결합했습니다. 이 플랫폼은 역할 기반 테스트, 공격 체인 분석, 그리고 내장 경량 C2 프레임워크를 통해 취약점 발견부터 결과 시각화까지의 전 과정을 자동화합니다. 특히 OpenAI 호환 AI 모델과 멀티 에이전트 시스템(CloudWeGo Eino)을 활용하여 검증 가능하고 추적 가능한 엔터프라이즈급 보안 테스트 환경을 제공하는 것이 특징입니다.
Chrome 브라우저가 사용자 동의나 옵트아웃 절차 없이 4Go 버전의 Gemini Nano 모델을 기기에 자동 설치하는 문제가 발생하고 있습니다. 이 모델은 사용자가 수동으로 삭제하더라도 자동으로 다시 다운로드되는 특성을 가지고 있어, 개인 정보 보호 및 시스템 자원 관리 측면에서 우려를 낳고 있습니다.
WhatsApp을 통해 빠르게 확산되는 새로운 맬웨어 'SORVEPOTEL'이 발견되었으며, 이는 주로 지인으로부터 온 것처럼 위장된 메시지(ZIP 파일, .LNK 단축기 등)를 통해 전파됩니다. 이 악성 코드는 백그라운드에서 설치되어 WhatsApp Web 세션을 장악하고, 연락처 전체에 자동으로 동일한 맬웨어 메시지를 전송하며, 심지어 스크린샷 캡처나 키보드 추적 같은 기능을 수행할 수 있습니다. 사용자는 의심스러운 파일은 절대 열지 않고, WhatsApp Web 세션을 정기적으로 점검하며, 반드시 2단계 인증(2FA)을 활성화하는 등 다층적인 보안 조치를 취해야 합니다.