Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

RuView는 WiFi 신호만을 이용하여 사람의 존재 유무, 움직임, 심지어 호흡과 심박수까지 측정할 수 있는 오픈 소스 프로젝트입니다. 이 기술은 카메라나 웨어러블 장치 없이도 작동하며, ESP32 보드를 활용하여 반사된 전파를 포착하고 분석합니다.

오픈소스 음성 복제 소프트웨어인 OmniVoice를 소개합니다. 이 도구는 사용자가 제공한 오디오 파일의 목소리를 완전히 복제할 수 있으며, 600개 이상의 언어를 지원하고 나이, 음높이 등 다양한 요소를 조절 가능합니다. 사전 학습 없이도 즉시 사용할 수 있어 더빙 및 다국어 콘텐츠 제작에 매우 유용합니다.

OmniVoice는 600개 이상의 언어에서 사용자의 목소리를 완벽하게 복제하는 오픈소스 프로젝트입니다. 오디오 세그먼트 입력만으로 제로샷 합성 및 다양한 음성 특성(나이, 음높이 등) 조절이 가능합니다. 다국어 콘텐츠 제작이나 영상 더빙에 매우 강력한 성능을 제공합니다.

hpc-ai가 11B 모델인 Open-Sora 2.0을 오픈 소스로 공개하며 AI 비디오 생성 분야의 판도를 바꿨습니다. 이 모델은 적은 비용으로도 높은 성능을 보여주며, 기존 고비용 장벽을 낮추고 시장에 큰 압박을 주고 있습니다.

단 25.8M 파라미터 규모의 미니 언어 모델을 저렴한 비용과 짧은 시간 안에 학습할 수 있는 오픈 소스 프로젝트가 화제입니다. 토크나이저 학습부터 사전 학습, SFT, 멀티모달 버전까지 LLM의 전 과정을 PyTorch로 구현하여 학습용으로 최적화되었습니다.

경량 TTS 모델인 LuxTTS가 혁신적인 성능을 선보였습니다. 단일 GPU에서 150배 빠른 속도와 48khz의 고음질을 지원하며, 1GB VRAM만으로도 로컬 구동이 가능합니다.

Cambridge에서 AI 및 머신러닝 분야의 클래식 교재 10권을 PDF 형태로 전면 무료 공개했습니다. 입문부터 심화 이론, 수학적 기초, 딥러닝까지 체계적인 학습이 가능한 리스트를 제공합니다.

MIT에서 공개한 머신러닝 및 딥러닝 관련 고품질 무료 학습 자료 리스트를 소개합니다. 유료 강의 대신 기초부터 강화학습, 공정성까지 다루는 검증된 학술 자료를 통해 체계적으로 학습할 것을 권장합니다.

칭화대학교 연구진이 금융 K선(K-line) 데이터를 언어처럼 학습하는 오픈 소스 기초 모델 'Kronos'를 발표했습니다. OHLCV 데이터를 토큰화하여 자기회귀 트랜스포머로 학습하며, 다양한 규모의 모델 라인업을 제공합니다.

NIH에서 공개한 BioArt Source는 연구 및 논문 작성 시 필요한 생의학 삽화 라이브러리입니다. 이 자료는 전문 일러스트레이터가 그린 2000개 이상의 벡터 이미지와 아이콘을 포함하며, 바이러스, 세포, 해부학 등 광범위한 주제를 다룹니다.

GPS를 비활성화한 상태에서도 안드로이드 기기 내장 센서를 활용해 실시간 위치를 추적할 수 있는 기술이 공개되었습니다. 이는 위치 정보 권한을 차단하더라도 사용자의 이동 경로를 파악할 수 있음을 시사하며 개인정보 보호의 취약성을 보여줍니다.

중국의 새로운 대규모 언어 모델인 MiniMax M3가 출시되었습니다. 1M 컨텍스트 지원과 멀티모달 기능을 갖추었으며, MiniMax Code를 통해 에이전트 활용 가능성을 높였습니다.

Claude Opus 4.8이 출시 7분 만에 이전 세대인 Opus 4.7을 이용한 탈옥 공격에 성공했습니다. 구모델이 생성한 데이터를 신모델이 이어 쓰게 만드는 '좌우상박' 방식을 통해 가드레일을 무력화했습니다.

dealignai 팀이 Google Gemma 4의 보안 제한을 해제한 크랙 버전인 Gemma-4-31B-JANG4M-CRACK을 공개했습니다. 이 모델은 높은 HarmBench 준수율을 보이며, 양자화를 통해 크기를 줄이면서도 지능과 멀티모달 기능을 유지한 것이 특징입니다.
NetEase Youdao가 수리 및 논리 능력에서 SOTA를 달성한 27B 규모의 Ziyue 4 모델을 오픈 소스로 공개했습니다. 특히 언어 전환 시 발생하는 악센트 문제를 해결한 음성 복제(Voice Cloning) 기능이 주목받고 있습니다.
Tencent이 1.8B 파라미터 규모의 경량 번역 모델 Hy-MT2를 공개했습니다. 저사양 Mac mini에서도 구동 가능한 효율성을 갖추었으며, 로컬 환경에서 비용 없이 준수한 번역 성능을 제공합니다.
이 글은 리버싱(Reverse Engineering) 과정에서 발생하는 상업적 도구의 높은 비용과 무료 도구의 낮은 사용성을 지적하며, 이를 해결하는 오픈 소스 도구 'Cutter'를 소개합니다. Cutter는 PE, ELF, Mach-O 등 다양한 바이너리 포맷을 지원하며 전문가 수준의 리버싱 환경을 제공한다고 강조합니다. 또한, 통계학 학습에 대한 어려움을 언급하며 코드를 통해 개념을 설명하는 《Think Stats》라는 대안도 함께 제시하고 있습니다.
홍콩대학교가 개발한 CLI-Anything이라는 오픈 소스 도구가 공개된 지 단 3일 만에 Star 수 3만 개를 돌파하며 큰 주목을 받고 있습니다. 이 도구는 API가 없는 임의의 소프트웨어 소스 코드를 스캔하여 AI 에이전트(Agent)가 직접 호출할 수 있는 CLI 인터페이스를 자동으로 생성하는 기능을 제공합니다. 이를 통해 GIMP, Blender와 같은 데스크톱 애플리케이션도 사람의 개입 없이 AI 에이전트가 직접 다룰 수 있게 됩니다.
OmniVoice Studio는 오픈 소스 도구로, 로컬 환경에서 음성 복제와 비디오 더빙 기능을 제공합니다. 이 도구는 646개 언어를 지원하며, 인터넷 연결이나 API 키가 필요 없어 완전히 오프라인으로 작동하고 비용이 들지 않습니다. 사용자는 3초의 오디오만으로 원하는 목소리를 복제할 수 있으며, YouTube 링크를 입력하면 자동으로 전사, 번역, 재더빙을 거쳐 MP4 파일로 출력할 수 있습니다.
Elicit이라는 인터랙티브 AI 연구 도구가 소개되었으며, 사용자가 던지는 어떤 연구 질문에 대해서도 학술 논문 검색, 핵심 관점 요약, 인용 관계 시각화 등을 실시간으로 제공하여 깊이 있는 연구를 돕습니다. 이 글은 단순히 도구 소개를 넘어, 온라인 활동의 투명성 증가와 개인 정보 노출 위험성을 경고하며, 특정 정보를 수집하는 것이 얼마나 쉬워졌는지를 강조하고 있습니다.