Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.

단 25.8M 파라미터 규모의 미니 언어 모델을 저렴한 비용과 짧은 시간 안에 학습할 수 있는 오픈 소스 프로젝트가 화제입니다. 토크나이저 학습부터 사전 학습, SFT, 멀티모달 버전까지 LLM의 전 과정을 PyTorch로 구현하여 학습용으로 최적화되었습니다.

경량 TTS 모델인 LuxTTS가 혁신적인 성능을 선보였습니다. 단일 GPU에서 150배 빠른 속도와 48khz의 고음질을 지원하며, 1GB VRAM만으로도 로컬 구동이 가능합니다.

Cambridge에서 AI 및 머신러닝 분야의 클래식 교재 10권을 PDF 형태로 전면 무료 공개했습니다. 입문부터 심화 이론, 수학적 기초, 딥러닝까지 체계적인 학습이 가능한 리스트를 제공합니다.

MIT에서 공개한 머신러닝 및 딥러닝 관련 고품질 무료 학습 자료 리스트를 소개합니다. 유료 강의 대신 기초부터 강화학습, 공정성까지 다루는 검증된 학술 자료를 통해 체계적으로 학습할 것을 권장합니다.

칭화대학교 연구진이 금융 K선(K-line) 데이터를 언어처럼 학습하는 오픈 소스 기초 모델 'Kronos'를 발표했습니다. OHLCV 데이터를 토큰화하여 자기회귀 트랜스포머로 학습하며, 다양한 규모의 모델 라인업을 제공합니다.

NIH에서 공개한 BioArt Source는 연구 및 논문 작성 시 필요한 생의학 삽화 라이브러리입니다. 이 자료는 전문 일러스트레이터가 그린 2000개 이상의 벡터 이미지와 아이콘을 포함하며, 바이러스, 세포, 해부학 등 광범위한 주제를 다룹니다.

GPS를 비활성화한 상태에서도 안드로이드 기기 내장 센서를 활용해 실시간 위치를 추적할 수 있는 기술이 공개되었습니다. 이는 위치 정보 권한을 차단하더라도 사용자의 이동 경로를 파악할 수 있음을 시사하며 개인정보 보호의 취약성을 보여줍니다.

중국의 새로운 대규모 언어 모델인 MiniMax M3가 출시되었습니다. 1M 컨텍스트 지원과 멀티모달 기능을 갖추었으며, MiniMax Code를 통해 에이전트 활용 가능성을 높였습니다.

Claude Opus 4.8이 출시 7분 만에 이전 세대인 Opus 4.7을 이용한 탈옥 공격에 성공했습니다. 구모델이 생성한 데이터를 신모델이 이어 쓰게 만드는 '좌우상박' 방식을 통해 가드레일을 무력화했습니다.

dealignai 팀이 Google Gemma 4의 보안 제한을 해제한 크랙 버전인 Gemma-4-31B-JANG4M-CRACK을 공개했습니다. 이 모델은 높은 HarmBench 준수율을 보이며, 양자화를 통해 크기를 줄이면서도 지능과 멀티모달 기능을 유지한 것이 특징입니다.
NetEase Youdao가 수리 및 논리 능력에서 SOTA를 달성한 27B 규모의 Ziyue 4 모델을 오픈 소스로 공개했습니다. 특히 언어 전환 시 발생하는 악센트 문제를 해결한 음성 복제(Voice Cloning) 기능이 주목받고 있습니다.
Tencent이 1.8B 파라미터 규모의 경량 번역 모델 Hy-MT2를 공개했습니다. 저사양 Mac mini에서도 구동 가능한 효율성을 갖추었으며, 로컬 환경에서 비용 없이 준수한 번역 성능을 제공합니다.
이 글은 리버싱(Reverse Engineering) 과정에서 발생하는 상업적 도구의 높은 비용과 무료 도구의 낮은 사용성을 지적하며, 이를 해결하는 오픈 소스 도구 'Cutter'를 소개합니다. Cutter는 PE, ELF, Mach-O 등 다양한 바이너리 포맷을 지원하며 전문가 수준의 리버싱 환경을 제공한다고 강조합니다. 또한, 통계학 학습에 대한 어려움을 언급하며 코드를 통해 개념을 설명하는 《Think Stats》라는 대안도 함께 제시하고 있습니다.
홍콩대학교가 개발한 CLI-Anything이라는 오픈 소스 도구가 공개된 지 단 3일 만에 Star 수 3만 개를 돌파하며 큰 주목을 받고 있습니다. 이 도구는 API가 없는 임의의 소프트웨어 소스 코드를 스캔하여 AI 에이전트(Agent)가 직접 호출할 수 있는 CLI 인터페이스를 자동으로 생성하는 기능을 제공합니다. 이를 통해 GIMP, Blender와 같은 데스크톱 애플리케이션도 사람의 개입 없이 AI 에이전트가 직접 다룰 수 있게 됩니다.
OmniVoice Studio는 오픈 소스 도구로, 로컬 환경에서 음성 복제와 비디오 더빙 기능을 제공합니다. 이 도구는 646개 언어를 지원하며, 인터넷 연결이나 API 키가 필요 없어 완전히 오프라인으로 작동하고 비용이 들지 않습니다. 사용자는 3초의 오디오만으로 원하는 목소리를 복제할 수 있으며, YouTube 링크를 입력하면 자동으로 전사, 번역, 재더빙을 거쳐 MP4 파일로 출력할 수 있습니다.
Elicit이라는 인터랙티브 AI 연구 도구가 소개되었으며, 사용자가 던지는 어떤 연구 질문에 대해서도 학술 논문 검색, 핵심 관점 요약, 인용 관계 시각화 등을 실시간으로 제공하여 깊이 있는 연구를 돕습니다. 이 글은 단순히 도구 소개를 넘어, 온라인 활동의 투명성 증가와 개인 정보 노출 위험성을 경고하며, 특정 정보를 수집하는 것이 얼마나 쉬워졌는지를 강조하고 있습니다.