Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Mistral이 128B 파라미터와 256k 컨텍스트 창을 갖춘 오픈 웨이트 모델 'Mistral Medium 3.5'를 공개했습니다. 이 모델은 코딩, 도구 사용, 에이전트 작업에 최적화되어 있으며 MIT 라이선스로 제공됩니다.

자연어를 수학적 스케줄과 스펙트로그램으로 변환하여 언어의 내부 구조를 시각화하는 Attention Algebra 연구를 소개합니다. 이는 모델의 추론 체인을 진단하고, 메타 언어를 통해 모델의 추론 효율성을 극대화하는 것을 목표로 합니다.
Microsoft Research가 제안한 NextLat은 트랜스포머가 다음 토큰 대신 다음 잠재 상태를 예측하도록 학습하는 자기지도 학습 방법론입니다. 이를 통해 압축된 세계 모델을 형성하여 추론과 계획 능력을 향상시키고, 자기 투기적 디코딩을 통해 추론 속도를 최대 3.3배 높입니다.

InternLM-Math는 검증 가능한 추론을 목표로 하는 오픈 소스 수학 특화 거대 언어 모델(LLM)입니다. 수학적 문제 해결 능력을 극대화하기 위한 연구 결과와 모델 구조를 다룹니다.

1,000개 이상의 통합된 과학적 리소스를 활용하여 LLM의 도구 사용 방식을 표준화하는 연구를 소개합니다. 이를 통해 대규모 언어 모델이 과학적 데이터를 더 정확하게 다룰 수 있도록 돕습니다.

양자 실험을 통해 시간이 직선적이지 않고 순환적이며 역인과적(Retro-causal)일 수 있다는 연구 결과가 발표되었습니다. 초저온 루비듐 원자 구름 실험을 통해 광자가 '음의 시간'을 보낸 듯한 현상이 관찰되었으며, 이는 양자 역학의 비국소성을 설명하는 새로운 열쇠가 될 수 있습니다.

연구진이 1,400만 편의 학술 논문을 분석한 결과, ChatGPT 출시 이후 특정 스타일 단어의 빈도가 급증하며 언어적 변화가 나타났음을 발견했습니다. 이는 AI가 학술적 글쓰기의 주제가 아닌 표현 방식(voice)을 변화시키고 있음을 시사합니다.
DeepSeek가 1M 컨텍스트 길이를 지원하는 차세대 오픈 웨이트 모델인 DeepSeek-V4를 출시했습니다. 고성능의 Pro 모델과 가성비 중심의 Flash 모델로 구성되며, 매우 공격적인 API 가격 정책을 통해 개발자 접근성을 높였습니다.

1.2M 장의 방사선 사진으로 학습된 1.3B 파라미터 규모의 RadiT XL 모델이 발표되었습니다. 이 모델은 임상 전문가조차 실제와 구분하기 어려울 정도로 정교한 흉부 방사선 사진을 생성하며, 다양한 병리학적 상태를 제어할 수 있습니다.

RATs는 로봇이 명시적인 지시 없이도 자유로운 놀이를 통해 스스로 과업을 생성하고 기술 라이브러리를 구축하도록 학습시키는 방법론입니다. 강화학습 없이도 코드 기반의 정책을 작성하며, 실제 로봇 팔로의 기술 전이 성능이 뛰어납니다.

촉각 센서 없이 순수한 물리적 접촉만을 활용하여 51자유도의 다지형 손이 서랍과 문을 조작할 수 있도록 학습시키는 새로운 프레임워크인 DragMesh-2를 소개합니다.
멸종 위기 유산 언어의 음소 생성을 위해 물리학의 '게이지 불변성' 원리를 적용한 물리 증강 확산 모델링(PADM)을 제안합니다. 언어적 특징을 물리적 보존 법칙처럼 취급하여 언어의 정체성을 유지하고 윤리적 감사 가능성을 모델에 내장합니다.

AI 도구에 대한 과도한 의존이 전문가의 숙련도를 저하시키는 '탈숙련화(deskilling)' 현상이 의료 분야에서 관찰되었습니다. 대장 내시경 전문의들이 AI 도움 없이 수행할 때 암 전단계 병변 발견율이 감소했다는 연구 결과가 이를 뒷받침합니다.
Qwen2.5-32B 모델이 엄격한 JSON 스키마를 준수하더라도 복잡한 M&A 계약서 데이터 추출 시 높은 환각률을 보인다는 연구 결과를 소개합니다. 스키마 제약 디코딩이 구조적 정확성은 보장하지만, 내용의 의미론적 정확성과 환각 문제는 별도로 해결해야 함을 강조합니다.
저숙련 공격자들이 Claude Code와 OpenAI Codex를 활용해 14개 기업을 침해한 사례가 발견되었습니다. 공격자들은 AI 에이전트를 정찰 및 취약점 발견에 활용했으며, 보안 가드레일을 우회하는 방식을 사용했습니다.
Anthropic의 실험 결과, AI 어시스턴트를 활용한 프로그래밍은 작업 속도를 약간 높일 수 있으나 코드 이해도는 67%에서 50%로 크게 저하시키는 것으로 나타났습니다. 특히 개념을 질문하지 않고 코드 작성을 통째로 위임할 경우 학습 효과가 급격히 떨어지는 경향을 보였습니다.
유럽 위원회가 24개 EU 공식 언어를 지원하는 오픈소스 프런티어 AI 모델 개발 프로젝트인 'Frontier AI Grand Challenge'의 승자로 EUROPA 컨소시엄을 선정했습니다. 이 프로젝트는 유럽의 기술 주권과 언어적 다양성을 확보하기 위해 4,000억 개 이상의 파라미터를 가진 모델을 구축하는 것을 목표로 합니다.
Google의 Gemma 2 모델은 하이브리드 어텐션 메커니즘과 지식 증류 기술을 통해 모델 크기 대비 압도적인 성능을 구현했습니다. 로컬 및 글로벌 어텐션을 교차 사용하고 GQA를 도입하여 추론 효율성과 문맥 인지 능력을 동시에 높였습니다.
현대차의 Boston Dynamics 완전 인수 계획과 중국 휴머노이드 기업의 새로운 파운데이션 모델 출시 등 로보틱스 산업의 주요 동향을 다룹니다. 또한, 강화학습을 물리 세계에 적용한 'Physical Atari' 논문과 월드 모델 관련 연구 및 투자 소식을 포함합니다.
Google이 발표한 새로운 오픈 소스 AI 모델 Gemma 4에 대한 해설입니다. Apache 2.0 라이선스를 채택하여 상업적 이용이 완전히 자유로우며, 스마트폰부터 클라우드까지 다양한 환경에 최적화된 4종의 모델 라인업을 제공합니다.