Insights
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
© 2026 Molayo
AI가 자동으로 큐레이션·번역·정리하는 기술 동향 피드입니다.
본 페이지의 콘텐츠는 AI가 공개된 소스를 기반으로 자동 수집·요약·번역한 것입니다. 원 저작권은 각 원저작자에게 있으며, 각 게시물의 “원문 바로가기” 링크를 통해 원문을 확인할 수 있습니다. 저작권자의 삭제 요청이 있을 경우 신속히 조치합니다.
Bonsai 2 27B 모델은 메모리 사용량을 크게 줄인 거의 무손실 압축 기술을 적용하여 효율성을 높였습니다. 이 모델은 M5 Pro 등 다양한 환경에서 구동 가능하며, 특히 작은 크기에도 불구하고 준수한 성능을 보여주어 주목받고 있습니다. 다만, 긴 작업 처리 시 불안정성이 관찰되기도 했습니다.
Claude 사용 경험이 단순히 상호작용 방식뿐만 아니라 실제 코딩하는 개발 프로세스 자체를 변화시켰습니다. 세션 관리에 의존하기보다, 생각나는 대로 프롬프트를 보내면 Claude가 이를 스레드로 분할하고 프로젝트의 작업 맥락을 기억해주는 기능이 핵심입니다.
Anthropic이 Opus 5에서 Opus-Next로의 비밀 라우팅(stealth routing)을 중단했음을 알립니다. 이는 테스트 그룹에 속했던 계정 수가 이제 0이 되었음을 의미합니다.
GE Aerospace의 CFO가 GE9X 엔진의 미드 실 내구성 문제가 Boeing 777X 항공기의 운항 개시 일정에 지연을 초래하지 않을 것이라고 발표했습니다. 이는 관련 산업 및 주주들에게 중요한 정보로, 해당 기사의 맥락은 기업 재무 및 비즈니스 운영 계획과 밀접하게 연결되어 있습니다.
SpaceXAI 엔지니어가 API를 Cursor 플러그인으로 변환하는 GrokBot이라는 도구를 공개했습니다. 이 템플릿은 데이터 정의부터 로컬 작동 증명까지 전체 워크플로우를 처리하여, 복잡한 에이전트 플러그인 구축 과정을 간소화합니다.
Anthropic이 Chat과 Cowork의 통합, 그리고 멀티에이전트 활용을 위한 Claude Code Projects를 발표하며 AI 에이전트 시장의 방향성을 제시했습니다. 이는 단순한 질의응답(Answering Intelligence)에서 업무 수행(Agentic Intelligence)으로 AI 활용 패턴을 전환시키려는 시도입니다.
자율형 AI 에이전트 'Pip'이 활동 유지에 필요한 컴퓨팅 토큰 비용을 마련하기 위해 크리에이터에게 아르바이트를 요청한 사례가 보고되었습니다. 이는 AI 에이전트의 자립적 행동과 경제 활동까지 확장될 수 있음을 시사합니다.
Anthropic이 AI의 '재귀적 자기 개선(RSI)' 수준 도달 현황을 투명하게 공개했습니다. 현재 연구 및 엔지니어링 작업 중 상당 부분이 'AI collaborates' 이상의 복잡한 작업을 수행하며, 8월에는 그 비중이 26%까지 증가했습니다. 또한 약 30,000개의 에이전트가 연구/엔지니어링 작업을 진행하고 있으며, 방대한 양의 결정 검토 및 인간 검토 과정을 거치고 있음을 밝혔습니다.
PrismML은 Qwen3.8 27B 모델을 9배 축소하여 크기를 5.9GB로 구현하는 데 성공했습니다. 이 과정에서 모델의 벤치마크 성능을 98.2% 수준으로 유지하며, 대규모 언어 모델(LLM)이 로컬 환경에서도 구동 가능함을 입증했습니다.
새로운 모델인 Ternary Bonsai 2 27B가 발표되었습니다. 이 모델은 Qwen3.8 27B를 기반으로 하며, 기존 대비 크기는 9배 작으면서도 벤치마크 성능의 98.2%를 유지합니다. 특히 에이전트 코딩 및 멀티모달 추론에서 강력한 성능 향상을 보였습니다.
Anthropic의 모델 R&D 작업에서 Claude가 차지하는 비중이 3월 대비 크게 증가했습니다. 현재 Anthropic에서는 총 30,000개의 에이전트가 연구 및 엔지니어링 작업을 수행하며 활발한 개발 활동을 이어가고 있습니다.
본 기사는 AI 벤치마크의 품질을 감사하고 평가하는 새로운 이니셔티브인 '벤치마크 리뷰'를 소개합니다. 총 15개 벤치마크에 대해 검증됨, 결함 있음, 정보 부족 등의 기준으로 판결하며, 사용자들에게 신뢰할 수 있는 정보 출처가 되는 것을 목표로 합니다.
Qwen에서 부모 모델 Qwen 3.8 27B의 성능을 98.2% 유지하는 테너리(ternary) 27B 모델을 출시했습니다. 이 모델은 에이전트 작업, 컴퓨터 사용, 긴 컨텍스트 처리 등 다양한 분야에서 뛰어난 성능을 보이며, 크기가 6GB 미만으로 M5 Max에서 초당 55 토큰의 속도로 구동 가능합니다.
Meta는 카메라 장착 모델에 대한 '변태용 안경' 비판 이후, 카메라가 없는 스마트 글래스 Luna를 개발 중입니다. 이 기기는 AI 챗봇 및 에이전트 Muse와 대화할 수 있는 여섯 개의 마이크와 버튼을 탑재했습니다. Meta는 하드웨어 손실에도 불구하고, 사용자가 생성하는 방대한 오디오 데이터를 AI 모델 학습에 활용하여 더 큰 가치를 창출하려 합니다.
OpenAI가 최고 성능 모델과 미국 판례법(precedential case law) 검색 인덱스를 결합한 'Astra for Law'를 공개했습니다. 이는 법률 분야에 특화된 강력한 AI 솔루션으로, 방대한 양의 출판된 미국 판례법을 다룰 수 있게 합니다.
OpenAI 사장 Greg Brockman이 NYT 유료 콘텐츠를 스크래핑한 사실을 전하자 'ah nice'라고 반응하며 논란이 되었습니다. 이는 컴퓨터 사기 및 남용법(CFAA) 위반에 해당한다는 비판이 제기되고 있습니다.
Qwen3.8-Omni-Flash는 텍스트, 이미지, 오디오, 비디오 입력을 모두 지원하는 '풀 오므니' 모델입니다. 1M 컨텍스트를 제공하며, 특히 오디오 성능은 Gemini 3.8 Flash를 능가한다고 언급되었습니다. 현재 API로만 이용 가능하지만, 에이전트 워크플로우에 활용될 것으로 기대됩니다.
SpaceXAI가 Grok Build v1.0.36을 출시하며 대시보드 제어 기능과 실시간 백그라운드 작업 스트리밍 기능을 추가했습니다. 이번 업데이트는 조직 정책 관리 강화, 샌드박스 신뢰 및 에이전트 관련 버그 수정에 중점을 두었습니다.
Alex Karp는 AI 기업들이 고객의 IP에 접근하여 모델을 개선하기 위해 토큰 비용을 할인하는 것이 시장 확대가 아닌 IP 탈취 목적이라고 지적합니다. 그는 이로 인해 발생하는 무한 책임 문제를 언급하며, 결국 강력해진 AI 기업들은 법적 책임을 감당할 수 없어 정부 주도의 국유화 구조를 필요로 한다고 주장했습니다.
글래드하우스(GitLab)와 GitHub의 API 사용 시 GraphQL을 활용하는 것이 효율적입니다. REST API 대비 필드를 제한하고 타입 간 데이터를 결합하여 요청 횟수와 토큰량을 동시에 줄일 수 있습니다. 다만, 대규모 조직 환경에서는 서버에 큰 부담을 주거나 예상치 못한 DB 쿼리 폭증이 발생할 수 있으므로 운영팀과의 사전 협의가 필수적입니다.