AI 데일리 다이제스트: 2026년 10월 3일 - Claude Code Mods, 스마트 글래스용 Muse, DGX Spark 64GB
요약
Anthropic이 Claude Code의 동작 방식을 변경하는 'mods' 기능을 출시했습니다. 이 mods는 TypeScript 기반의 플러그인 형태로, 프롬프트 재작성, tool call 제어, 커스텀 UI 구현 등 광범위한 확장성을 제공합니다. 또한 Meta Muse 에이전트가 스마트 글래스로 이동하고 NVIDIA가 로컬 AI 메모리 티어를 업데이트하는 등 다양한 기술 동향을 다룹니다.
핵심 포인트
- Claude Code의 'mods'는 TypeScript 기반 플러그인으로, 강력한 커스터마이징 기능을 제공합니다.
- Mods는 샌드박스되지 않아 Claude Code와 동일 권한으로 실행되므로 보안에 주의해야 합니다.
- Meta Muse 에이전트가 스마트 글래스로 이동하며 AI 인터페이스의 변화를 예고했습니다.
- NVIDIA는 로컬 AI 박스를 위한 새로운 메모리 티어 및 가격 정책을 발표했습니다.
Claude Code가 작은 TypeScript mods로 해킹 가능해졌고, Meta의 Muse 에이전트는 스마트 글래스로 이동하고 있으며, NVIDIA는 로컬 AI 박스에 새로운 메모리 티어와 가격을 부여했습니다. Bloomberg에 따르면 Anthropic의 IPO는 또다시 연기되었고, Tesla는 3분기 인도량 추정치를 상회했으며, Microsoft는 하루 만에 세 가지 음성 모델을 출시했습니다. 총 일곱 가지 이야기이며, 각 섹션 하단에 출처가 명시되어 있습니다.
Anthropic이 작은 TypeScript mods로 Claude Code를 개방하다
Anthropic은 10월 1일과 2일에 'mods'라는 기능을 출시했는데, 이는 Claude Code의 동작 방식을 변경하는 작은 TypeScript 함수입니다. mod는 tool call, permission request, prompt submission, UI rendering 같은 이벤트가 발생하기 전, 후 또는 그 자리에 실행될 수 있습니다. Mods는 플러그인 형태로 제공되며, CLI와 데스크톱 앱 모두에서 /plugin으로 설치할 수 있고, Claude Code v2.1.287 이상이 필요합니다.
— Anthropic · TechDig
적용 범위가 매우 넓습니다. Mods를 사용해 프롬프트를 재작성하거나, tool call을 차단 또는 재시도하고, permission request를 승인 또는 거부하며, tool 출력에서 비밀 정보를 제거할 수 있고, 커스텀 UI(버튼, 패널, /commands)를 그릴 수도 있습니다. Anthropic은 또한 자체 내장 기능들도 mods로 마이그레이션하고 있습니다. /diff는 이미 비활성화하거나 대체할 수 있는 mod이며, AGENTS.md 로딩과 텔레메트리도 내장된 mods이며, 앞으로 더 많은 것이 뒤따를 예정입니다. 세 가지 공식 예시는 그 범위를 보여줍니다: Token Weather는 프롬프트 위에 실시간 컨텍스트 창 예측을 표시하고, Blast Radius는 rm -rf 같은 위험한 명령어를 건너뛰어보고 폭발 영역을 먼저 미리 보여주며, Replay Theater는 편집 라운드를 한 번에 하나의 변경 사항으로 단계별로 진행시켜 줍니다.
여기서 읽을 가치가 있는 부분: mods는 샌드박스(sandboxed)되지 않습니다. 이는 Mods가 Claude Code 자체와 동일한 권한으로 실행된다는 의미이며, 사용자가 보기 전에 비밀 정보(secrets)를 읽거나, 프롬프트를 재작성하거나, 도구 호출(tool calls)을 승인할 수 있다는 뜻입니다. 엔터프라이즈 설치 버전에는 기본적으로 sec-default mod가 내장되어 처음 로드되며, 권한 거부 규칙(permission-deny rules)을 무시하려는 모든 시도를 차단합니다. Anthropic은 Mods 작성에도 Claude를 사용하며, 이를 통해 에이전트가 TypeScript 코드를 생성하고, 설치하며, 핫 리로드(hot reload)할 수 있습니다. 이처럼 깊은 확장성은 정말 유용하지만, 이제 신뢰 경계(trust boundary)는 마지막으로 설치한 Mod를 누가 작성했는지에 달려있습니다.
Meta가 Muse 에이전트를 스마트 글래스에 탑재하다
Meta는 10월 2일, 자사의 AI 에이전트 Muse가 곧 스마트 글래스로 출시될 것이라고 발표했습니다. 'Hey Muse' 또는 사용자 지정 이름으로 음성 인식하여 깨우고, 휴대폰을 주머니에 넣어둔 채로 작업을 백그라운드에서 완료될 때까지 실행하고 보고받을 수 있습니다.
— Meta · TechCrunch
Muse는 MuseSpark 모델에서 작동하며, 핵심 실행 환경은 자체 브라우저, 파일 시스템(filesystem), 터미널을 갖춘 클라우드의 사설적이고 지속적인 Linux VM입니다. 앱을 닫아도 작업은 계속 진행됩니다. 이 에이전트는 스스로 코드를 작성하고 실행하며, 여러 하위 에이전트(subagents)를 배포하고, 예약된 작업을 설정하여 그 과정에서 문서, PDF, 웹사이트, 대시보드 등을 생성합니다. 특히 글래스용으로 Meta는 예약을 검색하거나, 항공편을 찾거나, 부품을 찾고, 식사를 기록하거나, 운동 지침을 제공하며, 눈앞의 물건을 구매하는 등의 기능을 나열했습니다. 결제는 Stripe Link 일회성 가상 카드(one-time virtual cards)를 통해 이루어지므로, AI가 실제 은행 카드 정보에 접근할 일이 없습니다.
개인정보 보호 약관은 자세히 읽어볼 필요가 있습니다. Muse 데이터는 광고 목적으로 사용되지는 않지만, 사용자가 명시적으로 거부(opt out)하지 않는 한 향후 모델 훈련에 사용됩니다. Meta조차 접근할 수 없는 기밀 VM이 올해 말에 제공될 예정입니다. 여기서 맥락을 이해하는 것이 중요합니다: Muse는 9월 8일에 출시되었으며, Connect 2026에서는 이를 Meta의 소비자 AI 추진력의 중심축으로 자리매김했습니다. 하루 종일 착용하는 하드웨어와 결코 잠들지 않는 VM은 현재까지 가장 구체적인 소비자 에이전트 배포 형태이며, 기본 설정(default-on)으로 작동하는 훈련 데이터 자체가 진입 비용인 셈입니다.
NVIDIA, 64GB DGX Spark 티어 추가 및 가격 책정
NVIDIA는 10월 2일, DGX Spark용 새로운 64GB 통합 메모리 구성을 $4,999부터 시작하는 것으로 발표했으며, 출하 예정일은 10월 23일입니다. 이 제품은 Acer, ASUS, Dell, Gigabyte, HP, MSI 등 OEM을 통해 판매됩니다. 해당 티어에는 Founders Edition이 없습니다.
— NVIDIA · Tom's Hardware
하드웨어 이야기는 중요한 부분에서 변함이 없습니다: GB10 Grace Blackwell 슈퍼칩, DGX OS, 전체 CUDA 소프트웨어 스택, 그리고 ConnectX-7 모두 계승됩니다. 64GB 중 약 8GB는 시스템용으로 예약되어, 가중치(weights)와 KV 캐시를 위해 대략 56GB가 남습니다. NVIDIA의 공식 입장은 최대 1,000억 개 매개변수(parameters)까지 로컬에서 실행 가능하다는 것입니다. NVFP4 기준으로 Qwen3.8-27B 가중치는 16.5GB를 차지하며, KV 캐시를 위해 40GB가 남고, Gemma4 26B-A4B는 15GB에 들어갑니다. 두 개의 64GB 유닛을 QSFP를 통해 직접 연결하면 2,000억 개 매개변수 상한선을 가진 128GB 메모리 풀이 형성되며, Qwen3.8-27B는 해당 2대 클러스터에서 최대 1.7배의 처리량(throughput)을 기록했습니다. Sync Cluster Assistant를 사용하면 최대 네 개의 유닛까지 자동 네트워크 연결할 수 있습니다.
가격 책정 변화가 진짜 이야기입니다. 128GB Founders Edition은 2025년 $3,999에 출시되고 2026년 2월 $4,699로 상승한 후, 10월 2일부로 $6,950까지 인상됩니다. 언론 보도에 따르면 이러한 증가는 메모리 공급 제약과 비용 증가 때문이라고 합니다. NVIDIA는 또한 llama.cpp와 vLLM을 위한 심층 최적화를 통해 로컬 에이전트 추론(local agent inference) 속도가 최대 1.9배 빨라졌다고 주장합니다. 이들을 함께 읽어보면, 진입 가격은 하락했지만 최고가 제품의 가격은 상승했고, 판매 주장은 이제 명시적으로 로컬 에이전트 워크플로우에 초점을 맞추고 있음을 알 수 있습니다.
🔗 ITHome
테슬라, 3분기 인도량 시장 기대치 상회했으나, 스토리지 부문은 미달
테슬라의 10월 2일 IR(Investor Relations) 보도 자료에 따르면, 3분기 생산량은 464,391대, 인도량은 486,532대로 집계되었으며, 이는 Model 3/Y가 478,237대를 차지하고 나머지 모델이 8,295대를 차지한 수치입니다. 에너지 스토리지(Energy storage) 배치는 13.7 GWh를 기록했습니다.
— Tesla IR · CNBC
인도량은 약 463,761대라는 시장 기대치를 약 5% 상회했지만, 회사 자체 집계 컨센서스는 461,974대였습니다. 분기 실적은 전년 동기(Q3 2025) 기록인 497,099대에는 미치지 못하며 전년 대비 2.1% 감소했지만, 직전 분기(Q2)의 480,126대와는 비교하여 증가세를 보였습니다. 주가는 장중 한때 5% 이상 상승했습니다. 스토리지 부문이 더 약한 고리입니다: 13.7 GWh는 컨센서스인 약 15.9 GWh에 미달했으며, 비록 직전 분기(Q2)의 13.5 GWh와 작년의 12.5 GWh보다는 높았지만 말입니다.
같은 주간에 제출된 SEC(미국 증권거래위원회) 서류에는 자금 조달 세부 사항이 추가되었습니다: 확장 지원을 위한 신규 대출 및 신용 시설로 300억 달러가 투입되었으며, 올해 공장 건설과 Robotaxi를 위해 설비 투자(capital expenditure, capex)는 250억 달러를 초과할 것으로 예상됩니다. 스티어링 휠도 페달도 없는 2인승 차량인 Cybercab이 생산을 시작했으며, 전체 실적 보고서는 10월 21일 마감 후 발표될 예정입니다. 인도량 상회는 좋은 소식이지만, 부채와 capex 수치는 Robotaxi 베팅이 실시간으로 자금을 조달하고 있음을 보여줍니다.
🔗 Tesla IR
Microsoft, 하루 만에 세 가지 음성 모델 출시
10월 1일, Microsoft AI 블로그는 세 가지 모델을 동시에 발표했습니다: 스트리밍 음성 인식용 MAI-Transcribe-2-Streaming과 MAI-Voice-2.1 및 MAI-Voice-2.1-Flash입니다.
— Microsoft AI · Artificial Analysis
MAI-Transcribe-2-Streaming은 최종 전사 WER(Word Error Rate) 부문에서 Artificial Analysis의 38개 모델 리더보드에서 2.5%로 1위를 차지하며, 이전 선두 주자 Grok Voice Transcribe 2.0의 2.7%를 앞섰습니다. 또한 지연 시간(latency) 면에서도 0.13초로 0.49초보다 빠릅니다. 첫 부분 결과는 오디오 수신 후 약 100밀리초 이내에 도착하며, 첫 부분 전사본은 WER 2.5%에서 약 0.12초 만에 게시됩니다. 이 모델은 60개 언어를 자동 감지합니다. 가격은 연말까지 진행되는 프로모션으로 시간당 $0.54이며, 이는 분당 약 9달러로 ElevenLabs Scribe v2 Realtime 및 Deepgram Flux의 대략적인 $6.50보다 높은 수준입니다. Microsoft는 가격보다는 품질, 지연 시간, 그리고 엔터프라이즈급 배포에 초점을 맞추고 있습니다.
MAI-Voice-2.1은 26개 지역에서 23개 언어를 지원하며, 현지 억양을 사용하면서도 여러 언어에 걸쳐 단일 목소리를 일관되게 유지합니다. 비용은 백만 문자당 $22입니다. Flash 버전은 백만 문자당 $15이며, 추론(inference) 속도가 55% 빠르고 유사 모델보다 약 60% 저렴합니다. 두 모델 모두 몇 초 분량의 참고 오디오를 통해 동의 메커니즘을 거쳐 음성 복제(voice cloning)를 지원합니다. MAI-Transcribe-2, MAI-Thinking-1, MAI-Code-1.1-Flash 및 MAI-Image 시리즈를 포함한 Microsoft의 자체 모델군은 계속 성장하며 Foundry, Copilot, Teams에 통합됩니다. 가격 면에서는 2위지만 WER(Word Error Rate) 면에서는 1위인 것은 우연이 아니라 의도적인 포지셔닝입니다.
Spanner Queues가 일반 사용 가능(General Availability)에 도달하다
Google은 Spanner Queues가 이제 일반 사용 가능해졌다고 발표했습니다. 이는 Spanner 데이터베이스 내에서 트랜잭션 메시징을 제공하며, 에이전트 워크플로우의 비동기 작업에 활용됩니다.
— Google Cloud
메시지는 데이터베이스 쓰기 작업과 원자적으로(atomically) 커밋되고 승인됩니다(acknowledge). SQL 인터페이스를 갖춘 풀 모델(pull model)이며, 메시지가 행(row)으로 저장되므로 직접 쿼리하고, 조인하며, 필터링할 수 있습니다. 미래 타임스탬프를 지정하여 전송을 예약하거나, 리스(lease)를 연장하고, 데드 레터(dead letters)는 승인되거나 삭제될 때까지 계속 재시도합니다. 핵심은 간단합니다. 별도의 큐 인프라를 프로비저닝할 필요가 없고, 운영해야 할 Kafka급 시스템도 없으며, Spanner 인스턴스와 함께 확장하고 그 교차 지역 가용성(cross-region availability)을 상속받습니다.
이 방향성은 언급할 가치가 있습니다. 에이전트 워크플로우 인프라가 핵심 데이터베이스에 흡수되고 있으며, 자금 흐름도 같은 것을 보여줍니다. 이미 Spanner에 비용을 지불하는 팀에게는 운영해야 할 시스템 하나가 줄어든 것이 실질적인 장점입니다. 열린 질문은 에이전트 트래픽이 많아졌을 때 처리량 프로필(throughput profile)이 전용 브로커와 어떻게 비교되는지이며, 그 답은 오직 프로덕션 환경에서만 나올 것입니다.
Anthropic의 IPO 로드쇼, 11월로 연기된 것으로 알려져
블룸버그(Bloomberg)에 따르면, Anthropic의 IPO 로드쇼는 이제 11월 9일 주를 목표로 하며, 11월 26일 추수감사절 전에 상장될 예정입니다. 이는 중도 선거를 앞두고 9월에 중순 10월을 예상했던 것보다 두 달 만에 두 번째 지연입니다. 해당 회사는 논평을 거부했습니다.
— Anthropic S-1 · Bloomberg
잠재 투자자들은 기업 가치를 1조 8천억 달러에서 2조 달러 사이로 논의하고 있으며, 이는 지난 5월 사모(private) 라운드에서 기록한 9,650억 달러보다 거의 두 배에 달합니다. 제출된 S-1 서류상 수치는 2025년 매출 45억 9천만 달러와 컴퓨팅 계약 의무액 5,180억 달러이며, 이 중 대부분은 용량이 사용되든 안 되든 지불해야 하는 고정 비용(rigid spend)입니다.
출처 표기는 정확하게 유지하세요: 로드쇼 일정은 공식 발표가 아닌 Bloomberg의 출처에 기인한 것이므로, 보고된 의도로 간주해 주세요. 주목해야 할 숫자는 45억 9천만 달러의 매출 기반과 5,180억 달러의 컴퓨팅 약속 사이의 격차입니다. 시장이 어떤 가치 평가를 수용하든 그 차이를 가격에 반영해야 합니다. 이 날짜가 유효한지는 다음 데이터 포인트가 될 것입니다.
KD Agentic · AI 데일리 다이제스트
AI 자동 생성 콘텐츠
본 콘텐츠는 Dev.to AI tag의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기