이번 주 OpenAI, Anthropic, 구글이 낸 새 모델 세 개의 API 값이 모두 입력 100만 토큰당 2달러, 출력 10달러로
요약
OpenAI, Anthropic, Google이 새 모델의 API 가격을 입력 100만 토큰당 $2, 출력 $10으로 통일했습니다. GPT-6.1 Sol, Claude Sonnet 5.5, Gemini 4 Argon 등 세 모델의 출시와 함께 각 모델별 특징 및 사용 시 주의사항(예: 코드 변경점)이 안내되었습니다.
핵심 포인트
- OpenAI GPT-6.1 Sol은 코딩/전문 업무에 적합하며 Astra 성능을 저렴하게 제공합니다.
- Claude Sonnet 5.5는 컨텍스트가 커졌으나, 기존 사용 시 API 호출 및 코드 수정이 필요합니다.
- Google Gemini 4 Argon은 출력 한도가 대폭 늘어났으며, 도입 가격 기간을 활용할 수 있습니다.
- 각 모델의 입력 토큰 비용 차이를 이해하고 에이전트 설계에 반영해야 합니다.
이번 주 OpenAI, Anthropic, 구글이 낸 새 모델 세 개의 API 값이 모두 입력 100만 토큰당 2달러, 출력 10달러로 같았습니다. 값이 같아진 만큼 모델 선택은 캐시 가격과 옮겨 가는 비용에서 갈립니다.
GPT-6.1 Sol, Claude Sonnet 5.5, Gemini 4 Argon(도입 가격) 셋 다 2달러와 10달러입니다. 캐시 입력은 다릅니다. Sol은 100만 토큰당 0.10달러, Sonnet 5.5는 0.20달러이고 Argon은 입력가에서 95%를 깎습니다. 같은 문서와 도구 정의를 여러 번 읽히는 에이전트라면 월말 비용은 이 차이에서 벌어집니다. 이번 주 실무자가 챙길 변경 다섯 가지입니다.
-
OpenAI GPT-6.1 Sol이 나왔습니다. OpenAI는 코딩, 컴퓨터 사용, 전문 업무에서 GPT-6 Astra에 가까운 성능을 Astra 표준 가격의 5분의 1로 낸다고 밝혔습니다. 실제 코드베이스 과제를 푸는 DeepSWE v1.1에서는 Astra와 같은 점수였습니다. API 이름은 gpt-6.1-sol이고 ChatGPT Work와 Codex에서는 Plus 이상 요금제에 열렸지만 일반 Chat에는 아직 없습니다.
해볼 것: Codex에서 지난주 Astra로 시킨 작업 하나를 Sol로 다시 돌려 작업당 비용과 결과를 나란히 봅니다.
https://t.co/5YB84XtumR -
Claude Sonnet 5.5가 나왔고 Sonnet 4.5는 11월 30일 Claude API에서 내려갑니다. Sonnet 5.5는 컨텍스트 100만 토큰, 최대 출력 12만 8천 토큰입니다. Sonnet 5용 코드는 다섯 군데에서 깨집니다. 앞단 thinking을 끌 때 "disabled" 대신 "between_tools"를 보내야 하고 tool_choice의 any와 tool은 400 오류를 냅니다. 예전 컴퓨터 사용 도구 computer_20251124도 Claude API와 구글 클라우드에서는 받지 않습니다.
해볼 것: 저장소에서 disabled, tool_choice, computer_20251124를 검색해 고칠 곳부터 표시합니다.
https://t.co/XtdX5fZF4n -
구글이 Gemini 4 Argon을 공개했습니다. 출력 한도를 6만 4천 토큰에서 100만 토큰으로 늘린 모델입니다. 지금은 Fairwind 프로그램에 든 사이버 보안 방어 담당자와 구글 내부만 쓸 수 있고 유료 API 고객과 Google AI Ultra 구독자가 다음 순서입니다. 도입 가격이 끝나면 입력 4달러, 출력 20달러가 되는데 도입 기간은 밝히지 않았습니다.
해볼 것: 긴 출력이 필요한 작업(대규모 코드 이전, 긴 보고서) 하나를 골라 지금 쓰는 모델로 기준 결과를 만들어 둡니다. 출시 날 바로 비교할 수 있습니다.
https://t.co/UnRNumFOgz -
Claude Code가 2.1.287과 2.1.288로 올라갔습니다. 2.1.287의 Mods로 플러그인이 Claude Code의 동작 자체를 바꿀 수 있게 됐고 기본으로 켜져 있습니다. 2.1.288에서는 /code-review에 --max-findings 옵션이 붙어 보고할 문제 수를 늘리거나 줄일 수 있습니다. Ctrl+C로 지운 프롬프트도 빈 입력창에서 위 화살표를 누르면 붙여 넣은 글과 이미지까지 돌아옵니다.
해볼 것: 큰 PR 하나에 /code-review --max-findings all을 돌려 평소 한도에서 잘리던 지적이 몇 개였는지 셉니다.
https://t.co/iGpFrXmCmi -
OpenAI Agents API에 컴퓨터 사용이 붙었고 GPT-6 모델 안내서가 나왔습니다. 에이전트는 OpenAI가 운영하는 브라우저에서 일하고 사이트 접근 승인과 로그인은 개발사 앱이 맡습니다. 안내서는 가장 어려운 추론은 Astra, 복잡한 코딩과 컴퓨터 사용은 6.1 Sol, 목표가 분명한 반복 작업은 Luna로 나눕니다. API에서는 대화 도중 reasoning effort를 바꿔도 캐시가 깨지지 않는다고 적었습니다.
해볼 것: 에이전트 단계마다 effort를 low와 high로 나눠 두고 성공한 작업 하나당 비용을 잽니다.
https://t.co/cLjpOEGfix
팔란티어 쪽에서는 AIP Analyst 변경을 꼽겠습니다. 관리자가 조직 기본 모델을 Fast, Balanced, Smart 세 등급 가운데 하나로 정하고 AIP 스킬을 사용자 그룹에 한 번에 나눠 줍니다. 등급 뒤의 모델은 더 나은 모델이 나오면 팔란티어가 바꿉니다. 등급마다 특정 모델을 직접 지정하면 이 자동 교체에서 빠집니다. 이번 주처럼 새 모델이 몇 개씩 나오는 시기에는 직접 지정보다 등급 기본값을 두는 편이 관리 부담이 적다고 봅니다.
https://t.co/1tJCMKrNqC
숫자로는 미국 9월 고용을 남깁니다. 비농업 일자리는 2만 9천 개 늘어 시장 예상(다우존스 집계 8만 4천 개)을 크게 밑돌았고 실업률은 4.1%에서 4.2%로 올랐습니다. 7월과 8월 일자리도 합쳐서 6만 개 낮게 고쳐졌습니다. 9월 30일 5.29%까지 올랐던 미국 10년물 금리는 발표 직후 5.17%로 내려왔다고 AP가 보도했습니다. 다음 확인 날짜는 10월 27~28일 FOMC입니다.
https://t.co/VRwNSNKIDz
#AI #주간정리
AI 자동 생성 콘텐츠
본 콘텐츠는 X 개발자 생산성의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기