클로드 아카데미.. 여기서 컨텍스트, 토큰 내용을 제대로 이해할 수 있음.
요약
본문은 Claude의 성능과 비용에 영향을 미치는 컨텍스트 및 토큰 사용 방식에 대해 설명합니다. 특히, 대화 전체가 매번 전송되는 구조적 문제와 이를 해결하기 위한 컴팩션(요약) 기법을 다룹니다. 또한, 장기 기억 유지를 위해 'written memory' 기능과 Claude Code의 메모리 기능을 활용하는 것이 중요함을 강조합니다.
핵심 포인트
- 대화 전체가 매번 전송되어 비용이 증가할 수 있음.
- 컨텍스트 윈도우가 가득 차면 디테일 손실 위험이 있는 요약(컴팩션)으로 대체됨.
- Written memory는 여러 대화에 걸쳐 기억을 유지하는 장기 기억 방식임.
- 오래 유지되는 정보와 자주 바뀌는 값의 관리 기준을 세우는 것이 유용함.
클로드 아카데미.. 여기서 컨텍스트, 토큰 내용을 제대로 이해할 수 있음.
📒 컨텍스트가 Claude의 성능과 비용에 미치는 영향
https://t.co/ZT6jTjwULe
대답해주는 얘기는 가중치에 새겨진 파라메트릭 메모리, 사용자가 넣어준 컨텍스트, 모델이 직접 검색해 가져오는 에이전틱 컨텍스트에서 나옴.
잘못된 답은 대개 거짓말이 아니라 컨텍스트가 없거나 부정확하거나 품질이 낮아서 생김.
최대 100만 토큰을 담는 컨텍스트 윈도우도 생각보다 금방 차는데, 그 대부분은 사실 내가 쓴 내용이 아님.
메시지를 보낼 때마다 지금까지의 대화 전체가 다시 전송됨.
그래서 긴 대화 끝의 짧은 질문이 새 채팅에서 같은 질문을 하는 것보다 더 비쌀 수 있음.
윈도우가 한계에 가까워지면 대화를 요약해 교체하는 컴팩션으로 대화를 이어가지만, 요약인 만큼 디테일이 빠질 수 있음.
반면 written memory는 클로드가 남긴 메모를 다음 대화 시작 때 다시 읽어 여러 대화에 걸쳐 기억을 유지하는 방식임.
클로드 코드의 CLAUDE md + claude ai 메모리 기능이 바로 이 원리로 작동함.
오래 유지되는 정보는 기록하고, 자주 바뀌는 값은 매번 새로 찾아보는게 좋다는 기준도 유용함.
AI 자동 생성 콘텐츠
본 콘텐츠는 X @lucas_flatwhite (자동 발견)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기