| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | ||||
| 4 | 5 | 6 | 7 | 8 | 9 | 10 |
| 11 | 12 | 13 | 14 | 15 | 16 | 17 |
| 18 | 19 | 20 | 21 | 22 | 23 | 24 |
| 25 | 26 | 27 | 28 | 29 | 30 | 31 |
- AI 에이전트
- Claude
- MCP
- 클로드코드
- OpenAI
- 바이브코딩
- 개발자 도구
- ai 뉴스
- AI 에이전트 개발
- 오픈웨이트
- ai에이전트
- claudecode
- Gemini
- 안드로이드
- Android
- 카드 없이
- AI 코딩
- 무료로 시작하기
- Android Studio
- claude code
- LLM
- 개발 생산성
- 무료 ai
- 실무
- 홍드로이드
- 안드로이드 스튜디오
- Anthropic
- 개발환경
- 자동화
- 오픈모델
- Today
- Total
홍드로이드의 야매코딩
AI 대화 맥락 자동 정리 — 결과만 지우고 요청은 그대로 남습니다 본문

AI에게 도구를 여러 개 붙여 쓰다 보면 대화가 금세 무거워집니다. 웹에서 긁어온 내용, 파일을 읽은 결과가 계속 쌓이거든요. 그래서 오래된 것부터 서버가 알아서 지워주는 기능이 있는데, 공식 문서를 읽어보니 생각과 다른 대목이 여럿입니다 — 결과만 지우고 무엇을 요청했는지는 그대로 남고, 지우는 순간 캐시가 깨지며, 조건이 안 맞으면 아예 아무 일도 안 일어납니다. 정리했습니다.
📌 30초 요약
- ★★결과만 지웁니다 — 무엇을 요청했는지는 그대로 남습니다.
- ★지울 양이 모자라면 아무 일도 안 일어납니다.
- ★지우면 그 지점부터 캐시가 깨집니다 — 둘 다는 못 가집니다.
- ⚠️ 생각 유지 기본값이 모델 세대마다 다릅니다.
- 내 쪽 기록은 그대로입니다 — 서버 쪽에서만 지웁니다.
- 기억에 남기는 건 자동이 아닙니다.
결과만 지우고 요청은 남습니다
기능의 성격부터. 대화에 실린 입력이 정해둔 양을 넘어서면 오래된 것부터 정리가 시작됩니다. 최근 몇 개는 남겨두고요. 그런데 기본값에서 지워지는 건 "도구가 돌려준 결과"뿐입니다. "내가 그 도구에 무엇을 달라고 했는지"는 그대로 남아요.
그래서 정리가 끝난 뒤 모델이 보는 그림은 "이걸 요청했었고, 결과는 지금 없다"가 됩니다. 요청 내용까지 감추고 싶다면 따로 켜야 합니다. 검색어나 파일 경로처럼 요청 자체에 민감한 게 실리는 경우가 있으니, 기본값이 무엇을 남기는지는 한 번 확인해 두는 게 좋아요. 웹에서 긁어온 내용을 계속 먹이는 구성이라면 이 기능이 가장 크게 체감되는 자리이기도 합니다.
⚠️ 특정 도구는 빼둘 수 있습니다
"이 도구 결과는 절대 지우지 마라"는 목록을 따로 줄 수 있습니다. 중요한 맥락을 지키는 데 유용하죠. 다만 빼두는 만큼 정리 효과는 떨어집니다 — 지울 게 줄어드니까요. 그리고 사용자의 취향이나 업무 맥락처럼 도구 결과가 아닌 정보는 이 기능이 손대지 않습니다. 그건 따로 관리해야 해요.
지울 양이 모자라면 아무 일도 안 일어납니다
여기가 가장 헷갈리는 지점입니다. "최소 이만큼은 지워라"를 정할 수 있는데, 그만큼을 못 채우면 정리를 아예 건너뜁니다. 조금만 지우고 마는 게 아니라 손도 안 대요. 왜 그런 설계인지는 다음 문단에 답이 있습니다.
지우는 순간 그 지점부터 캐시가 무효가 되기 때문입니다. 앞부분을 재활용해 싸게 쓰고 있었는데, 중간을 도려내면 그 뒤로는 다시 만들어야 해요. 그래서 "깰 만한 값어치가 있을 만큼 충분히 지워라"가 문서의 권고입니다. 찔끔 지우면 절약한 것보다 다시 만드는 비용이 더 큽니다.
| 무엇을 하면 | 캐시는 |
|---|---|
| 도구 결과를 지움 | 깨집니다 — 다시 만드는 비용 발생 |
| 생각 흔적을 남겨둠 | 보존됩니다 — 그대로 재활용 |
| 생각 흔적을 지움 | 그 지점부터 깨집니다 |
| 최소 지울 양을 못 채움 | 멀쩡합니다 — 정리 자체를 안 함 |
결국 캐시 성능과 맥락 여유는 동시에 못 가집니다. 문서도 "어느 쪽을 우선할지 정해서 설정하라"고 적어요. 대화가 아주 길어져 자리가 급하면 지우는 쪽, 같은 앞부분을 반복해서 쓰는 구조라면 남기는 쪽입니다.
모델 세대마다 기본값이 다릅니다
생각 흔적 쪽에 조용한 함정이 있습니다. 얼마나 남길지의 기본값이 모델 세대마다 다릅니다. 최근 세대는 앞선 생각을 전부 남기는 쪽이고, 이전 세대는 마지막 차례 것만 남기고 나머지를 지우는 쪽이에요. 급이 낮은 계열은 세대와 무관하게 마지막 것만 남깁니다.
그래서 문서가 못을 박습니다 — 여러 급을 오가는 코드라면 기본값에 기대지 말고 직접 지정하라고요. 안 그러면 모델을 바꾼 순간 조용히 더 많이 지워지고, 답변 흐름이 달라집니다. "같은 프롬프트인데 왜 결과가 다르지"의 원인이 여기일 수 있어요. 프롬프트를 다듬어 품질을 올리는 흐름에서도, 맥락이 얼마나 남아 있느냐가 프롬프트만큼 결과를 좌우합니다.
지워진 건 서버 쪽에서만입니다
정리는 요청이 모델에 닿기 직전, 서버에서 이뤄집니다. 그래서 내 프로그램이 들고 있는 대화 기록은 손대지 않은 그대로예요. 내 쪽을 지워진 상태에 맞춰 고칠 필요가 없다는 뜻이라 편한데, 대신 기록을 남기거나 감사에 쓴다면 "내가 가진 것"과 "모델이 실제로 본 것"이 달라집니다. 무엇이 얼마나 지워졌는지는 응답에 따로 실려 오니 그걸 함께 남겨야 합니다. 흐르듯 받는 방식이면 중간이 아니라 마지막에 옵니다.
✅ 기억에 옮겨두는 건 자동이 아닙니다
기억 기능과 함께 쓰면 "곧 지워질 테니 중요한 건 챙겨두라"는 안내가 모델에게 자동으로 갑니다. 여기까지만 자동이에요. 실제로 저장하라고 시키지 않으면 그냥 사라집니다. 긴 조사 작업처럼 중간 결과가 나중에 필요한 흐름이라면, 지침에 "중요한 발견은 파일로 남겨라"를 명시해 두세요. 그리고 두 가지 정리를 같이 쓸 때는 순서가 정해져 있습니다 — 생각 쪽을 먼저 적어야 합니다. 숫자가 무엇을 세는지 먼저 확인하라는 원칙이 여기서도 그대로 통합니다.
자주 묻는 질문 (FAQ)
Q. 켜기만 하면 바로 되나요?
아니요. 시험 단계 표시를 요청에 함께 붙여야 동작합니다. 기본 동작이 아니에요. 안 붙이면 설정을 아무리 정성껏 써도 그냥 무시됩니다.
Q. 보내기 전에 얼마나 줄었는지 알 수 있나요?
토큰을 세어주는 창구가 지우기 전과 후 두 값을 함께 돌려줍니다. 다만 세고 나서 내용을 더 붙이면 실제 요청과 달라지니 참고용으로 보세요.
Q. 예전에 쓰던 압축 설정은 어떻게 되나요?
내 프로그램 쪽에서 하던 방식은 폐기 절차에 들어갔습니다 — 일부 언어에선 경고가 뜨고 한 곳은 이미 제거됐어요. 서버 쪽 방식으로 옮기라는 안내입니다.
Q. 압축이 엉뚱한 때 걸리는데요?
알려진 한계입니다. 서버가 대신 돌려주는 도구를 쓰면 사용량 계산이 어긋나 시점이 틀어질 수 있어요. 세어주는 창구로 직접 확인하거나, 그런 도구를 쓸 때는 압축을 피하라고 안내합니다.
✨ 정리하면
맥락을 자동으로 줄여주는 기능이지만 "공짜로 줄여주는 것"은 아닙니다. 지울 때마다 캐시를 다시 만들어야 하니, 찔끔 지우지 말고 한 번에 충분히 지우도록 잡으세요. 그리고 요청 내용은 남는다는 것, 세대마다 기본값이 다르다는 것, 기억에 옮기는 건 시켜야 한다는 것 셋만 기억하면 됩니다. 비용 설계 전체 흐름은 AI 지출 관리 허브에 단계별로 정리해 두었습니다.
출처: Claude 공식 문서 「맥락 편집」 (2026-09-01 열람). 이 기능은 시험 단계이며, 기본값과 세부 동작은 모델과 판에 따라 다르고 변경될 수 있습니다.
'AI & Vibe Coding' 카테고리의 다른 글
| AI 환각 줄이는 법 — 모른다고 말할 허락을 주는 게 먼저입니다 (0) | 2026.09.01 |
|---|---|
| Claude 한국어 성능 — 영어의 96.7%, 급을 낮추면 벌어집니다 (0) | 2026.09.01 |
| 자체 호스팅 러너 지표 — 훅과 카운터가 같은 일을 다르게 셉니다 (0) | 2026.09.01 |
| AI 에이전트 SDK 새 방식 — 써보려 했더니 통째로 사라졌습니다 (0) | 2026.09.01 |
| AI 에이전트 관측 설정 — 로그가 안 나가도 아무 말이 없습니다 (0) | 2026.08.31 |