| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | ||
| 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| 27 | 28 | 29 | 30 |
- 클로드코드
- 무료 ai
- 안드로이드
- Android
- ai 뉴스
- AI 에이전트
- 홍드로이드
- 개발자 도구
- 클로드 API
- 개발 생산성
- 무료로 시작하기
- OpenAI
- 개발환경
- claude code
- ai에이전트
- Gemini
- Anthropic
- LLM
- 안드로이드 스튜디오
- MCP
- 실무
- 오픈모델
- 자동화
- Claude
- 바이브코딩
- AI 코딩
- claudecode
- Android Studio
- 카드 없이
- AI 에이전트 개발
- Today
- Total
홍드로이드의 야매코딩
GLM API 요금표 — 캐시 저장은 기간 한정 무료고, 싼 모델일수록 출력이 비쌉니다 본문

저가 API를 고를 때 입력 단가만 보고 결정하기 쉽습니다. 그런데 GLM 공식 요금표를 열어 항목별로 나눠보니, 같은 표 안에서 규칙이 일정하지 않았습니다. 캐시 할인율이 모델마다 다르고, 싼 모델일수록 출력이 입력보다 훨씬 비싸집니다. 그리고 지금 공짜인 항목 하나에 "기간 한정"이 붙어 있습니다.
📌 30초 요약
- 캐시 할인율이 모델마다 다릅니다. 정가의 10퍼센트부터 20퍼센트까지 갈립니다.
- "캐시는 10분의 1"이 아닙니다. 대부분 5분의 1 수준입니다.
- 캐시 저장료가 전 모델 "기간 한정 무료"입니다. 언젠가 청구되기 시작한다는 뜻입니다.
- 싼 모델일수록 출력 배수가 큽니다. 최상위는 3배대인데 가장 싼 축은 10배까지 갑니다.
- 입력과 출력이 같은 값인 모델도 둘 있습니다. 배수가 1배입니다.
- 토큰이 아니라 횟수로 세는 항목이 따로 있습니다. 검색은 1회당입니다.
캐시 할인율이 모델마다 다릅니다
요금표에는 입력·캐시된 입력·출력이 나란히 적혀 있습니다. 캐시 쪽 숫자를 입력으로 나눠보면 모델마다 비율이 다릅니다. 저는 이걸 한 줄로 기억하고 있었는데 — 실제로는 한 줄이 아니었습니다.
| 모델 | 입력 | 캐시된 입력 | 정가 대비 |
|---|---|---|---|
| 최상위 계열 | 2.2달러 | 0.45달러 | 약 20.5퍼센트 |
| 주력 5.2 계열 | 1.4달러 | 0.26달러 | 약 18.6퍼센트 |
| 보급형 4.7 계열 | 0.6달러 | 0.11달러 | 약 18.3퍼센트 |
| 경량 에어 | 0.2달러 | 0.03달러 | 15퍼센트 |
| 비전 플래시엑스 | 0.04달러 | 0.004달러 | 10퍼센트 |
정리하면 10퍼센트에서 20.5퍼센트까지 벌어집니다. 흔히 "캐시는 정가의 10분의 1"로 알려져 있는데, 이 표에서 10분의 1이 적용되는 건 가장 싼 비전 모델 하나뿐이고 주력 모델들은 5분의 1 언저리입니다. 즉 캐시가 잘 걸려도 절감 폭이 생각보다 작습니다. 캐싱이 조용히 실패하는 경우를 정리했을 때는 "걸렸느냐"가 문제였는데, 걸렸을 때 얼마나 아끼느냐도 모델마다 다릅니다.
⏳ 캐시 저장료에 "기간 한정 무료"가 붙어 있습니다
표에 열이 하나 더 있는데 캐시된 입력을 보관하는 값입니다. 여기에 전 모델 공통으로 "기간 한정 무료"라고 적혀 있습니다. 지금은 안 받지만 언젠가 받겠다는 뜻이죠. 이게 왜 중요하냐면 — 캐시는 쓸 때만 돈이 나가는 게 아니라 얹어두는 동안에도 돈이 나갈 수 있는 항목이기 때문입니다. 다른 회사들은 이미 보관료를 따로 받고 있고요. 지금 캐시를 크게 잡아두는 구조를 만들어뒀다면, 이 열이 유료로 바뀌는 날 계산이 달라집니다. 참고로 입출력이 같은 값인 두 모델은 이 열이 아예 비어 있습니다 — 캐시 자체가 없는 셈입니다.
싼 모델일수록 출력이 비쌉니다
이번엔 출력을 입력으로 나눠 봤습니다. 여기서 역전이 나옵니다 — 비쌀수록 배수가 작고, 쌀수록 배수가 큽니다.
| 모델 | 입력 대비 출력 | 해석 |
|---|---|---|
| 주력 5.2 계열 | 약 3.1배 | 표 전체에서 가장 완만 |
| 보급형 4.7 계열 | 약 3.7배 | 중간 |
| 경량 에어 | 5.5배 | 입력은 싼데 출력이 따라붙음 |
| 텍스트 플래시엑스 | 약 5.7배 | 가장 싼 유료 텍스트 모델 |
| 비전 플래시엑스 | 10배 | 표에서 가장 가파름 |
| 32B 장문 · 문자인식 | 1배 | 입력과 출력이 같은 값 |
실용적인 결론이 나옵니다. 싼 모델로 갈아타서 아끼는 폭은 "출력이 짧을 때" 가장 큽니다. 답이 길어지는 작업이라면 배수 차이가 절감분을 갉아먹거든요. 반대로 요약처럼 입력이 크고 출력이 짧은 일이라면 싼 모델의 이점이 그대로 남습니다. 그리고 입출력이 같은 값인 두 모델은 성격이 아예 다릅니다 — 긴 문서를 통째로 넣고 통째로 받는 용도라 배수를 따질 필요가 없게 만들어 둔 셈입니다.
토큰이 아니라 횟수로 세는 것들
요금표 아래쪽에는 단위가 아예 다른 항목들이 있습니다. 토큰으로 안 세니 예상 비용을 짤 때 따로 계산해야 합니다.
| 항목 | 세는 단위 | 값 |
|---|---|---|
| 웹 검색 | 쓸 때마다 1회 | 0.01달러 |
| 이미지 생성 | 장당 | 0.01~0.015달러 |
| 영상 생성 | 편당 | 0.2~0.4달러 |
| 음성 인식 | 토큰. 다만 분 단위 환산 병기 | 분당 약 0.0024달러 |
마지막 줄이 인상적이었습니다. 음성 인식만 유일하게 "분당 얼마"로 환산해 병기해 뒀습니다. 오디오는 토큰 감이 안 잡히니 배려한 것으로 보이는데, 다른 모델도 이렇게 익숙한 단위로 알려주면 좋겠다는 생각이 들었습니다. 검색은 호출 1회당이라 자동화로 반복 호출하면 토큰과 별개로 쌓입니다 — 하루 1,000번이면 10달러입니다.
🤖 번역 에이전트가 최상위 모델보다 비쌉니다
표 맨 아래 에이전트 항목이 따로 있는데, 여기서 숫자 하나가 튑니다. 범용 번역 에이전트가 100만 토큰당 3달러입니다. 같은 표에서 가장 비싼 텍스트 모델의 입력 단가가 2.2달러인데, 그보다 높습니다. 슬라이드·포스터 에이전트는 0.7달러라 훨씬 싸고요. 이 차이를 어떻게 읽어야 할지는 문서에 설명이 없습니다. 다만 "에이전트"라고 묶여 있어도 값이 네 배 넘게 갈린다는 것, 그리고 번역을 많이 돌릴 계획이라면 일반 모델에 직접 시키는 쪽과 비교해 볼 만하다는 것 정도는 말할 수 있겠습니다. 영상 템플릿은 또 편당 0.2달러로 단위가 다르고요.
🧾 정직하게 — 이 글의 한계
- 비율과 배수는 제가 나눈 것입니다. 요금표에는 단가만 있고 퍼센트나 배수는 안 적혀 있습니다. 계산 실수 가능성은 제 몫입니다.
- 공식 표를 옮긴 시점의 값입니다. 가격은 바뀌고, 특히 "기간 한정"이라 적힌 항목은 예고 없이 유료화될 수 있습니다.
- 실제로 청구서를 받아본 게 아닙니다. 표의 단가와 실제 청구 사이에 최소 과금 단위 같은 규칙이 있는지는 제가 잰 범위에 없습니다.
- 모델 이름을 계열로 묶어 적었습니다. 같은 계열 안에서도 값이 다를 수 있으니, 쓸 모델의 정확한 이름으로 원문 표를 확인하세요.
🗺️ AI 지출 전체 지도
단가표를 나눠보는 건 비용 관리의 시작일 뿐입니다. 구독과 종량제 중 무엇을 고를지, 캐시를 어떻게 쓸지, 상한을 어떻게 걸지가 그다음에 있고요. 지금까지 확인한 것들을 일곱 단계 지도 한 장으로 묶어뒀습니다.
자주 묻는 것
Q. 완전 무료인 모델은 몇 개인가요?
이번 표에서는 셋입니다 — 텍스트 둘, 그리고 비전에도 하나가 있습니다. 입력·캐시·출력이 전부 무료로 표기돼 있고요. 무료 모델의 한도를 찾아봤을 때는 텍스트 둘만 놓고 봤는데, 비전 쪽에도 무료가 있다는 건 이번에 표를 통으로 보고 알았습니다. 물론 그때 결론은 그대로입니다 — 가격표에 "무료"라고 적혀 있어도 얼마나 쓸 수 있는지는 표에 없습니다.
Q. 구독과 종량제 중 뭐가 낫나요?
이 표만으로는 못 정합니다. 종량제는 쓴 만큼이고 구독은 한도 안에서 정액이라 계산 방식 자체가 다르거든요. 다만 이 표에서 얻을 수 있는 판단 재료는 있습니다 — 내 작업이 출력이 긴 쪽인지 짧은 쪽인지를 먼저 보세요. 출력이 길면 배수 때문에 종량제가 빨리 오릅니다. 코딩 플랜의 크레딧이 어떻게 깎이는지를 따로 정리해 뒀으니 함께 보시면 계산이 됩니다.
Q. 최신 모델은 표에 왜 없나요?
가장 최근에 나온 모델은 이 요금표에 아직 없습니다. 모델 소개 문서는 따로 있는데, 거기에 "API는 곧 제공됩니다"라고만 적혀 있고요. 대신 구독 플랜에서는 이미 쓸 수 있다고 안내합니다. 즉 구독으로는 되는데 종량제로는 아직 안 되는 상태인 거죠. 새 모델이 나왔다는 소식을 봤다면 요금표에 줄이 생겼는지부터 확인하는 게 정확합니다.
✨ 오늘 확인한 것 정리
같은 요금표 안에서도 규칙이 일정하지 않습니다. 캐시 할인율은 10퍼센트에서 20.5퍼센트까지 갈리고, "10분의 1"이 맞는 모델은 하나뿐입니다. 출력 배수는 싼 모델일수록 커져서 최대 10배까지 가고요 — 싼 모델의 이점은 출력이 짧을 때 가장 큽니다. 그리고 캐시 저장이 "기간 한정 무료"라는 것, 오늘 계산에 안 들어간 이 항목이 언젠가 청구서에 등장합니다.
※ 확인 경로(2026년 8월 17일 기준): docs.z.ai/guides/overview/pricing. 모든 값은 미국 달러이며 100만 토큰 기준입니다. 비율과 배수는 제가 계산한 것입니다.
※ 가격은 수시로 바뀝니다. 특히 "기간 한정"으로 표기된 항목은 유료로 전환될 수 있으니 결제 전 원문을 확인하세요.
'AI & Vibe Coding' 카테고리의 다른 글
| AI 캐시 요금 3사 비교 — 읽기는 6배까지 갈리고, 쓸 때 돈 받는 곳은 한 곳뿐입니다 (0) | 2026.08.17 |
|---|---|
| Claude Code 세션 재개 — 권한 모드는 안 따라오고, 어느 쪽을 골라도 한 번은 전부 다시 읽습니다 (0) | 2026.08.17 |
| Claude Code 딥링크 — 클릭해도 실행은 안 되고, 깃허브에서는 링크가 사라집니다 (0) | 2026.08.17 |
| Claude Code 백그라운드 세션 — 커밋과 푸시를 안 묻고 하고, main만은 건드리지 않습니다 (0) | 2026.08.17 |
| Claude Code 아티팩트 공유 — 커넥터를 부르면 공개 링크가 막히고, 데이터는 보는 사람 계정으로 나갑니다 (0) | 2026.08.17 |
