홍드로이드의 야매코딩

GLM-5.3 출시 — 코딩 50퍼센트 향상이라는데 API는 아직 안 열렸습니다 본문

AI & Vibe Coding

GLM-5.3 출시 — 코딩 50퍼센트 향상이라는데 API는 아직 안 열렸습니다

홍드로이드 2026. 8. 16. 15:47
반응형

GLM-5.3이 나왔습니다. 8월 14일 발표됐고, 코딩 성능이 50퍼센트 좋아졌다는 이야기가 돌고 있습니다. 저가 코딩 모델 쪽에서 가장 많이 언급되는 이름이라 바로 공식 문서를 열어봤는데, API는 아직 준비 중이고 가격표에도 이름이 없었습니다. 지금 쓸 수 있는 사람과 못 쓰는 사람이 갈립니다. 벤치마크 숫자도 하나씩 나눠보니 "50퍼센트"라는 표현이 감추는 게 있었습니다.

📌 30초 요약

  • API는 아직입니다. 공식 문서에 "곧 제공"이라고 적혀 있고, 지금은 코딩 플랜 가입자만 쓸 수 있습니다.
  • 가격표에 GLM-5.3이 없습니다. 다른 모델은 다 있는데 이 줄만 비어 있어, 단가를 아직 알 수 없습니다.
  • 새 모델이 아니라 같은 베이스입니다. 문서가 "개선은 전부 사후 학습에서 나왔다"고 직접 적었습니다.
  • 컨텍스트 100만 토큰, 출력 최대 12만 8천 토큰입니다.
  • 벤치마크 상승폭이 지표마다 크게 다릅니다. 6배 오른 것도 있고 1.2배에 그친 것도 있습니다.
  • 가장 크게 오른 지표는 원래 점수가 4.6점이었습니다. 6배가 돼도 28.3점입니다.

먼저 확인할 것 — 지금 쓸 수 있나

신규 모델 소식을 보면 바로 API 키를 꺼내게 되는데, 이번엔 잠깐 멈춰야 합니다. 모델 문서에 "GLM-5.3 API는 곧 제공됩니다"라고 적혀 있습니다. 지금 접근할 수 있는 건 코딩 플랜 가입자입니다.

확인차 가격 문서도 따로 열어봤습니다. GLM-5.2·5.1·5·5-Turbo부터 4.7·4.6·4.5 계열까지 열네 줄이 표에 들어 있는데, GLM-5.3은 그 표에 없습니다. 두 경로 모두 같은 이야기를 하고 있으니, API로 붙여 쓰려는 계획이라면 아직 시점이 아닙니다.

🕰️ "출시"와 "쓸 수 있음"은 다릅니다

요즘 신규 모델 소식에서 반복되는 패턴입니다. 발표는 났는데 접근 경로가 순차적으로 열립니다. 구독 플랜 먼저, API 나중, 오픈 가중치는 그보다 더 나중인 식이죠. 바로 어제도 요금 이야기에서 같은 걸 겪었는데, 그때는 취소된 계획이 아직 살아 있는 정보로 돌고 있었습니다. 이번엔 반대로 아직 안 열린 것이 열린 것처럼 읽힙니다. 어느 쪽이든 방법은 같습니다 — 공식 문서의 모델 목록과 가격표에 그 이름이 실제로 있는지 보는 것.

새 모델이 아니라 같은 모델을 더 가르친 것

이번 버전에서 가장 눈에 띈 한 줄입니다. 문서가 "모든 개선은 사후 학습에서 나왔다"고 적었습니다. GLM-5.2와 같은 베이스 모델을 쓰고, 구조를 바꾼 게 아니라는 뜻입니다.

버전 번호가 올라가면 흔히 더 큰 모델, 새 아키텍처를 떠올리는데 이번엔 아닙니다. 판단에 도움이 되는 정보입니다 — 베이스가 같으니 속도나 토큰 소비 특성은 크게 안 변할 가능성이 있고, 반대로 학습으로 끌어올린 부분은 작업 종류에 따라 체감이 갈릴 수 있습니다. 물론 이건 제 추론이고, 문서가 그렇게까지 말하지는 않았습니다.

"50퍼센트"를 지표별로 나눠보면

문서는 코딩 성능이 50퍼센트 좋아졌다고 요약하면서 네 개 지표의 전후 점수를 함께 실었습니다. 그 숫자를 그대로 나눠봤습니다.

지표 GLM-5.2 GLM-5.3 배수
Terminal-Bench 3.0 4.6 28.3 6.2배
ExploitBench 24.4 54.4 2.2배
DeepSWE v1.1 46.2 66.9 1.4배
Agents' Last Exam 23.8 28.5 1.2배

전후 점수는 문서에 실린 값이고, 배수는 제가 나눈 것입니다. 문서에는 배수가 적혀 있지 않습니다.

1.2배부터 6.2배까지 벌어집니다. "50퍼센트 향상"이라는 한 줄로는 이 폭이 안 보입니다. 그리고 가장 크게 오른 지표를 자세히 보면 다른 이야기가 됩니다 — Terminal-Bench 3.0의 출발점이 4.6점입니다. 거의 못 하던 일을 이제 조금 하게 된 것에 가깝지, 잘하던 걸 훨씬 잘하게 된 게 아닙니다. 6배라는 숫자는 바닥이 낮아서 나온 배수입니다.

반대로 DeepSWE는 46.2에서 66.9로, 배수는 1.4배지만 이미 절반쯤 하던 일을 3분의 2까지 끌어올린 변화입니다. 실무 체감으로는 이쪽이 더 클 수도 있습니다. 배수만 봐도, 향상폭만 봐도 놓치는 게 생깁니다 — 출발점을 같이 봐야 합니다.

가격은 아직, 대신 형 모델 단가로 가늠하면

GLM-5.3 단가가 안 나왔으니 바로 앞 버전 값으로 위치를 잡아보겠습니다. 가격 문서 기준입니다.

100만 토큰당 입력 캐시 입력 출력
GLM-5.2 1.4달러 0.26달러 4.4달러
GLM-5 1달러 0.2달러 3.2달러
GLM-4.7 0.6달러 0.11달러 2.2달러
GLM-4.7-Flash 무료 무료 무료
GLM-4.5-Flash 무료 무료 무료

표에서 눈에 띄는 건 가격표에 "무료"라고 적힌 모델이 둘이라는 점입니다. Flash 계열 두 개가 입력·출력·캐시 전부 무료로 표기돼 있습니다. 다만 가격 필드가 0원이라고 진짜 공짜인지는 따로 확인해야 한다는 걸 다른 서비스에서 이미 겪었습니다 — 가격 0원인데 유료였던 모델들이 있었죠. 여기서도 호출 한도나 조건이 따로 걸려 있을 수 있어 그대로 믿기보다 계정에서 확인하는 게 맞습니다.

Claude 쪽과 나란히 놓으면 위치가 분명해집니다. Opus 5가 100만 토큰당 입력 5달러·출력 25달러니, GLM-5.2 기준으로 입력은 약 3.6배, 출력은 약 5.7배 싼 자리입니다. 저가 모델로 갈아타는 이야기에서 GLM을 "가성비 자리"에 뒀던 것과 위치는 그대로입니다.

🧾 정직하게 — 이 글의 한계

  • 제가 써보고 쓴 글이 아닙니다. API가 아직 안 열려서 붙여볼 수도 없었습니다. 벤치마크 숫자는 전부 만든 쪽이 낸 값이고, 제3자 검증 결과가 아닙니다.
  • 배수 계산만 제 몫입니다. 나눗셈일 뿐이고, 그 배수가 실무 체감과 얼마나 이어지는지는 모릅니다.
  • 파라미터 수·라이선스는 이 문서에서 못 찾았습니다. 앞 버전이 오픈 라이선스였다고 해서 이번에도 그렇다고 볼 수는 없어, "확인 못 했다"로 남깁니다.
  • 가격이 앞 버전과 같을지도 알 수 없습니다. 이 계열은 올해 들어 단가가 여러 번 올랐다는 이야기가 있어, GLM-5.2 값으로 GLM-5.3을 계산하면 안 됩니다.

🗺️ AI 지출 전체 지도

싼 모델로 갈아타는 건 지출을 줄이는 여러 갈래 중 하나일 뿐입니다. 단가가 같아도 캐시·구간·토큰 세는 법에 따라 청구가 갈리고요. 구독과 종량제 선택부터 모델 조합, 팀 단위 청구까지 지금까지 확인한 것들을 일곱 단계 지도 한 장으로 묶어뒀습니다.

자주 묻는 것

Q. 지금 GLM-5.3을 쓰려면 어떻게 하나요?

문서 기준으로는 코딩 플랜 가입자가 먼저 접근합니다. API로 직접 붙이려면 가격표에 이름이 올라오는 걸 기다려야 합니다. 급하지 않다면 며칠 뒤에 다시 확인하는 편이 낫습니다 — 지금 결제하면서 "5.3을 쓸 수 있겠지"라고 가정하지 마세요. 어느 플랜에서 언제 열리는지는 제가 확인한 범위 밖입니다.

Q. Claude Code 대신 쓸 만해졌나요?

앞 버전으로 같은 질문을 다뤘을 때의 결론은 "대신"이 아니라 "안에서 섞어 쓰기"였습니다. 이번 숫자만 놓고 보면 에이전트로 오래 도는 작업 쪽이 특히 올랐습니다 — 터미널에서 여러 단계를 밟는 계열 지표가 가장 크게 뛰었으니까요. 다만 그 지표의 출발점이 4.6이었다는 점도 같이 봐야 하고, 직접 돌려보기 전에는 결론을 내리기 이릅니다.

Q. 벤치마크 점수를 얼마나 믿어야 하나요?

만든 쪽이 발표한 값이라는 점을 항상 먼저 봐야 합니다. 그렇다고 조작이라는 뜻은 아니고, 유리한 지표를 골라 싣는 건 어느 회사나 하는 일이라는 뜻입니다. 이번 경우 전후 점수를 함께 공개한 건 좋은 쪽입니다 — 그래야 이 글처럼 나눠볼 수 있으니까요. 향상률만 적고 원점수를 안 주는 발표가 훨씬 흔합니다.

Q. 중국 모델이라 회사에서 쓰기 곤란한데요

데이터가 어디로 가고 어떻게 보관되는지는 제공사와 무관하게 확인해야 할 항목입니다. 회사 규정이 걸린다면 개인 실험용과 업무용을 분리하는 게 현실적입니다. 참고로 이 문제는 국적으로만 갈리지 않습니다 — 사내 서버에 직접 올려도 대화는 밖으로 나가는 구조를 얼마 전에 확인했거든요. 어느 서비스든 "무엇이 어디로 가는지"를 따로 읽어야 합니다.

🆓 무료 표기의 실제 조건을 찾아봤습니다 (8월 16일 추가)

이 글에서 가격표에 무료로 적힌 모델이 둘이라고 적으면서 "실제 조건은 따로 확인해야 한다"고 남겨뒀습니다. 그 숙제를 처리했습니다 — 여섯 경로를 열었지만 무료 등급의 한도·쿼터는 어디에도 없었습니다. 공개 문서의 한도 링크는 계정 관리 화면으로 넘어가, 로그인하지 않으면 모델 이름만 보이고 숫자는 안 보입니다. 카드가 필요한지도 문서에 명시가 없었습니다("필요하면 충전하라"는 안내뿐). 즉 "무료"는 공개돼 있고 "얼마나"는 가입 뒤에 있는 구조입니다. 다만 여섯 경로에서 못 찾은 것이지 없다는 뜻은 아닙니다. 전체 기록은 무료 모델 한도를 찾아본 글에 있습니다.

🔢 가격표엔 없지만 배수는 이미 공개돼 있었습니다 (8월 16일 추가)

이 글은 API 가격표 열네 줄 어디에도 GLM-5.3이 없다고 적었습니다. 그 절반이 채워졌습니다 — 코딩 플랜 문서에는 GLM-5.3의 크레딧 배수가 올라 있습니다: 입력 6.9 · 캐시 입력 1.7 · 출력 24. 모순이 아니라 앞뒤가 맞는 이야기입니다. 이 글이 확인한 "지금은 코딩 플랜 가입자만"이 맞다면, 플랜 안에서는 이미 과금 대상이라 배수가 필요하고 토큰당 달러 단가는 API가 열려야 정해지는 순서니까요. 즉 지금 GLM-5.3을 쓰는 유일한 경로가 구독이고, 비용은 달러가 아니라 크레딧으로 계산해야 합니다. 등급별 크레딧과 차감 공식은 코딩 플랜을 계산해 본 글에 있습니다.

✨ 오늘 확인한 것 정리

GLM-5.3은 8월 14일 발표됐지만 API는 아직 열리지 않았고, 가격표에도 이름이 없습니다 — 문서 두 곳에서 같은 이야기를 확인했습니다. 구조는 GLM-5.2와 같은 베이스이고 개선은 전부 사후 학습에서 나왔다고 문서가 직접 적었습니다. 내세운 "코딩 50퍼센트 향상"을 지표별로 나눠보면 1.2배에서 6.2배까지 벌어지고, 가장 크게 오른 지표는 출발점이 4.6점이었습니다. 바닥이 낮아서 나온 배수라는 뜻입니다. 붙여 쓸 계획이라면 가격표에 이름이 올라온 다음이 맞습니다.

※ 확인 경로 두 곳(2026년 8월 16일 기준): 모델 문서 docs.z.ai/guides/llm/glm-5.3, 가격 문서 docs.z.ai/guides/overview/pricing. 비교용 Claude 단가는 앤트로픽 공식 가격 문서 기준입니다.

※ 벤치마크는 모델 제공사가 발표한 값이며 제3자 검증 결과가 아닙니다. 금액은 미국 달러 기준이고 환율·부가세는 포함하지 않았습니다. 신규 모델은 며칠 사이에도 조건이 바뀌니 결제 전 공식 가격 페이지를 확인하세요.

반응형
Comments