| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | ||
| 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| 27 | 28 | 29 | 30 |
- 바이브코딩
- 클로드 API
- OpenAI
- 실무
- LLM
- ai에이전트
- AI 코딩
- Android
- 홍드로이드
- 오픈모델
- 무료로 시작하기
- 무료 ai
- Android Studio
- claudecode
- MCP
- 무료 LLM
- 카드 없이
- 자동화
- 안드로이드 스튜디오
- 클로드코드
- ai 뉴스
- AI 에이전트 개발
- 개발 생산성
- 개발자 도구
- Gemini
- 안드로이드
- Claude
- AI 에이전트
- claude code
- 개발환경
- Today
- Total
홍드로이드의 야매코딩
메타 무료 모델 용량이 59GB냐 17GB냐 — 둘 다 맞는데 내 숫자는 따로 있었습니다 본문

Muse Glimmer 30B · 받기 전에 재기
59GB · 17GB · 32GB
세 숫자가 다 맞습니다.
각각 원본 저장소 · 양자화판 · 권장 그래픽카드 메모리입니다. 그리고 이 중 어느 것도 아닌 파일 하나를 따로 받아야 이미지가 됩니다.
메타가 Muse Glimmer 30B를 Apache 2.0으로 풀었다는 글을 사흘 전에 썼습니다. 이번엔 실제로 받기 전에 저장소를 열어 파일 크기를 쟀습니다. 이름이 30B라고 30GB가 아니라는 글에서 쓴 방법 그대로요. 그러다 보도와 3배 차이나는 숫자를 보고 의심했는데, 제 의심이 틀렸습니다. 그 과정을 그대로 적습니다.
📌 30초 요약
- 원본 저장소 실측 59.5GB(safetensors 2조각 합).
- 양자화판은 16.76GB — 보도의 "20GB 미만"은 이쪽이었습니다. 보도가 맞았습니다.
- ⚠️ 그런데 모델 카드가 말하는 실제 배포 목표는 그래픽카드 메모리 24GB 또는 32GB입니다.
- ⚠️ 이미지를 쓰려면 1.4GB 파일을 따로 받아야 합니다. 모델 파일에 안 들어 있습니다.
- ⚠️ 라이선스는 무수정 Apache 2.0인데 금지 용도 목록이 별도 파일로 있고, 둘의 관계는 안 적혀 있습니다.
- 모델 카드가 스스로 "Spark보다 대체로 덜 유능하다"고 적어뒀습니다.
① 제 의심이 틀렸습니다 — 그 과정부터
🔍 확인해봤고, 제가 틀렸습니다
보도에 "20GB 미만으로 압축돼 일반 하드웨어에서 돌아간다"고 되어 있었습니다. 그런데 저장소 파일 크기를 재보니 59.5GB였습니다. 3배 차이라 "보도가 과장했나" 싶었습니다.
그래서 양자화 저장소를 따로 열었더니 16.76GB가 있었습니다. 보도가 말한 건 그쪽이었고 숫자는 정확했습니다. 원본 저장소만 보고 "틀렸다"고 썼으면 없는 문제를 만들 뻔했습니다. 한 저장소만 보고 판단하면 안 된다는 걸 또 배웠습니다.
그래서 이 글은 "누가 틀렸나"가 아니라 "어느 숫자가 내 숫자인가"가 됩니다. 아래가 제가 잰 전부입니다.
| 무엇 | 크기 | 누구한테 필요한 숫자인가 |
|---|---|---|
| 원본 safetensors 2조각 | 59.55GB | 미세조정·직접 양자화할 사람 |
| 양자화 Q4_K_M | 16.76GB | 그냥 돌려볼 대부분의 사람 |
| 양자화 Q4_K_XL(동적) | 19.65GB | 품질을 조금 더 챙길 사람 |
| mmproj (이미지 처리용) | 1.40GB | 이미지를 넣을 사람 — 별도 파일 |
| dflash (추측 디코딩용) | 1.63GB | 속도를 더 짜낼 사람 — 별도 파일 |
| 토크나이저 | 28MB | 전원(자동으로 같이 받아짐) |
Hugging Face 파일 메타데이터의 바이트 값을 십진 GB로 환산 · 2026년 8월 14일 조회
네 번째 줄이 이 표의 핵심입니다. 이 모델은 이미지도 읽는 모델인데, 이미지 담당 부분이 모델 파일 안에 안 들어 있습니다. 양자화판만 받아서 이미지를 넣으면 안 됩니다. "저장소에 뜬 총량이 받을 양이 아니다"라고 썼는데, 여기선 반대로 받아야 할 걸 빠뜨리는 쪽이었습니다.
② 진짜 필요한 숫자는 표에 없었습니다
파일 크기를 다 재놓고 모델 카드를 읽다가 더 중요한 숫자를 봤습니다. 그리고 이 대목이 이번 글의 반전입니다.
📄 모델 카드가 보도보다 정확했습니다
보도는 "20GB 미만"에서 멈췄습니다. 그런데 메타의 모델 카드는 그 뒤를 이어서 적어놨습니다 — 20GB 미만인 건 언어 모델 부분만이고, KV 캐시 · 이미지 인코더 · 추측 디코딩 드래프터까지 얹으면 배포 목표가 그래픽카드 메모리 24GB 또는 32GB라고요.
→ 만든 회사가 정직하게 적었고, 인용이 절반에서 끊긴 겁니다. 저는 보통 벤더 숫자를 한 단계 낮춰서 보는데, 이번엔 벤더 문서 쪽이 더 보수적이었습니다.
즉 "16.76GB니까 16GB 카드면 되겠네"가 아닙니다. 모델을 메모리에 올리는 것 말고도 대화가 길어지면 쌓이는 캐시가 있고, 이미지를 쓰면 인코더가 붙고, 속도를 위한 드래프터가 또 붙습니다. 그래서 24GB부터입니다.
# 내려받기 전에 파일 크기부터 확인하는 법 (브라우저에서)
# 저장소 주소 뒤에 이렇게 붙이면 파일별 바이트 수가 그대로 나옵니다
https://huggingface.co/api/models/<계정>/<모델>?blobs=true
# siblings 안의 size 값이 바이트입니다.
# 1,000,000,000으로 나누면 GB(십진), 1,073,741,824로 나누면 GiB.
# 저장 공간 표기는 보통 십진, 운영체제 표시는 보통 이진이라 값이 달라 보입니다.
참고로 모델 카드에 적힌 파라미터 수는 약 29.6B이고 이미지 인코더까지 포함한 값입니다. 이름은 30B인데 언어 부분만 30B인 게 아니라 다 합쳐서 30B에 가깝다는 뜻입니다. 컨텍스트는 131,072 이상, 학습 언어는 100개 이상이라고 적혀 있습니다.
③ Apache 2.0인데 금지 용도가 따로 있습니다
Qwen3.8이 Apache인 줄 알았는데 아니었던 일이 있어서, 이번에도 라이선스 파일을 직접 열었습니다. 결과는 이렇습니다.
| 확인한 것 | 결과 |
|---|---|
| 저장소 라이선스 표기 | apache-2.0 |
| LICENSE 파일 본문 | 무수정 표준 Apache 2.0 — 추가 조항·부칙 없음 |
| LICENSE 안에 사용 정책 참조 | 없음 |
| 별도 USAGE_POLICY.md | 있음 — 금지 용도를 열거 |
| 모델 카드의 언급 | "사용 정책은 여기에 있습니다"라고 링크만 |
| 둘의 관계 서술 | 제가 읽은 범위에는 없었습니다 |
Apache 2.0은 용도를 제한하지 않는 라이선스입니다. 그런데 같은 저장소에 쓰면 안 되는 것들의 목록이 함께 있습니다. 금지 항목은 대략 이렇습니다 — 불법 행위 · 아동 대상 유해물 · 괴롭힘 · 차별 · 군사와 무기 개발 · 마약 · 자해 · 사기와 허위정보 · 사람인 척하기 · 가짜 후기 · 무자격 전문 상담(금융·법률·의료) · 무단 개인정보 수집 · 악성코드 · 안전장치 우회.
⚠️ 여기서 제가 단정하지 않는 것
이걸 "라이선스가 Apache가 아니다"로 읽으면 안 됩니다. LICENSE 파일은 무수정 Apache 2.0이 맞습니다. 제가 확인한 건 "두 문서가 같이 있는데 어느 쪽이 우선인지가 안 적혀 있다"까지입니다. 사용 정책이 법적 구속력을 갖는지, 아니면 요청에 가까운지는 제가 판단할 수 있는 영역이 아닙니다. 회사에서 쓸 거라면 이 두 파일을 같이 법무에 넘기세요.
실무적으로는 대부분의 사람에게 문제가 안 됩니다. 목록이 상식적인 금지 항목들이라서요. 다만 계약서 조항을 볼 때처럼, "오픈 라이선스니까 아무 데나 써도 된다"는 가정은 저장소에 파일이 하나 더 있는지 확인한 다음에 하시는 게 맞습니다.
④ 그런데 이게 원래 기다리던 모델은 아닙니다
Muse Spark 1.2 가중치가 언제 올라오나를 열 번째로 확인했습니다. 결과부터 적습니다.
📊 10회차 확인 — 여전히 없습니다
공식 계정의 모델 목록을 API로 받았더니 전부 네 개였고 전부 Glimmer 계열이었습니다 — 본체 · GGUF · 모바일용 · 어시스턴트판. Spark라는 이름은 하나도 없습니다.
그런데 이번에 맥락이 확실해졌습니다. 8월 10일에 "Spark 1.2도 공개하겠다"고 약속이 나왔고, 같은 날 실제로 공개된 건 Glimmer였습니다. 즉 약속은 있었고 아직 나흘밖에 안 지났습니다. 늦은 게 아니라 아직 안 된 것입니다. 이 구분을 아홉 번 동안 못 하고 있었습니다.
그리고 모델 카드가 둘의 관계를 직접 적어놨습니다. Glimmer는 Spark에서 증류한 모델이고, "대체로 Spark보다 덜 유능하다"고 되어 있습니다. 만든 회사가 자기 모델을 그렇게 적는 건 흔치 않아서 기록해 둡니다.
그러니 지금 상황은 이렇습니다 — 노트북에서 돌릴 모델이 필요하면 Glimmer는 지금 받을 수 있고 실제로 쓸 만합니다(닷새 만에 다운로드 12만 회, 파생 모델도 수십 개 올라왔습니다). 반대로 프런티어급을 로컬에서 돌리려고 기다리는 거라면 아직 기다려야 합니다. 둘을 같은 것으로 알고 있으면 잘못된 계획을 세우게 됩니다.
자주 묻는 것
Q. 16GB 그래픽카드로는 못 쓰나요?
제가 안 돌려봐서 단정 못 합니다. 모델 카드의 배포 목표가 24GB 또는 32GB라는 것까지가 문서 사실입니다. 일반적으로는 일부를 시스템 메모리로 넘겨서 돌리기도 하는데 그러면 느려집니다. 더 작은 양자화를 쓰는 방법도 있지만 품질이 떨어집니다. 이건 직접 재보는 수밖에 없습니다.
Q. 상업적으로 써도 되나요?
Apache 2.0 자체는 상업적 이용을 허용합니다. 다만 위에서 적은 대로 사용 정책 파일이 별도로 있고 둘의 관계가 문서에 없습니다. 개인 프로젝트면 신경 쓸 일이 거의 없고, 제품에 넣어 파는 거라면 두 파일을 같이 검토하세요. 저는 법률 조언을 할 수 없습니다.
Q. Spark 1.2는 언제 나오나요?
모릅니다. 날짜가 나온 걸 못 봤습니다. 공개하겠다는 약속은 8월 10일에 나왔고, 8월 14일 현재 저장소에는 없습니다. "곧"이라는 말 외에 일정에 해당하는 표현을 찾지 못했습니다. 계속 확인해서 이 글과 추적 글에 갱신하겠습니다.
✨ 정리하면
59GB · 17GB · 32GB가 다 맞습니다. 원본이냐 양자화판이냐 그래픽카드 메모리냐가 다를 뿐입니다.
받을 거라면 양자화판 16.76GB + 이미지용 1.4GB. 그리고 카드 메모리는 24GB부터가 모델 카드 기준입니다.
라이선스는 무수정 Apache 2.0이 맞고, 다만 금지 용도 목록이 별도 파일로 같이 있습니다. 제품에 넣을 거면 두 파일을 같이 보세요.
🧭 AI 지출 전체 그림
로컬로 돌리는 건 1단계(무료)에 해당합니다. 그다음 단계별로 새는 곳을 일곱 단계로 묶어뒀습니다 → AI에 쓰는 돈 총정리 — 숨은 비용 7가지
🔗 받기 전에 같이 볼 글
- Muse Glimmer 30B 소개와 실행 방법 — 뭘 하는 모델인지부터
- 30B 모델은 30GB가 아닙니다 — 이 글에서 쓴 재는 법
- Qwen3.8은 Apache가 아니었습니다 — 라이선스를 직접 열어야 하는 이유
- Muse Spark 1.2 가중치 추적 — 10회차 기록
- 순위표가 무엇을 세는지 — 어떤 모델을 받을지 고를 때
확인 시점 — 2026년 8월 14일. ✅ 1차 확인 : Hugging Face 모델 API로 meta-models/Muse-Glimmer-30B의 라이선스 필드·태그·파이프라인·생성일·파일 목록과 바이트 단위 크기 전부 · 같은 방식으로 GGUF 저장소의 양자화 변형 8개 크기 · LICENSE 파일 원문(무수정 표준 Apache 2.0, 추가 조항 없음) · USAGE_POLICY.md 원문(금지 용도 열거) · 모델 카드 본문(파라미터 약 29.6B, 컨텍스트 131,072 이상, 100개 이상 언어, 배포 목표 VRAM 24GB 또는 32GB, Spark에서 증류·"대체로 덜 유능" 서술) · 공식 계정 모델 목록 전수(4개, Spark 없음). 제가 계산한 것 : 59.55GB는 safetensors 두 조각의 바이트 합을 십진 환산한 값입니다. 이진(GiB)으로 보면 약 55.5로 표시됩니다. 📰 보도 : "20GB 미만" 표현의 출처 확인용으로만 참조했고, 제 의심이 틀렸음을 확인하는 데 쓰였습니다(본문 ①). 확인하지 않은 것 : 실제 내려받아 실행 · 16GB 카드에서의 동작 여부 · 양자화별 품질 차이 · 사용 정책의 법적 효력과 Apache 2.0과의 우선순위(문서에 관계 서술이 없었고, 이는 제 판단 영역이 아닙니다) · Spark 1.2 공개 일정(날짜에 해당하는 표현을 못 찾았습니다). 일반화 금지 : 파일 크기와 권장 사양은 이 모델·이 시점 기준입니다. 저장소는 수시로 갱신됩니다. 제휴·협찬 없습니다.
'AI & Vibe Coding' 카테고리의 다른 글
| 한 달 전 무료 AI 글을 다시 열어봤습니다 — 하나는 서비스가 통째로 없어졌습니다 (0) | 2026.08.14 |
|---|---|
| DeepSeek 요금 12배는 캐싱 쓰던 사람 얘기입니다 — 한국 업무시간은 전부 피크고요 (0) | 2026.08.14 |
| Gemini 3.7 Flash가 전작의 절반 값이라는데 — 공식 가격표에선 둘이 같은 값이었습니다 (0) | 2026.08.14 |
| AI와 나눈 대화는 30일 뒤 지워집니다 — 그런데 내가 친 프롬프트는 안 지워집니다 (0) | 2026.08.14 |
| 내가 한 글자도 치기 전에 8,520 토큰 — 컨텍스트의 92퍼센트는 화면에 안 보입니다 (0) | 2026.08.14 |
