| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | ||||||
| 2 | 3 | 4 | 5 | 6 | 7 | 8 |
| 9 | 10 | 11 | 12 | 13 | 14 | 15 |
| 16 | 17 | 18 | 19 | 20 | 21 | 22 |
| 23 | 24 | 25 | 26 | 27 | 28 | 29 |
| 30 | 31 |
- MCP
- Gemini
- 안드로이드 스튜디오
- 실무
- cursor
- 오픈웨이트
- ChatGPT
- 무료 ai
- ai코딩
- 앤트로픽
- AI 코딩
- 오픈모델
- codex
- Claude
- claude code
- Anthropic
- 카드 없이
- 안드로이드
- AI 에이전트
- 바이브코딩
- ai 뉴스
- Android Studio
- 홍드로이드
- 개발자
- GPT-5.6
- 무료 LLM
- Android
- LLM
- OpenAI
- 로컬 llm
- Today
- Total
홍드로이드의 야매코딩
30B 모델은 30GB가 아닙니다 — 받기 전에 재보는 법 본문

무료 로컬 AI · 용량
같은 30B 모델이
15GB이기도, 55GB이기도.
이름에 붙은 숫자로는 용량을 알 수 없습니다. 저장소에 표시된 용량도 실제로 받는 양이 아니었습니다. 일곱 개를 직접 재보고 규칙을 찾았습니다.
내 PC 사양을 확인했고 무료 모델 목록도 뽑았습니다. 그런데 막상 받으려니 "이게 내 컴퓨터에 들어가나"가 안 잡힙니다. 이름은 30B인데 어디는 55기가, 어디는 15기가라고 나오니까요. 그래서 직접 재봤습니다.
📌 30초 요약
- 이름의 숫자부터 실제와 다릅니다. 0.6B가 0.78B, 1.7B가 2.04B였습니다.
- 기본 형식은 파라미터 하나당 2바이트. 30B면 약 55GB입니다.
- 양자화본은 파라미터당 0.5바이트쯤. 같은 30B가 15.6GB가 됩니다.
- ⚠️ 저장소에 뜬 총 용량은 받을 용량이 아닙니다. 5.9배까지 차이 났습니다.
- ⚠️ 유명 모델 중에 승인을 받아야 받을 수 있는 것이 섞여 있습니다.
① 일곱 개를 재봤습니다
허깅페이스가 모델 정보를 API로 열어두고 있습니다. 로그인도 키도 필요 없습니다. 거기서 실제 파라미터 수와 파일별 크기를 받아 정리했습니다.
| 모델 | 이름 | 실제 파라미터 | 받을 용량 | 저장소 총량 |
|---|---|---|---|---|
Qwen3-ASR-0.6B-hf |
0.6B | 0.78B | 1.47 | 1.47 |
Qwen3-ASR-1.7B-hf |
1.7B | 2.04B | 3.81 | 3.81 |
gemma-3-4b-it |
4b | 4.30B | 8.01 | 47.04 |
Llama-3-8B-Instruct |
8B | 8.03B | 14.96 | 57.9 |
Muse-Glimmer-30B |
30B | 29.78B | 55.5 | 55.5 |
Muse-Glimmer-30B-GGUF |
30B | 표기 없음 | 15.61 | 73.47 |
Qwen3.8-2.4T-A95B |
2.4T | 2,446B | 4,556 | 4,556 |
단위 GiB · 2026년 8월 13일 밤 조회
② 규칙은 단순합니다 — 파라미터 곱하기 바이트
위 표에서 규칙이 하나 나옵니다. 용량은 파라미터 수에 형식별 바이트 수를 곱한 값입니다.
# 실측으로 확인된 비율
기본 형식(BF16) 파라미터당 2.00 바이트
4비트 양자화 파라미터당 0.5 바이트쯤
# 검산
29.78B x 2.00 = 59.6 GB → 실측 55.5 GiB ✓
8.03B x 2.00 = 16.1 GB → 실측 14.96 GiB ✓
29.78B x 0.5 = 14.9 GB → 실측 15.61 GiB ✓
세 건 다 맞았습니다. 그러니 "30B니까 30GB"는 틀린 계산입니다. 기본 형식이면 그 두 배쯤이고, 양자화본이면 절반의 절반쯤입니다.
💡 그래서 이렇게 어림잡으세요
양자화본 기준으로 모델 크기(B) 나누기 2 = 대략 필요한 기가바이트입니다. 7B면 3~4GB, 14B면 7~8GB, 30B면 15GB 안팎.
여기에 실행 중 여유분이 더 듭니다. 파일 크기가 곧 메모리 소요량은 아니라서요 — 저는 실행 시 메모리는 재지 않았습니다. 그건 사양 확인 글 쪽입니다.
③ 여기가 함정입니다 — 표시된 용량이 받을 용량이 아닙니다
처음엔 "저장소 총 용량을 보면 되겠네" 했습니다. 그런데 표의 오른쪽 두 칸을 보세요. 안 맞는 게 세 개입니다.
🔍 왜 차이가 나는지 파일 목록을 열어봤습니다
GGUF 저장소 — 안에 양자화본이 여덟 개 들어 있었습니다. 15.61 짜리, 18.30 짜리, 부속 파일들… 전부 합치면 73.47이지만 실제로는 그중 하나만 받으면 됩니다.
Llama-3-8B — 같은 가중치가 두 가지 형식으로 들어 있었습니다. .safetensors 14.96 GiB와 original/ 폴더의 원본 14.96 GiB. 둘 중 하나만 받습니다.
gemma-3-4b-it — 실제 받을 파일은 8.01인데 저장소 총량은 47.04. 5.9배입니다.
⚠️ 여기는 제가 설명하지 못했습니다
Llama-3-8B의 경우 파일을 다 더해도 30 GiB쯤인데 저장소 총량은 57.9로 잡힙니다. 중복 형식으로는 절반만 설명됩니다. 나머지 차이가 왜 생기는지 저는 확인하지 못했습니다. 이전 버전 기록이 포함된 수치일 수 있다고 짐작만 할 뿐이고, 그건 제 추측이지 확인된 사실이 아닙니다. 확실한 건 하나입니다 — 표시된 총 용량을 그대로 믿으면 안 됩니다.
④ 승인이 필요한 모델이 섞여 있습니다
카드도 결제도 필요 없지만, 사람 손으로 승인을 받아야 하는 경우가 있습니다. 표의 일곱 개 중 둘이 그랬습니다.
| 모델 | 받기 조건 | 라이선스 |
|---|---|---|
gemma-3-4b-it |
수동 승인 필요 | gemma |
Llama-3-8B-Instruct |
수동 승인 필요 | llama3 |
Muse-Glimmer-30B 계열 |
바로 받기 | apache-2.0 |
Qwen3-ASR 계열 |
바로 받기 | apache-2.0 |
"무료"와 "바로 받을 수 있다"는 다른 이야기입니다. 승인이 걸린 쪽은 양식을 내고 기다려야 합니다. 급하게 오늘 밤에 돌려보려던 계획이라면 이걸 먼저 봐야 합니다. 라이선스도 갈립니다 — 오픈이라고 Apache는 아니라는 것은 따로 다뤘습니다.
⑤ 받기 전 30초 — 이렇게 확인하세요
브라우저만 있으면 됩니다. 주소창에 넣으면 바로 열립니다.
# 1) 파라미터 수와 승인 여부
huggingface.co/api/models/계정/모델이름
→ safetensors.total 이 실제 파라미터
→ gated 가 false 여야 바로 받습니다
# 2) 파일별 실제 크기 (이게 핵심)
huggingface.co/api/models/계정/모델이름/tree/main
→ 받을 파일 하나만 골라 그 size 를 봅니다
🧭 화면에서 하는 방법도 있습니다
모델 페이지의 Files and versions 탭을 열면 파일마다 크기가 적혀 있습니다. 거기서 실제로 받을 파일 하나의 숫자만 보세요. 페이지 어딘가에 적힌 총합이 아니라요.
GGUF 저장소라면 파일 이름에 Q4 Q5 같은 표시가 붙어 있습니다. 숫자가 작을수록 파일도 작습니다. 다만 품질 차이는 제가 비교하지 않았습니다.
🚫 이 글이 말하지 않는 것
성능은 한 줄도 없습니다. 일곱 개 중 하나도 돌려보지 않았습니다. 양자화하면 품질이 얼마나 떨어지는지도 저는 모릅니다. 이 글은 "용량이 얼마인가" 하나만 다룹니다.
그리고 파일 크기와 실행에 필요한 메모리는 다릅니다. 보통 파일보다 더 듭니다. 얼마나 더 드는지는 재보지 않았습니다. 여기 숫자는 디스크에 받는 양까지입니다.
자주 묻는 것
Q. 이름의 숫자가 왜 실제와 다른가요?
이유는 제가 확인하지 못했습니다. 다만 실측으로는 0.6B가 0.78B, 1.7B가 2.04B, 4b가 4.30B로 모두 이름보다 컸습니다. 반올림해서 붙이는 관행으로 보이지만 확인된 건 아니고, 어쨌든 여유를 두고 잡는 게 안전합니다.
Q. 2.4조 파라미터짜리는 개인이 못 쓰나요?
받는 파일만 4,556 GiB, 4.4테라입니다. 디스크에 들어가도 실행은 또 다른 문제고요. 개인 PC 이야기가 아닙니다. 무료로 공개됐다는 것과 내가 돌릴 수 있다는 건 별개입니다.
Q. 그냥 클릭해서 받으면 안 되나요?
받아도 됩니다. 다만 GGUF 저장소를 통째로 받는 도구를 쓰면 필요 없는 양자화본까지 다 내려받아 15기가면 될 걸 73기가 받게 됩니다. 파일 하나를 지정해서 받는 편이 낫습니다.
📌 보탬 (8월 14일) — 문서에 적힌 숫자도 서로 다를 수 있습니다
이 글은 표시된 용량을 믿지 말라고 했는데, 문제가 용량만은 아니었습니다. 다른 서비스를 보다가 같은 회사의 두 공식 문서가 서로 다른 숫자를 적어둔 걸 봤습니다 — 발표 페이지는 참조 이미지 최대 5장, 개발자 가이드는 최대 3장. 그리고 검색에 걸리는 사용법 글들은 기능 출시 이전에 쓰인 것이었고요 → Grok 이미지 부분 수정 — 검색되는 설명은 출시 전 글입니다
📌 보탬 (8월 14일) — 용량 다음은 "어느 순위를 보나"입니다
이 글은 표시된 숫자를 믿지 말라고 했습니다. 고를 때 보는 순위도 같았습니다 — 다운로드 상위 여덟 개에 글 생성 모델이 0개였고(문장 유사도·빈칸 채우기·시계열 예측 같은 부품들), 정렬을 화제순으로 바꾸면 여덟 개가 전부 생성 모델로 바뀝니다. 두 목록은 한 개도 겹치지 않습니다 → 다운로드 1위는 채팅용이 아닙니다
✨ 정리하면
이름의 숫자도, 저장소에 뜬 총 용량도 받을 양이 아닙니다. 실측에서 5.9배까지 벌어졌습니다.
어림잡을 땐 양자화본 기준 크기 나누기 2 기가바이트. 30B가 15기가쯤 됩니다.
받기 전에 파일 목록을 열고 실제 받을 파일 하나의 크기를 보세요. 그리고 승인이 걸려 있는지도요.
🔗 같이 보면 좋은 글
- 내 PC로 어떤 무료 AI가 돌아가나 — 사양 확인이 먼저
- 카드 없이 무료로 쓰는 AI 모델 15개 — 받지 않고 쓰는 쪽
- 오픈이라고 Apache는 아닙니다 — 받기 전 라이선스
- 같은 이름의 다른 가중치 — 슬래시 앞을 보세요
확인 시점 — 2026년 8월 13일 밤. ✅ 직접 측정 : 허깅페이스 공개 API를 키 없이 호출해 7개 저장소의 safetensors.total(실제 파라미터)·usedStorage(저장소 총량)·gated·라이선스를 수집하고, tree/main으로 파일별 크기를 개별 확인. 본문 ②의 바이트 비율과 검산은 그 측정값으로 제가 직접 계산한 것입니다. 확인하지 않은 것 : 모델 성능(하나도 실행하지 않음) · 양자화에 따른 품질 저하 · 실행 시 메모리 소요량 · 이름 표기와 실제 파라미터가 다른 이유 · Llama-3-8B의 저장소 총량이 파일 합보다 큰 나머지 이유(본문에 추측임을 명시). 용량·승인 조건·라이선스는 예고 없이 바뀝니다. 받기 전 해당 모델 페이지에서 직접 확인하세요. 제휴·협찬 없습니다.
'AI & Vibe Coding' 카테고리의 다른 글
| Grok 이미지가 부분 수정을 지원합니다 — 검색되는 설명은 대부분 출시 전 글입니다 (0) | 2026.08.14 |
|---|---|
| 배치로 절반 값에 씁니다 — 다만 지출 상한을 넘길 수 있습니다 (0) | 2026.08.13 |
| 프롬프트 캐싱은 조용히 실패합니다 — 에러도 안 납니다 (0) | 2026.08.13 |
| 결제 첫 달에 볼 것 — 사용량 화면의 숫자가 전부가 아닙니다 (0) | 2026.08.13 |
| AI로 만든 걸 납품할 때 — 클라이언트가 묻기 전에 약관이 먼저 요구합니다 (1) | 2026.08.13 |
