Notice
Recent Posts
Recent Comments
Link
| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | ||||||
| 2 | 3 | 4 | 5 | 6 | 7 | 8 |
| 9 | 10 | 11 | 12 | 13 | 14 | 15 |
| 16 | 17 | 18 | 19 | 20 | 21 | 22 |
| 23 | 24 | 25 | 26 | 27 | 28 | 29 |
| 30 | 31 |
Tags
- 홍드로이드
- ChatGPT
- 실무
- Android
- Android Studio
- 무료 LLM
- AI 에이전트
- 앤트로픽
- Anthropic
- LLM
- 무료 ai
- Claude
- 카드 없이
- codex
- cursor
- 오픈모델
- MCP
- 안드로이드 스튜디오
- ai 뉴스
- 개발자
- 안드로이드
- AI 코딩
- GPT-5.6
- ai코딩
- OpenAI
- 오픈웨이트
- 바이브코딩
- 로컬 llm
- claude code
- Gemini
Archives
- Today
- Total
홍드로이드의 야매코딩
내 PC로 어떤 무료 AI가 돌아가나 — 흔히 쓰는 확인 명령어가 틀립니다 본문

💻 내 PC 확인
그 명령어,
4GB에서 잘립니다
4GB에서 잘립니다
12GB 카드도 4GB로 나옵니다.
무료 AI 모델을 내 컴퓨터에서 돌려보려면 VRAM이 얼마인지부터 알아야 합니다. 검색하면 명령어가 하나 나오는데, 여기저기 그대로 복사돼 있어요. 그런데 그 명령어는 4GB가 넘는 그래픽카드에서 틀린 값을 줍니다. 8GB든 12GB든 24GB든 4GB 언저리로 찍힙니다. 그 숫자를 믿고 "우리 컴퓨터는 안 되겠네" 하고 접은 분도 계실 겁니다. 제대로 확인하는 법과, 나온 숫자로 뭘 돌릴 수 있는지 판단하는 기준을 정리했습니다.
📌 30초 요약
⚠️ 널리 쓰이는 확인 명령어는 4GB에서 값이 잘립니다 — 규격상 한계
✅ 아래에 정확한 명령어를 뒀습니다. 복사해서 붙여넣기만
🧮 어림셈은 필요 VRAM ≈ 파라미터(B) × 0.6(4비트 기준)
🐢 모자라면 안 돌아가는 게 아니라 느려집니다 — 얼마나 느린지가 관건
🖱️ 명령어가 부담되면 작업 관리자로도 됩니다
✅ 아래에 정확한 명령어를 뒀습니다. 복사해서 붙여넣기만
🧮 어림셈은 필요 VRAM ≈ 파라미터(B) × 0.6(4비트 기준)
🐢 모자라면 안 돌아가는 게 아니라 느려집니다 — 얼마나 느린지가 관건
🖱️ 명령어가 부담되면 작업 관리자로도 됩니다
★ 왜 4GB로 나오나
🚫 이 명령어가 그 문제의 것입니다
Get-CimInstance Win32_VideoController 의 AdapterRAM 값
이 항목은 32비트 정수로 정의돼 있습니다. 32비트로 표현할 수 있는 최대치가 약 4.29GB예요. 그래서 그보다 큰 카드는 그 언저리에서 잘린 값이 나옵니다.
버그라기보다 오래전에 정해진 규격의 한계입니다. 카드가 4GB를 넘을 거라고 예상하지 못하던 시절에 만들어졌거든요. 그런데 그 명령어가 여전히 여기저기 복사돼 돌아다닙니다.
이 항목은 32비트 정수로 정의돼 있습니다. 32비트로 표현할 수 있는 최대치가 약 4.29GB예요. 그래서 그보다 큰 카드는 그 언저리에서 잘린 값이 나옵니다.
버그라기보다 오래전에 정해진 규격의 한계입니다. 카드가 4GB를 넘을 거라고 예상하지 못하던 시절에 만들어졌거든요. 그런데 그 명령어가 여전히 여기저기 복사돼 돌아다닙니다.
🔍 내가 그 값을 봤는지 확인하는 법
결과가 4GB 근처의 어중간한 숫자(4.0GB, 4,294,967,295바이트 등)로 나왔다면 의심하세요.
카드 이름은 정확히 나옵니다. 그러니 모델명을 검색해 원래 VRAM이 몇 GB인지 보고, 그 값과 다르면 잘린 것입니다. 4GB 이하 카드라면 값이 맞을 수도 있고요.
카드 이름은 정확히 나옵니다. 그러니 모델명을 검색해 원래 VRAM이 몇 GB인지 보고, 그 값과 다르면 잘린 것입니다. 4GB 이하 카드라면 값이 맞을 수도 있고요.
★ 제대로 확인하는 법
가장 쉬운 방법부터 — 명령어가 부담스러우면 이것만 보셔도 됩니다.
🖱️ 방법 0 — 작업 관리자 (윈도우)
Ctrl+Shift+Esc → 성능 탭 → 왼쪽에서 GPU 선택 → 오른쪽 아래 "전용 GPU 메모리".
이 값이 우리가 찾는 숫자입니다. 여기는 안 잘립니다. 같은 화면에서 메모리 탭을 누르면 시스템 RAM도 보이고요.
이 값이 우리가 찾는 숫자입니다. 여기는 안 잘립니다. 같은 화면에서 메모리 탭을 누르면 시스템 RAM도 보이고요.
# 윈도우 PowerShell — 전용 GPU 메모리(VRAM). 4GB 넘어도 정확합니다
Get-ItemProperty 'HKLM:\SYSTEM\CurrentControlSet\Control\Class\{4d36e968-e325-11ce-bfc1-08002be10318}\0*' |
Where-Object { $_.'HardwareInformation.qwMemorySize' } |
ForEach-Object {
'{0} : {1} GB' -f $_.DriverDesc,
[math]::Round($_.'HardwareInformation.qwMemorySize'/1GB, 1)
}
# 시스템 RAM (윈도우)
'RAM: {0} GB' -f [math]::Round((Get-CimInstance Win32_ComputerSystem).TotalPhysicalMemory/1GB, 1)
# 맥 — 애플 실리콘은 통합 메모리라 RAM = 사실상 VRAM
sysctl -n hw.memsize | awk '{print $1/1024/1024/1024, "GB"}'
⚠️ 위 명령어에 대해 밝혀둘 것
레지스트리를 읽기만 합니다. 아무것도 바꾸지 않아요. 그래도 낯설면 방법 0(작업 관리자)을 쓰시면 됩니다 — 결과는 같습니다.
환경에 따라 값이 안 나올 수 있습니다. 드라이버가 해당 항목을 안 적어두거나, 내장 그래픽만 있거나, 카드가 여러 장이면 목록이 여러 줄로 나옵니다. 안 나오면 작업 관리자로 확인하세요 — 그게 가장 확실합니다.
환경에 따라 값이 안 나올 수 있습니다. 드라이버가 해당 항목을 안 적어두거나, 내장 그래픽만 있거나, 카드가 여러 장이면 목록이 여러 줄로 나옵니다. 안 나오면 작업 관리자로 확인하세요 — 그게 가장 확실합니다.
숫자가 나왔으면 — 이렇게 판단합니다
🧮 어림셈 한 줄
필요한 VRAM(GB) ≈ 파라미터 수(B) × 0.6 (4비트 양자화 기준)
· 8B 모델 → 약 5GB
· 14B 모델 → 약 8GB
· 30B 모델 → 약 18GB
여기에 대화가 길어지면 조금 더 듭니다. 그래서 계산값보다 2GB쯤 여유가 있어야 편합니다. 자세한 근거와 예산별 구성은 PC 사양 글에 정리해 뒀습니다.
· 8B 모델 → 약 5GB
· 14B 모델 → 약 8GB
· 30B 모델 → 약 18GB
여기에 대화가 길어지면 조금 더 듭니다. 그래서 계산값보다 2GB쯤 여유가 있어야 편합니다. 자세한 근거와 예산별 구성은 PC 사양 글에 정리해 뒀습니다.
| 내 VRAM | 편하게 되는 것 |
|---|---|
| 내장 그래픽만 | 아주 작은 모델(1~4B)이 느리게. 실용은 어렵습니다 |
| 6~8GB | 8B급까지. 요약·분류·간단한 코드는 충분합니다 |
| 12~16GB | 14B급이 쾌적. 여기부터 "쓸 만하다"는 소리가 나옵니다 |
| 24GB 이상 | 30B급까지. 최근 나온 30B 모델들이 이 구간입니다 |
🍎 맥은 계산이 다릅니다
애플 실리콘은 메모리를 CPU와 GPU가 나눠 씁니다. 그래서 RAM 용량이 곧 쓸 수 있는 크기에 가깝습니다 — 16GB 맥이 8GB 그래픽카드보다 큰 모델을 돌리기도 해요.
다만 전부를 모델에 쓸 수는 없습니다. 시스템이 쓰는 몫이 있으니 RAM의 60~70% 정도를 상한으로 잡으시면 대체로 맞습니다.
다만 전부를 모델에 쓸 수는 없습니다. 시스템이 쓰는 몫이 있으니 RAM의 60~70% 정도를 상한으로 잡으시면 대체로 맞습니다.
모자라면 안 돌아가나요 — 아니요, 느려집니다
🐢 부족할 때 벌어지는 일
모델이 VRAM에 다 안 들어가면 나머지를 시스템 RAM에 두고 오가며 돌립니다. 실행은 됩니다. 대신 체감이 확 달라집니다.
· 다 들어갈 때 — 답이 줄줄 흘러나옵니다
· 조금 넘칠 때 — 답이 뚝뚝 끊겨 나옵니다
· 많이 넘칠 때 — 한 문장 기다리다 지칩니다
그래서 "되나 안 되나"가 아니라 "기다릴 만한가"가 진짜 질문입니다. 그리고 이건 직접 돌려봐야 압니다 — 사양표로는 몰라요.
· 다 들어갈 때 — 답이 줄줄 흘러나옵니다
· 조금 넘칠 때 — 답이 뚝뚝 끊겨 나옵니다
· 많이 넘칠 때 — 한 문장 기다리다 지칩니다
그래서 "되나 안 되나"가 아니라 "기다릴 만한가"가 진짜 질문입니다. 그리고 이건 직접 돌려봐야 압니다 — 사양표로는 몰라요.
💡 모자랄 때 먼저 해볼 것
① 더 작은 모델로 내려가기 — 14B가 버벅이면 8B로. 요약·분류라면 차이를 잘 못 느낍니다
② 더 센 양자화 쓰기 — 같은 모델의 더 작은 파일. 품질이 조금 깎이는 대신 들어갑니다
③ 그래도 안 되면 클라우드 — 지금 무료인 모델을 조회하는 법이 따로 있습니다. 로컬만 답은 아니에요
② 더 센 양자화 쓰기 — 같은 모델의 더 작은 파일. 품질이 조금 깎이는 대신 들어갑니다
③ 그래도 안 되면 클라우드 — 지금 무료인 모델을 조회하는 법이 따로 있습니다. 로컬만 답은 아니에요
자주 보는 오해 세 가지
"RAM이 32GB니까 되겠지"
윈도우·리눅스에서 중요한 건 그래픽카드 메모리입니다. RAM은 넘칠 때 받아주는 역할이에요. RAM만 크고 VRAM이 작으면 느립니다. 맥은 반대로 RAM이 기준이고요.
"게임용 그래픽카드면 다 되겠지"
게임 성능과 여기서 필요한 건 기준이 다릅니다. 게임은 처리 속도가 중요하고, 여기는 일단 모델이 들어가느냐가 먼저예요. 비싼 카드보다 VRAM 큰 카드가 유리한 경우가 많습니다.
"로컬이니까 마음대로 써도 되겠지"
내 컴퓨터에서 돌린다고 라이선스가 사라지지 않습니다. 상업적으로 쓰실 거면 모델 라이선스를 먼저 보세요 — 지역 제한이 붙은 사례도 실제로 있습니다.
자주 묻는 질문
Q. 확인해보니 사양이 부족한데, 그래도 로컬을 해야 하나요?
대부분은 안 하셔도 됩니다. 로컬이 확실히 나은 경우는 셋뿐이에요 — 인터넷이 안 되는 환경, 밖으로 못 내보내는 자료, 같은 작업을 대량 반복. 여기 해당 안 되면 그래픽카드 값이 구독료 몇 년 치입니다. 사기 전에 계산해보세요.
Q. 여기 나온 등급표를 믿어도 되나요?
대략의 감을 잡는 용도로만 쓰세요. 실제로는 모델마다 구조가 달라서 같은 파라미터 수여도 필요량이 다릅니다. 확실한 건 배포처가 적어둔 권장 사양이고, 그보다 확실한 건 한 번 돌려보는 것입니다. 어차피 무료라 손해가 없어요.
Q. 그 잘리는 명령어를 쓴 글이 많던데요?
대부분 악의는 없습니다. 오래된 예제가 복사되며 퍼진 것이고, 4GB 이하 카드에서는 값이 맞으니 쓴 사람은 문제를 못 느꼈을 수 있어요.
그래서 이 글의 요지는 "그 글이 틀렸다"가 아니라 "숫자가 이상하면 다른 방법으로 확인해보라"입니다. 카드 이름을 검색해보면 30초면 판명됩니다.
그래서 이 글의 요지는 "그 글이 틀렸다"가 아니라 "숫자가 이상하면 다른 방법으로 확인해보라"입니다. 카드 이름을 검색해보면 30초면 판명됩니다.
✨ 정리하면
4GB로 나왔다면 의심하세요. 카드 이름을 검색해보면 압니다.
확실한 건 작업 관리자 → 성능 → GPU → 전용 GPU 메모리.
그리고 파라미터 × 0.6 — 이 한 줄이면 대략 판단이 섭니다.
확실한 건 작업 관리자 → 성능 → GPU → 전용 GPU 메모리.
그리고 파라미터 × 0.6 — 이 한 줄이면 대략 판단이 섭니다.
📎 같이 읽으면 좋은 글
출처와 한계 · 2026년 8월 기준입니다. WMI의
Win32_VideoController 클래스에서 AdapterRAM이 32비트 부호 없는 정수로 정의되어 약 4.29GB를 넘는 값을 표현하지 못한다는 점, 그리고 드라이버 레지스트리의 HardwareInformation.qwMemorySize가 64비트 값을 담는다는 점은 널리 알려진 사항으로 복수의 기술 자료에서 확인했습니다. 다만 본문의 명령어는 모든 환경에서 동작을 보장하지 않습니다 — 드라이버가 해당 값을 기록하지 않거나, 내장 그래픽만 있거나, 어댑터가 여러 개인 경우 결과가 다르게 나올 수 있으므로 작업 관리자 값과 대조하시기 바랍니다. 명령어는 레지스트리를 읽기만 하며 설정을 변경하지 않습니다. VRAM 어림셈(파라미터 × 0.6)과 등급표는 대략의 기준이며, 모델 구조·양자화 방식·문맥 길이에 따라 실제 필요량은 달라집니다. 정확한 요구 사양은 각 모델 배포처의 안내를 확인하세요. 로컬 실행이라도 모델 라이선스는 그대로 적용되므로, 상업적 이용 전에 해당 라이선스를 직접 확인하시기 바랍니다. 이 블로그는 언급된 어떤 서비스·제조사와도 제휴 관계가 없습니다.'AI & Vibe Coding' 카테고리의 다른 글
| AI 구독 첫 결제 전에 — 해지·환불 규정을 공식 문서 원문으로 확인했습니다 (1) | 2026.08.11 |
|---|---|
| AI 도구 계약, 서명 전에 볼 6개 조항 — 공식 약관 원문에서 확인했습니다 (0) | 2026.08.11 |
| 사내 AI 규정이 안 지켜지는 이유 — 규율이 아니라 설계 문제입니다 (0) | 2026.08.11 |
| AI 성과 보고에서 '몇 % 빨라졌다'가 안 먹히는 이유 (0) | 2026.08.11 |
| AI 예산은 왜 늘 빗나가나 — 편성 전에 모아둘 숫자 4가지 (1) | 2026.08.11 |
Comments
