| 일 | 월 | 화 | 수 | 목 | 금 | 토 |
|---|---|---|---|---|---|---|
| 1 | 2 | 3 | 4 | 5 | ||
| 6 | 7 | 8 | 9 | 10 | 11 | 12 |
| 13 | 14 | 15 | 16 | 17 | 18 | 19 |
| 20 | 21 | 22 | 23 | 24 | 25 | 26 |
| 27 | 28 | 29 | 30 |
- ai에이전트
- Gemini
- Android
- claude code
- OpenAI
- 클로드코드
- LLM
- AI 에이전트 개발
- Android Studio
- ai 뉴스
- Claude
- 오픈모델
- 무료 LLM
- AI 코딩
- 개발환경
- 홍드로이드
- 안드로이드 스튜디오
- 자동화
- 클로드 API
- 안드로이드
- 개발자 도구
- MCP
- AI 에이전트
- 무료로 시작하기
- claudecode
- 카드 없이
- 무료 ai
- 실무
- 바이브코딩
- 개발 생산성
- Today
- Total
홍드로이드의 야매코딩
Cloudflare 무료 AI 한도, 모델 따라 26배 본문

무료로 AI를 굴려볼 곳을 찾다 보면 잘 안 알려진 자리가 하나 있습니다. 클라우드플레어가 무료 플랜 안에 AI 추론을 끼워서 주는데, 문제는 한도 단위가 토큰도 요청 수도 아니라는 점입니다. "하루 10,000개"라고 적혀 있는데 그 10,000개가 뉴런이라는 처음 보는 단위입니다. 그래서 공식 단가표를 열어 모델별로 하루 분량을 직접 계산해봤습니다. 결과가 재밌습니다 — 같은 10,000개인데 어떤 모델을 고르느냐에 따라 실제 쓸 수 있는 분량이 26배 벌어집니다.
📌 30초 요약
- 무료 플랜에 하루 10,000 뉴런이 포함됩니다. 별도 신청이 아니라 무료 계정에 그냥 딸려 옵니다.
- 같은 10,000으로 가장 싼 모델은 약 58만 토큰, 가장 비싼 모델은 약 2만 3천 토큰. 26배 차이입니다.
- 돈으로 환산하면 하루 약 150원어치입니다. 크지 않습니다 — 그래서 모델 선택이 더 중요해집니다.
- 무료 목록에 있는데 결제수단 없이는 못 쓰는 모델이 다섯 개 있습니다. 문서에 따로 적어놨습니다.
- 한도 리셋은 한국 시간 오전 9시입니다. 자정이 아닙니다.
- 한도를 넘기면 429 오류에 전용 코드가 붙어 옵니다. 고장이 아니라 한도 신호로 구분할 수 있습니다.
단위가 뉴런이라 감이 안 옵니다
무료 한도를 비교하기 어려운 이유는 업체마다 세는 단위가 다르기 때문입니다. 어디는 요청 수, 어디는 토큰, 어디는 크레딧으로 셉니다. 전에 무료 AI 다섯 곳의 한도를 한 표에 못 넣은 적이 있는데, 이번 건 거기서 한 걸음 더 나갑니다. 단위 이름이 아예 뉴런입니다.
🧮 뉴런이 뭔가
문서 설명을 옮기면 여러 모델에 걸친 AI 출력을 재는 방식이고, 요청을 처리하는 데 필요한 GPU 연산량을 나타냅니다. 쉽게 말해 "이 모델이 이만큼 답하는 데 든 계산 비용"을 하나의 숫자로 통일한 겁니다. 가격은 1,000 뉴런당 0.011달러로 고정되어 있고, 모델마다 100만 토큰을 처리할 때 몇 뉴런이 드는지가 표로 공개돼 있습니다. 즉 단가표만 있으면 "내 하루치가 몇 글자인지" 역산할 수 있습니다. 그래서 계산해봤습니다.
같은 10,000으로 26배가 갈립니다
공식 단가표의 출력 토큰 뉴런 값으로 하루 10,000 뉴런을 전부 출력에 쓴다고 가정하고 나눴습니다. 입력도 뉴런을 먹으니 실제로는 이보다 적게 나옵니다 — 이건 상한선입니다.
| 모델 | 출력 100만 토큰당 | 하루 출력 상한 |
|---|---|---|
| Mistral 7B | 17,300 | 약 578,000 토큰 |
| Llama 3.2 1B | 18,252 | 약 548,000 토큰 |
| gpt-oss 20B | 27,273 | 약 367,000 토큰 |
| Llama 3.1 8B | 34,868 | 약 287,000 토큰 |
| Gemma 3 12B | 50,560 | 약 198,000 토큰 |
| gpt-oss 120B | 68,182 | 약 147,000 토큰 |
| Llama 3.3 70B | 204,805 | 약 49,000 토큰 |
| DeepSeek R1 distill 32B | 443,756 | 약 23,000 토큰 |
같은 한도, 다른 분량
맨 위와 맨 아래가 약 26배 차이입니다. 578,000 대 23,000. "하루 10,000개 무료"라는 한 줄만 보고는 이 격차를 짐작할 방법이 없습니다.
체감으로 옮기면 — 위쪽 모델은 긴 글 수십 편을 뽑을 수 있고, 아래쪽은 한 편 남짓입니다. 추론 특화 모델은 답 하나에 생각을 길게 쓰기 때문에 특히 빨리 닳습니다.
돈으로 바꾸면 하루 150원어치
과대평가하지 않기 위해 짚습니다. 1,000 뉴런에 0.011달러니까 하루치 10,000 뉴런은 0.11달러, 대략 150원입니다. 한 달 내내 다 써도 4,500원 안팎이죠. "무료로 서비스를 굴린다"는 규모는 아닙니다.
그래서 쓸모의 자리가 명확합니다. 개인 프로젝트 개발 중의 시험 호출, 프롬프트 다듬기, 자동화 스크립트의 가벼운 분류 작업 — 이런 데는 하루 150원어치가 꽤 넉넉합니다. 특히 위 표 상단의 작은 모델이라면요. 반대로 사용자에게 노출되는 서비스를 여기 얹으면 금방 넘깁니다. 다른 곳의 무료 티어와 성격을 비교해두신 게 있다면 무료 LLM API 정리와 나란히 놓고 보시면 자리가 잡힙니다.
목록에 있는데 못 쓰는 모델 다섯 개
단가표를 훑다 보면 요즘 화제인 모델 이름들이 눈에 들어옵니다. 그런데 표 아래에 작은 주석이 하나 붙어 있습니다.
⚠️ 일부 모델은 결제수단이 있어야 합니다
문서가 다섯 개를 이름까지 찍어 예외로 지정해뒀습니다 — Kimi 계열 둘, GLM 하나, DeepSeek 계열 둘입니다. 이 모델들은 무료 하루치로는 손댈 수 없고, 유료 플랜에 올라가거나 선불 크레딧을 미리 넣어야 열립니다. 목록과 단가표에는 다른 모델과 똑같이 실려 있어서 표만 보고 계획을 세우면 어긋납니다. 뒤집어 보면 "목록에 있다"와 "무료로 쓸 수 있다"가 다르다는, 무료 티어에서 계속 반복되는 그 구조입니다.
리셋은 자정이 아니라 오전 9시
사소해 보이지만 실제로 걸리는 부분입니다. 문서는 모든 한도가 매일 00:00 UTC에 초기화된다고 적어놨습니다. 한국은 UTC보다 9시간 빠르니, 우리 시계로는 오전 9시입니다.
그래서 밤늦게 작업하다 한도가 찼다면 자정을 기다려도 안 열립니다. 아침 9시까지 기다려야 합니다. 반대로 활용하면 — 오전에 몰아서 돌리는 습관이 하루를 가장 길게 쓰는 방법입니다. 그리고 한도를 넘겼을 때는 429 응답에 전용 코드가 함께 옵니다. 문서에 그 코드와 설명이 명시돼 있어서, 서버 장애인지 내 한도가 찬 건지를 헷갈리지 않고 구분할 수 있습니다.
# 한도를 넘겼을 때 돌아오는 응답
HTTP 429
"code": 3036
→ 하루 무료 10,000 뉴런을 다 썼다는 뜻
# 확인할 것 세 가지
1. 지금 쓰는 모델의 출력 단가 (위 표에서 확인)
2. 대시보드의 뉴런 사용량 그래프
3. 다음 리셋까지 남은 시간 (한국 시간 오전 9시)
이 계산이 정확하지 않은 이유
위 표는 상한선이지 실제 쓰게 될 양이 아닙니다. 어긋나는 지점을 미리 적어둡니다.
| 줄어드는 이유 | 설명 |
|---|---|
| 입력도 먹습니다 | 단가표에 입력 토큰 뉴런 값이 따로 있습니다. 대화가 길어질수록 앞부분을 매번 다시 넣게 되니 여기서 빠집니다. |
| 한국어는 불리합니다 | 같은 내용이라도 한국어가 영어보다 토큰을 더 씁니다. 위 숫자를 글자 수로 그대로 옮기면 안 됩니다. |
| 단위가 바뀌는 중입니다 | 문서가 모델별 단위 기반 가격으로 옮겨가는 중이라고 밝혀뒀습니다. 뉴런 표기가 언제까지 유지될지는 미지수입니다. |
자주 묻는 질문
Q. 카드를 넣어야 하나요?
문서상으로는 무료 플랜에 그냥 포함됩니다. 별도 신청이나 대기열도 없습니다. 다만 앞서 말한 다섯 개 모델은 예외고, 저는 실제로 가입 절차를 밟아보지 않았습니다 — 가입 화면에서 결제수단을 물어보는지까지는 확인하지 못했습니다. 카드 없이 되는 곳을 모아둔 목록은 카드 없이 무료로 쓰는 AI 모델 15개에 있습니다.
Q. 챗봇처럼 그냥 쓸 수 있나요?
이건 채팅 서비스가 아니라 개발자용 추론 API입니다. 코드에서 호출하는 용도라, 브라우저에서 바로 대화하려는 목적이라면 다른 선택지가 낫습니다. 일반 사용자용 무료 플랜을 비교한 건 ChatGPT·Claude·Gemini 무료 비교 쪽입니다.
Q. 어떤 모델부터 써보면 되나요?
표 위쪽부터입니다. 하루치를 가장 길게 쓰는 건 작은 모델이고, 분류·요약·태깅 같은 가벼운 작업이면 성능 차이도 크게 안 납니다. 큰 모델은 정말 필요한 요청에만 쓰는 식으로 나누면 하루가 훨씬 길어집니다. 추론 특화 모델은 마지막에 고려하세요 — 답 하나에 뉴런을 가장 많이 씁니다.
🧭 정직하게 덧붙이면
①저는 계정을 만들어 실제로 호출해보지 않았습니다. 이 글의 숫자는 전부 공식 문서의 단가표를 제가 나눈 계산입니다. ②하루 분량은 출력만 썼다고 가정한 상한이라 실사용은 반드시 더 적습니다. ③단가와 모델 목록은 자주 바뀝니다. 문서 스스로 가격 체계를 옮기는 중이라고 밝혀뒀습니다. ④환율은 1달러 1,400원 안팎으로 어림한 값이라 정확한 금액이 아닙니다. ⑤모델 성능은 다루지 않았습니다 — 뉴런이 적게 든다고 결과가 좋다는 뜻은 아닙니다.
무료 티어와 요금 구조를 항목별로 뜯어본 글들은 AI 지출 정리 허브에 모아두고 있습니다. 이번 건은 "한도 숫자만으로는 아무것도 알 수 없다"는 항목에 한 줄을 더 보탠 셈입니다.
출처: Cloudflare 공식 개발자 문서 Workers AI 섹션 전문(2026-08-19 직접 열람, 492,725바이트). 인용 항목 = 무료 할당량·뉴런 정의·모델별 뉴런 단가표·결제수단 필수 모델 목록·한도 초기화 시각·초과 시 오류 코드. 하루 분량 수치는 필자가 단가표를 나눈 계산 결과이며 실측이 아닙니다. 단가·모델 구성은 수시로 변경됩니다.
'AI & Vibe Coding' 카테고리의 다른 글
| OpenAI 훈련 중단, 30분 안에 못 밝히면 멈춥니다 (0) | 2026.08.19 |
|---|---|
| Codex 5년 작업 2주, 원문에만 있는 단서 넷 (0) | 2026.08.19 |
| 국산 AI 모델 성능 비교, 아무도 서로를 안 넣었습니다 (0) | 2026.08.19 |
| 국산 AI 오픈모델 라이선스, K 한 글자로 갈립니다 (0) | 2026.08.19 |
| Claude API 거절 응답 요금 — 청구는 0인데 한도는 그대로 깎이고, 오류 대시보드에는 안 잡힙니다 (0) | 2026.08.19 |
