홍드로이드의 야매코딩

Gemini 3.7 Flash가 전작의 절반 값이라는데 — 공식 가격표에선 둘이 같은 값이었습니다 본문

AI & Vibe Coding

Gemini 3.7 Flash가 전작의 절반 값이라는데 — 공식 가격표에선 둘이 같은 값이었습니다

홍드로이드 2026. 8. 14. 14:11
반응형

Gemini 3.7 Flash · 가격표 대조

"전작의 절반 값"이라는데
가격표엔 같은 값이 적혀 있습니다.

공식 가격 문서를 열어보니 3.6 Flash와 3.7 Flash가 글자 그대로 동일했습니다. 절반이 되는 비교 대상은 "3.6 Flash의 출시 당시 가격"이었습니다.

2026년 8월 13일, 구글이 Gemini 3.7 Flash를 냈습니다. 전작이 나온 지 3주 만이고, 헤드라인은 대부분 "절반 값"이었습니다. 값이 반이 된다는 건 큰 얘기라 공식 가격 문서를 직접 열어봤습니다. 그랬더니 Grok 단가표를 봤을 때와 비슷한 종류의 어긋남이 세 군데 있었습니다.

📌 30초 요약

  • 성능은 제3자 실측으로도 올랐습니다 — 지능 지수 52 → 56, 순위 31위 → 17위.
  • 출력 속도는 초당 225 → 340으로 1.5배입니다. 여기가 진짜 차이입니다.
  • ⚠️ 그런데 공식 가격표에서 3.6 Flash와 3.7 Flash는 같은 값입니다. 오늘 기준 둘 다 0.75 / 3.75달러.
  • ⚠️ "절반"의 기준은 3.6 Flash가 출시되던 때의 가격입니다. 지금 두 모델을 비교한 게 아닙니다.
  • ⚠️ 둘 다 2027년 1월 1일에 정확히 두 배가 됩니다 — 1.50 / 7.50달러.
  • ⚠️ 캐시 저장 요금(시간당 과금)까지 두 배가 되는데 이건 어디에도 안 나옵니다.

① 먼저 좋은 소식 — 성능은 제3자도 인정합니다

가격 얘기를 하기 전에 성능부터 분리해서 봅니다. 발표문에 실린 벤치마크는 다섯 개인데 대부분 구글 자체 측정입니다. 그래서 독립 평가 기관이 같은 지수로 잰 값을 따로 가져왔습니다.

제3자 실측 3.6 Flash 3.7 Flash
지능 지수 52 56
순위(188개 중) 31위 17위
출력 속도 초당 225.1 초당 340.1

Artificial Analysis 자체 측정 · 양쪽 모두 high 설정 · 2026년 8월 14일 조회

같은 기관이 같은 지수로 잰 값이라 이건 유효한 비교입니다. 지능 지수가 4점 오르면서 순위가 14계단 뛰었고, 무엇보다 출력 속도가 1.5배입니다. 초당 340 토큰이면 앞서 본 Grok 4.6(초당 65.5)의 다섯 배가 넘습니다. 에이전트처럼 여러 번 왕복하는 작업에서는 속도가 곧 체감 성능입니다.

📄 발표문의 벤치마크 다섯 개 — 출처를 갈라서 봅니다

구글 자체 측정 : FrontierCode 1.1 Main 34.4 → 43.6 · DeepSWE v1.1 49.0 → 65.3 · GDP.pdf 22.0 → 34.0 · AutomationBench 17.0 → 30.4

제3자 플랫폼 : WebDev Arena Elo 1538 → 1588(외부 아레나 지표). → 다섯 개 중 넷은 만든 회사가 잰 것입니다. 틀렸다는 게 아니라 같은 조건에서 잰 것끼리만 비교하려고 위 표에는 안 넣었습니다.

② "절반 값"을 가격표와 대조했습니다

여기서부터가 이 글의 본론입니다. 공식 가격 문서에서 두 모델의 행을 각각 읽었습니다. 글자 그대로 옮깁니다.

📄 공식 가격 문서 — 두 행이 동일합니다

Gemini 3.6 Flash — 입력 "$0.75 through December 31, 2026. $1.50 starting January 1, 2027."

Gemini 3.7 Flash — 입력 "$0.75 through December 31, 2026. $1.50 starting January 1, 2027."

출력도 마찬가지로 양쪽 다 3.75 → 7.50달러입니다. 문장 부호까지 같습니다. 오늘 기준으로 두 모델의 값은 차이가 없습니다.

그러면 "절반"은 어디서 나온 걸까요. 발표문의 문장은 이렇습니다 — "3.7 Flash is available through the end of the year at an introductory price of $0.75/1M input tokens and $3.75/1M output tokens." 도입가라고만 되어 있고, 제가 받은 본문에는 "전작의 절반"이라는 비교 문장이 없었습니다. 그 비교는 보도 쪽 표현이었고, 기준은 3.6 Flash가 출시되던 시점의 가격입니다.

⚠️ 제가 확인한 범위를 정확히 적습니다

발표문 어딘가에 그 비교 문장이 있는데 제가 못 받았을 수 있습니다. 그래서 "발표문에 없다"가 아니라 "제가 받은 본문 범위에 없었다"로 씁니다. 확실한 건 가격표 두 행이 같다는 것이고, 이건 두 번 따로 조회해서 같은 결과를 얻었습니다.

③ 집계 사이트는 두 모델에 다른 시점을 적용하고 있습니다

그런데 집계 사이트에서는 정말로 절반으로 보입니다. 왜 그런지 세 주체를 나란히 놓으니 보였습니다.

어디서 본 값인가 3.6 Flash 3.7 Flash
공식 가격표 (오늘) 0.75 / 3.75 0.75 / 3.75
공식 가격표 (1월 1일부터) 1.50 / 7.50 1.50 / 7.50
독립 평가 사이트 (오늘 조회) 1.50 / 7.50 0.75 / 3.75

100만 토큰당 달러(입력 / 출력) · 세 값 모두 2026년 8월 14일 같은 날 조회

🔍 세 번째 줄이 문제입니다

같은 사이트가 3.6 Flash에는 1월 1일 이후의 정가를, 3.7 Flash에는 올해 말까지의 도입가를 적용하고 있습니다. 서로 다른 시점의 값을 한 화면에 나란히 놓은 겁니다. 나란히 있으니 절반으로 보이고, 그 화면을 근거로 모델을 고르면 있지도 않은 가격 차이를 보고 고르는 셈입니다.

이건 그 사이트를 탓할 일만은 아닙니다. 한 모델의 가격이 날짜에 따라 두 개인데 표의 칸은 하나니까요. 다만 순위표가 무엇을 세는지를 확인해야 했던 것처럼, 가격표도 "언제 기준인지"를 확인해야 합니다.

④ 아무도 안 짚는 것 — 캐시 저장 요금도 두 배입니다

가격표를 끝까지 읽다가 토큰 단가가 아닌 항목을 하나 봤습니다. 캐싱 글에서 다뤘던 그 캐시입니다.

항목 올해 말까지 1월 1일부터
입력 100만 토큰 0.75 1.50
출력 100만 토큰(사고 토큰 포함) 3.75 7.50
캐시된 입력 100만 토큰 0.075 0.15
캐시 저장료 (100만 토큰 · 시간당) 0.50 1.00

단위 달러 · 공식 가격 문서의 Gemini 3.7 Flash 행 전체

마지막 줄의 단위를 보세요 — "시간당"입니다. 앞의 셋은 토큰을 쓸 때 나가는 돈이고, 이건 가만히 두기만 해도 시간마다 나가는 돈입니다. 단가만 보고 단위를 안 보면 생기는 일을 다룬 적 있는데, 같은 함정이 여기 또 있습니다.

"사고 토큰 포함"이라는 괄호도 그냥 넘기면 안 됩니다. 이 모델은 발표문 표현대로 "더 부지런히 생각하고 다단계 계획과 도구 호출에 더 공을 들이는" 방향으로 만들어졌습니다. 성능에는 좋은 얘기인데, 그 생각한 만큼이 출력 요금으로 잡힙니다. 성능 개선과 요금 증가가 같은 원인에서 나옵니다.

참고로 이 모델에는 구간 요금이 없습니다. 프롬프트가 길어져도 단가가 안 바뀝니다. 같은 회사의 Pro 계열은 20만 토큰을 넘으면 단가가 오르는데(입력 2.00 → 4.00, 출력 12.00 → 18.00) Flash 계열은 단일가입니다. 앞서 확인했던 그대로가 이번 모델에도 유지됐습니다.

⑤ 그래서 지금 뭘 하면 되나

✅ 순서대로

  1. 지금 3.6 Flash를 쓰고 있다면 3.7로 바꾸세요. 값이 같은데 성능과 속도가 올랐습니다. 이 경우엔 고민할 게 없습니다.
  2. 새로 고르는 거라면 "절반"은 지우고 비교하세요. 오늘 기준 두 모델 값은 같습니다. 판단 근거는 속도와 지능 지수지 가격이 아닙니다.
  3. 1월 1일 이후 예산은 두 배로 잡으세요. 회계연도가 1월 시작이면 정확히 그 시점에 오릅니다. 도입가로 계산한 숫자를 그대로 올리면 첫 달부터 어긋납니다.
  4. 캐시를 쓸 계획이면 저장료를 따로 계산하세요. 시간당 과금이라 토큰 수가 아니라 얼마나 오래 얹어두느냐로 값이 정해집니다.
  5. 무료 등급이 있습니다. 결제 전에 여기서 먼저 재보세요.

세 번째가 이 글에서 제일 실용적인 부분입니다. AI 예산이 늘 빗나가는 이유를 정리하면서 "편성 전에 모아둘 숫자"를 꼽았는데, "이 단가가 언제까지 유효한가"를 그 목록에 넣어야겠습니다. 단가가 날짜를 달고 있을 줄은 저도 이번에 처음 봤습니다.

🆕 후속판이 나왔고, 값에 기한이 붙었습니다

이 글의 결론이 그대로 이어집니다. 9월 2일 나온 후속판도 가격표가 글자 하나 다르지 않은데, 그 값이 12월 31일까지라고 가격표에 함께 적혀 있습니다. 2027년 1월 1일부터 입력·출력·캐시가 전부 정확히 두 배가 되고, 이 글에서 다룬 전작에도 똑같이 적용됩니다.

자주 묻는 것

Q. 그럼 보도가 틀린 건가요?

틀렸다고는 못 합니다. "3.6 Flash 출시가의 절반"은 사실입니다. 문제는 기준 시점이 헤드라인에서 빠진다는 것이고, 그러면 읽는 사람은 "지금 3.6보다 싸다"로 받아들입니다. 그건 오늘 기준으로 사실이 아닙니다.

Q. 1월 1일에 정말 두 배가 되나요?

공식 가격표에 날짜와 금액이 같이 적혀 있습니다. 다만 가격 정책은 바뀔 수 있습니다 — 연말에 연장될 수도, 다른 모델이 나와 이 값이 무의미해질 수도 있습니다. 지금 문서에 그렇게 적혀 있다까지가 제가 말할 수 있는 범위입니다. 예산은 적힌 대로 잡되, 12월에 한 번 다시 보세요.

Q. 직접 써보고 쓴 건가요?

아닙니다. 안 써봤습니다. 이 글에 체감 성능이나 코드 품질에 대한 제 평가는 없습니다. 공식 가격 문서·공식 발표문·독립 평가 기관 세 곳을 대조한 것까지입니다. 코딩 성능은 본인 작업으로 직접 재보셔야 합니다 — 무료 등급이 있으니 카드 없이 됩니다.

📌 보탬 (8월 14일) — 같은 날 두 번째 사례가 나왔습니다

이 글에서 "단가에 날짜가 붙는다"를 짚었는데, 사흘 뒤 발효되는 사례가 또 있었습니다. DeepSeek이 한국시간 8월 17일 새벽 1시부터 시간대별 요금으로 바꿉니다. 여기서도 헤드라인("최대 12배")과 실제 표가 달랐고, "오프피크는 절반"이 현재가 대비 할인이 아니라 전 항목 인상이었습니다. 단가를 볼 때 "언제까지"에 더해 "몇 시에"까지 봐야 하는 시대가 됐습니다 → 한국 업무시간이 전부 피크입니다

✨ 정리하면

성능은 진짜로 올랐습니다 — 제3자 지수 52 → 56, 속도 1.5배. 3.6을 쓰고 있다면 바꾸는 게 맞습니다.

다만 "전작의 절반"은 오늘 기준이 아닙니다. 공식 가격표에서 두 모델은 같은 값이고, 집계 사이트만 서로 다른 시점을 나란히 놓고 있습니다.

그리고 1월 1일에 둘 다 두 배입니다. 캐시 저장료까지요. 단가를 볼 때 "언제까지"를 같이 보세요.

🧭 AI 지출 전체 그림

모델을 고른 다음엔 쓰면서 새는 곳이 따로 있습니다. 개인·개발자·회사별로 일곱 단계로 묶어뒀습니다 → AI에 쓰는 돈 총정리 — 숨은 비용 7가지

🔗 단가표가 안 보여주는 것들


확인 시점 — 2026년 8월 14일. ✅ 1차 확인 : Google Gemini API 공식 가격 문서(3.6 Flash·3.7 Flash·3.1 Pro 행의 입력·출력·캐시 입력·캐시 저장료와 날짜 조건, 무료 등급 유무, 구간 요금 유무) · Google 공식 발표문(도입가 문장, 벤치마크 다섯 항목, 제공 경로). 가격표 두 행이 동일하다는 점은 서로 다른 질문으로 두 번 조회해 같은 결과를 얻었습니다. 제3자 실측 : Artificial Analysis의 Gemini 3.6 Flash(high)·3.7 Flash(high) 모델 상세 페이지 — 지능 지수·순위·표시 단가·출력 속도. 📰 보도 : "전작 대비 절반"이라는 비교 표현의 출처로만 참조했고 수치 근거로는 쓰지 않았습니다. 확인하지 않은 것 : 두 모델을 직접 실행한 성능·코드 품질 비교 · 구글 자체 측정 벤치 네 항목의 재현 · 3.6 Flash의 출시 당시 원 단가를 당시 문서에서 직접 확인(현재 문서에는 지금 값만 있음) · 발표문 전문에 "절반" 비교 문장이 있는지 여부(제가 받은 본문 범위에는 없었습니다) · 캐시 저장료의 실제 청구 사례. 주의 : 가격 정책은 예고 없이 바뀝니다. 1월 1일 인상은 현재 문서에 적힌 예정이며 확정된 미래가 아닙니다. 제휴·협찬 없습니다.

반응형
Comments