홍드로이드의 야매코딩

GPT-6 솔 출시 — 값은 절반·작업당 비용도 절반으로 본문

AI & Vibe Coding

GPT-6 솔 출시 — 값은 절반·작업당 비용도 절반으로

홍드로이드 2026. 9. 23. 18:06
반응형

오픈AI가 9월 22일 GPT-6 솔과 루나를 함께 내놨습니다. 앞서 나온 큰 모델의 방식을 작은 등급에 옮겨 담은 것인데, 눈에 띄는 건 값입니다 — 이전 세대 대비 토큰 값이 정확히 절반입니다.

둘 중 솔은 코딩처럼 복잡한 일을 맡는 쪽입니다. 같은 날 앤트로픽도 값을 내린 모델을 내놨으니 하루 사이에 양쪽 값이 같이 내려간 셈이죠.

📌 30초 요약

  • 토큰 값이 절반입니다.
  • 캐시 읽기는 90% 할인입니다.
  • 맥락은 백만 토큰 넘습니다.
  • 실수가 절반으로 줍니다.
  • 영구 가격이라 한시적 아님입니다.

1. 값이 어떻게 됐나

표값부터 보겠습니다. 백만 토큰당 넣는 쪽 2달러, 내놓는 쪽 10달러입니다. 이전 세대가 각각 두 배였으니 그대로 반값이 됐죠.

항목(백만 토큰당) 값
넣는 쪽 2달러 (절반으로)
내놓는 쪽 10달러 (절반으로)
캐시 읽기 0.2달러 (90% 할인)
가격 성격 한시 특가가 아님

넷째 줄을 회사가 따로 밝힌 게 흥미롭습니다. 도입 특가나 홍보용 할인이 아니라 그냥 가격이라는 것이죠. 값이 내려갈 때 늘 따라붙던 「나중에 올릴 수도 있다」는 불안을 미리 끊어 둔 셈입니다.

셋째 줄도 큽니다. 같은 앞부분을 반복해 넣는 작업이라면 회사별로 캐시 요금을 견줘 보던 계산을 다시 하셔야 합니다 — 넣는 쪽 값의 10분의 1이니까요.

2. 작업당 비용이라는 잣대

이번 발표에서 눈여겨볼 건 점수와 함께 「그 점수를 내는 데 든 값」을 같이 공개했다는 점입니다. 토큰 값이 싸도 답을 길게 늘어놓으면 실제 지출은 안 줄어드니, 이 잣대가 훨씬 정직하죠.

무엇을 재나 점수 · 작업당 값
소프트웨어 수정 68.8% · 2.74달러
긴 과제 수행 56.4% · 2.93달러
어려운 코드 과제 49.3% · 2.14달러
업무 자동화 33.2% · 0.27달러

넷째 줄의 0.27달러가 눈에 띕니다. 점수는 가장 낮지만 한 건 처리에 400원이 안 드는 셈이죠. 반대로 소프트웨어 수정이나 긴 과제는 한 건에 3천~4천 원대입니다. 같은 모델이라도 어떤 일을 시키느냐에 따라 열 배 넘게 갈립니다.

회사 설명으로는 여섯 개 잣대 중 넷에서 점수가 올랐고, 모든 항목에서 작업당 값이 대략 절반 이상 줄었습니다. 실수도 이전 세대의 절반 수준으로 줄었다고 하고요.

여기서 「실수가 절반」과 「점수가 올랐다」는 다른 말이라는 점을 짚어 둘 만합니다. 틀리는 빈도가 줄어도 어려운 문제를 새로 풀어내는 능력은 그대로일 수 있거든요. 실제로 여섯 중 둘은 점수가 안 올랐습니다. 그러니 「더 똑똑해졌다」보다 「같은 값에 덜 틀린다」 쪽으로 읽으시는 편이 실제에 가깝습니다.

이런 성격은 사람이 일일이 확인하기 어려운 대량 작업에서 특히 값어치가 큽니다. 백 건 중 열 건이 틀리던 게 다섯 건으로 줄면 뒤에서 손보는 품이 절반으로 주니까요. 반대로 한 건 한 건이 중요한 작업이라면 절반이 줄어도 확인 절차는 그대로 두셔야 합니다.

3. 크기와 쓰는 곳

한 번에 다룰 수 있는 양이 큽니다. 맥락 창이 백만 토큰을 넘고 내놓는 쪽도 최대 12만 8천 토큰까지 갑니다. 큰 저장소를 통째로 넣고 물어보는 식의 작업이 가능한 크기죠.

⚠️ 맥락이 크다고 다 넣으면 값은 그대로 큽니다

백만 토큰을 실제로 채워 넣으면 한 번 호출에 2달러입니다. 넣는 쪽 값이 절반으로 내렸어도 넣는 양을 두 배로 늘리면 지출은 제자리죠. 「이제 싸졌으니 통째로 넣자」는 판단이 가장 위험합니다. 값이 내려간 만큼 골라 넣는 습관은 오히려 더 값어치가 커집니다 — 캐시 읽기가 10분의 1이니 고정된 앞부분을 캐시에 태우고 바뀌는 부분만 새로 넣는 구조가 가장 싸게 먹힙니다. 큰 맥락 창은 「한 번에 넣어도 된다」가 아니라 「쪼갤 필요가 줄었다」로 읽으시는 게 맞습니다.

쓸 수 있는 곳은 출시 당일부터 셋입니다 — 업무용 챗지피티, 코드 작업 도구, 그리고 개발자용 접속입니다. 회사는 솔을 에이전트와 업무 자동화의 기본 모델로 권하고 있습니다. 코딩 에이전트를 견줘 보던 기준으로 보면, 값이 반으로 내려온 만큼 후보 목록을 다시 짤 만한 변화입니다.

4. 같은 날 내려간 두 값

하루 사이에 양쪽 회사가 나란히 값을 내린 점은 짚어 둘 만합니다. 한쪽은 표값 20%에 캐시 60%, 다른 쪽은 표값 50%에 캐시 90% 할인이죠. 경쟁이 값으로 붙고 있다는 신호입니다.

쓰는 쪽에서는 어느 한쪽에 묶이지 않는 구조가 값어치를 갖게 됩니다. 값이 이렇게 자주 움직이면 갈아타는 비용이 낮을수록 이득이니까요. 모델마다 성격이 갈리는 지점을 미리 정리해 두던 작업이 그래서 쓸모가 있습니다 — 값이 바뀔 때마다 처음부터 재지 않아도 되니까요.

다만 값만 보고 정하기엔 이릅니다. 공개된 잣대가 회사마다 다르고, 같은 이름의 시험이라도 판올림이 다르면 숫자를 나란히 놓기 어렵습니다. 내가 실제로 시키는 일로 양쪽을 한 번씩 돌려 보는 것이 결국 가장 정확한 비교입니다.

자주 묻는 질문 (FAQ)

Q. 나중에 값이 오를 수 있나요

회사가 도입 특가가 아닌 영구 가격이라고 밝혔습니다. 물론 앞으로의 정책까지 보장하는 말은 아니지만, 한시 할인으로 보고 미룰 이유는 없습니다.

Q. 실제로 지출이 절반이 되나요

작업에 따라 다릅니다. 공개된 작업당 값 기준으로는 대체로 절반 아래로 내려갔지만, 넣는 양을 늘리면 그만큼 상쇄됩니다.

Q. 어떤 일에 쓰면 좋나요

회사는 에이전트와 업무 자동화의 기본으로 권합니다. 코딩처럼 여러 단계를 밟는 작업이 이쪽이고, 단순 분류나 요약은 같이 나온 작은 모델이 맞습니다.

Q. 모든 항목이 좋아졌나요

아닙니다. 여섯 중 넷에서 올랐습니다. 내려간 항목도 있어 이 부분은 따로 뜯어 볼 값어치가 있습니다.

정리하면

  • 표값이 절반입니다.
  • 작업당 값도 절반 아래입니다.
  • 캐시는 10분의 1입니다.
  • 맥락은 백만을 넘습니다.
  • 다 넣으면 말짱 도루묵입니다.

※ 2026년 9월 22일 발표 직후 여러 해외 매체가 전한 가격·성능 수치를 서로 대조해 정리했습니다. 제조사 공식 페이지는 접근이 막혀 있어 매체 보도 기준으로 적었습니다.

※ 작업당 값은 특정 시험 환경에서 잰 수치라 실제 지출과는 다를 수 있습니다. 도입 전 직접 재 보시길 권합니다.

반응형
Comments