월말마다 AI 코딩 한도를 다 태우고 다음 리셋만 기다려본 적 있으신가요. 저도 이번 달에 제일 좋은 모델 크레딧을 진작 소진하고 멍하니 대기 중이었는데, 클로드 오퍼스5(Claude Opus 5)가 나오면서 계산기를 다시 꺼냈습니다. 핵심만 먼저 말하면, 같은 작업에 돈이 절반쯤 덜 듭니다.
- 토큰 단가가 입력 100만 개당 5달러, 출력 100만 개당 25달러 — 상위 모델 Fable 5의 정확히 반값(2026년 7월 공개 단가 기준)
- 커서벤치 최고 난도에서 Fable 5 최고점과 0.5% 안쪽 차이, 대신 작업당 비용은 절반
- 기존 상위 모델과 사용 한도가 분리돼, 그쪽을 다 태운 날에도 이건 그대로 돌아갑니다
반값이라는 말, 표부터 그려서 확인했습니다
"반값"은 마케팅에서 하도 흔한 단어라 저는 일단 의심부터 합니다. 그래서 공개된 단가를 그대로 표에 옮겨봤어요.
🖼️ 추천 이미지 자리 — 🎨 버튼으로 이미지를 만들면 이 자리에 들어갑니다
늦은 밤 어두운 방, 책상 위 노트북 화면에 코드 에디터와 토큰 비용 그래프가 두 창으로 떠 있고, 그 옆에 숫자가 찍힌 계산기와 식은 커피잔이 놓인 장면. 개발자 1인칭 하이앵글 시점, 따뜻한 스탠드 조명 하나만 켜진 현실적인 야근 분위기, 실사 사진 스타일, 16:9
단가 자체는 명확합니다. 입력은 100만 토큰에 5달러, 출력은 25달러. 이전 오퍼스와 똑같은 값이고, 바로 윗급인 Fable 5(입력 10달러·출력 50달러)의 절반입니다.
| 구분 | 입력 100만 토큰 | 출력 100만 토큰 |
|---|---|---|
| Opus 5 | 5달러 | 25달러 |
| Fable 5 | 10달러 | 50달러 |
숫자만 보면 단순한 반값이지만, 체감은 조금 다릅니다.
에이전트 작업은 출력 토큰이 유독 많이 쌓이거든요. 긴 코드베이스를 수십 번 왕복하는 작업이라면, 이 절반이 그대로 청구서 절반으로 내려옵니다. 커뮤니티 후기에서 가장 자주 보이는 말도 "성능 체감은 비슷한데 월말이 안 무섭다"는 쪽입니다.
가격을 반으로 깎으면 성능도 깎일까
싸지면 성능이 빠지는 게 보통이라, 저는 여기서부터가 진짜라고 봤습니다. 공개된 지표를 하나씩 보면 생각보다 촘촘하게 붙습니다.
커서벤치 최고 난도(맥스) 구간에서 Opus 5는 Fable 5 최고점과 0.5% 안쪽 차이로 붙었습니다. 그런데 같은 작업 한 건을 끝내는 비용은 절반 수준이에요. 그래프에서 같은 높이에 점이 찍혔어도, 거기 도달하는 데 든 돈이 다르면 그건 다른 등급의 가성비죠.
에이전트 자동화 지표(재피어 오토메이션벤치)는 더 흥미로웠습니다. 발표 자료 기준으로, 작업을 끝까지 완료하는 패스율이 높으면서도 이전 클로드 모델보다 토큰을 덜 쓰고 리더보드 1위에 올랐다고 소개됐거든요. 컴퓨터 조작 계열 벤치(OSWorld 2.0)에서도 모든 가격대에서 경쟁 모델을 앞서고, Fable 5의 최고점을 약 3분의 1 예산으로 넘겼다고 공개됐습니다.
정리하면 "거의 윗급 지능을 절반 가격에"라는 포지셔닝은 과장이 아니었습니다. 다만 최상위 한 끗의 난도에서는 여전히 윗급이 미세하게 앞섭니다.
3D를 시키면 왜 결이 다를까
공개된 데모와 후기에서 제일 눈에 띈 건 벤치 숫자가 아니라 3D 결과물이었습니다. 텍스트로 구조를 이해하는 것과 공간·깊이를 이해하는 건 다른 얘긴데, 여기서 확실히 층이 갈립니다.

예를 들어 짧은 프롬프트 몇 줄로 "소를 키우고 우유를 짜서 파는 목장 타이쿤"을 시키면, 3D 젖소가 서 있고 우유 게이지가 차오르고 출하하면 돈이 쌓이는 흐름까지 한 번에 나오는 데모가 돌아다닙니다. 예전 같으면 며칠은 붙잡았을 작업이 프롬프트 한 문단으로 형태가 잡히는 셈이에요.
스크롤에 반응해 요소가 입체적으로 움직이는 웹사이트, 사진을 올리면 자동으로 굿즈 박스 목업을 만들어주는 웹앱도 같은 맥락입니다. 아이디어의 해상도가 곧 결과물의 해상도가 되는 구간에 들어온 셈이죠.
진짜 핵심은 한도가 따로 논다는 점
솔직히 저에게 가장 크게 와닿은 건 성능도 3D도 아니었습니다. 윗급 모델과 사용 한도가 분리돼 있다는 점이었어요.
기존에는 상위 모델 크레딧을 다 태우면 그날 작업이 사실상 멈췄습니다. 그런데 이번엔 그 한도를 다 써도 Opus 5는 별개 주머니에서 그대로 돌아갑니다. 월 정액을 100% 쥐어짜 쓰는 사람에겐 이게 성능 수치보다 실질적입니다.
사고 강도는 단계가 있는데, 제가 권하는 감각은 이렇습니다.
- 하이(High): 가성비 구간. 대부분의 코딩·자동화는 여기서 충분합니다.
- 엑스트라 하이 / 맥스: 복잡한 3D, 긴 리팩터링처럼 한 끗을 더 밀어야 할 때만 올리기.
또 하나, 예전 윗급 모델은 프롬프트가 조금만 애매해도 안전 분류기가 개입해 작업이 뚝뚝 끊기곤 했는데, 이번엔 그 개입 빈도가 이전 대비 85% 줄었다고 발표됐습니다. 워크플로우가 중간에 멎지 않는다는 건 체감이 꽤 큽니다.
이미지·영상까지 모델이 직접 뽑아온다
요즘 재밌는 흐름은, 코드만 짜고 끝이 아니라 그 안에 들어갈 이미지·영상 소스까지 모델이 그 자리에서 만들어 넣는다는 겁니다.

방식은 크게 둘입니다. 웹 인터페이스에서는 MCP 커넥터로 이미지·영상 생성 도구를 연결하고, 결과물을 바로 내 컴퓨터에 떨구고 싶으면 CLI 명령어를 터미널에 붙여 로그인 한 번으로 연결합니다. 둘 다 세팅은 몇 분이면 끝나요.
재미있는 지점은, 모델이 강할수록 이 조합의 상한이 올라간다는 겁니다. 디자인과 로직은 모델이 잡고 실제 소스는 연결된 생성 도구가 뽑는 분업이 되니까요. 내 아이디어가 구체적일수록 결과물이 좋아지는 구조라, 병목이 도구에서 사람 쪽으로 넘어옵니다.
그래서 오늘 뭘 기준으로 고르면 될까
제 판단 기준은 단순합니다. 토큰 예산이 빠듯하거나 3D·에이전트 작업이 잦다면 Opus 5를 기본값으로 두세요. 최상위 한 끗의 정밀함이 매출에 직결되는 소수 작업에서만 윗급을 꺼내면 됩니다.
예전에 한도 정책이 아쉬워 다른 모델로 떠났던 분이라면, 이번엔 돌아와 하루만 하이 모드로 굴려보길 권합니다. 청구서 절반이라는 숫자보다, 월말에 멈추지 않는다는 감각이 먼저 와닿을 거예요.
결국 남는 질문은 하나입니다. 절반의 비용으로 비슷한 결과가 나온다면, 그렇게 아껴 만든 여유를 우리는 어디에 쓸 것인가.