구독료는 매달 나가는데, 정작 작업을 켤 때마다 '이건 어떤 모델로 돌리지?' 망설이게 되죠. 새로 나온 Opus 5까지 셋이 되니 벤치마크 숫자만 봐선 감이 더 안 옵니다.

그래서 같은 프롬프트를 세 모델에 똑같이 넣어봤습니다. 실력 순위가 아니라, 어디에 뭘 쓰면 실속 있는지만 추렸어요.

미리 말하면 셋은 실력보다 '성격'이 다릅니다. 성격만 알면 헤맬 일이 없습니다.

  • 어렵고 복잡한 작업은 Fable 5 → Opus 5 순서, 둘 차이는 생각보다 작습니다.
  • 빠르고 단순한 반복 작업은 Sol이 여전히 가볍고 빠릅니다.
  • Opus 5는 Fable보다 값이 싸고 체감 속도도 조금 빨라, 가성비 카드가 하나 늘었습니다.

세 모델, 실력보다 '성격'이 다릅니다

같은 테마로 게임 하나, 단편소설 하나, 통계 웹페이지 하나를 만들게 시켰습니다. 조건은 최대한 공평하게 맞췄어요.

결과를 스스로 검증하고 고치는 옵션은 껐고, 각 모델의 기본 최고 설정으로 딱 한 번씩만 돌렸습니다. '한 방에 얼마나 잘 뽑나'를 보려는 거였죠.

흥미로운 건 Opus 5와 Fable 5가 쌍둥이처럼 닮았다는 점입니다. 완성물의 결도, 풀어가는 방향도, 표현 감각까지 비슷해서 결과만 보곤 어느 쪽인지 헷갈릴 정도였어요.

Sol은 확실히 다른 길을 갔습니다. 방향은 맞는데 마감이 한 끗 아쉬운, 그 차이가 세 작업 내내 반복됐습니다.

어두운 스튜디오 배경에 반투명 유리 패널 세 장이 살짝 어긋난 각도로 공중에 떠 있고, 각 패널 안으로 보라·청록·주황의 가느다란 코드 라인이

어렵고 복잡한 일은 결국 누가 잘할까

같은 게임 프롬프트에서 로직은 셋 다 한 번에 굴러갔습니다. 침수 전에 예보하고, 배수 펌프 돌리고, 구조 신호를 보내는 규칙을 여섯 턴 안에 끝내는 단순한 구조라 로직에선 갈리지 않았어요.

차이는 '마감'에서 났습니다. Sol이 만든 화면은 안전 항로를 가리키는 화살표 위치가 살짝 틀어졌고, 원 옆에 붙어야 할 선이 떨어진 채 나왔습니다. 큰 버그는 아니지만 검증을 대충 넘긴 티가 났죠.

반면 Opus와 Fable은 애니메이션 정렬, 요소 간 결합 같은 디테일을 한 번에 더 깔끔히 맞췄습니다. 여기서 제가 세운 가설은 하나예요.

모델 자체의 지능보다, 결과를 스스로 검증하고 되고치는 '뒷단(하네스)'의 완성도가 첫 결과물의 품질을 가른다.

실제로 Sol도 두 번째 프롬프트로 고쳐 달라 하면 잘 고칩니다. 다만 한 방에 끝내는 힘은 클로드 계열이 앞섰다는 게 이번 관찰의 핵심입니다. 검증 옵션을 높이면 Sol도 격차가 크게 줄고요.

한국어 글쓰기, 이제 클로드가 밀리지 않습니다

예전엔 한국어 결과물이 필요하면 그냥 GPT였습니다. 문장의 자연스러움에서 클로드가 한 뼘 뒤처졌거든요. 저도 한국어 산출물은 습관처럼 GPT로 뽑았고요.

이번엔 같은 조건의 단편소설을 셋에 맡겼는데, 어느 게 낫다 가르기 어려울 만큼 다 자연스러웠습니다. 어색한 조사도, 번역투도 거의 사라졌어요.

갈린 지점은 엉뚱하게도 '공기감'이었습니다. 정전과 함께 비상등이 켜지는 도입부의 분위기를 얼마나 밀도 있게 잡느냐, 거기서 미세하게 벌어졌죠.

제 주관적 감상으론 Fable 5의 문장 흐름이 가장 매끄러웠고, Opus 5가 근소하게 뒤를 이었습니다. 분명한 건 하나, 이제 '한국어=GPT' 공식은 내려놓아도 됩니다.

낡은 나무 책상 위 크림색 원고지에 만년필로 또박또박 쓴 한글 문장, 오른쪽에서 스며드는 붉은 비상등 불빛이 종이 가장자리를 물들이는 어두운 실

웹·인터랙션을 만들면 여기서 갈립니다

통계와 상호작용이 들어간 웹페이지에서 차이가 가장 선명했습니다. 마우스를 올리면 수치가 바뀌고, 센서를 누르면 값이 갱신되는, 요즘 대시보드에서 흔한 형태였어요.

Opus와 Fable은 호버(마우스 오버) 기반 인터랙션을 자연스럽게 구현했고, 타임라인의 점과 선도 정확히 맞아떨어졌습니다.

Sol은 호버 대신 클릭으로 처리했고, 타임라인 포인트가 어긋나 있었습니다. 모바일이 아니라면 요즘 웹은 호버가 훨씬 자연스럽죠.

선과 좌표가 딱 맞아야 하는 정밀한 UI에서 Sol이 자주 헛짚는 인상은, 앞서 게임에서 본 패턴과 정확히 겹쳤습니다. 우연이 아니라 성향이라는 뜻이에요.

속도와 가격, 실제로 얼마나 차이 날까

2026년 7월 기준, 공개된 가격표만 보면 Opus 5가 Fable 5의 절반 수준입니다. 벤치마크 숫자로는 '굳이 Fable을?' 싶을 만큼 Opus 5가 잘 나왔어요. 다만 벤치마크는 참고일 뿐, 체감은 조금 다릅니다.

속도는 재밌게도 작업 종류를 탔습니다. 코드나 화면 작업은 Opus가 조금 빨랐는데, 글쓰기는 오히려 Fable이 먼저 뽑아냈거든요. 한 줄로 단정하기 어려운 지점입니다.

기준Opus 5Fable 5Sol (5.6)
어려운 작업 완성도매우 높음매우 높음좋으나 마감 아쉬움
한국어 글맛자연스러움가장 매끄러움자연스러움
정밀 UI·정렬강함강함자주 어긋남
상대 가격낮음(절반 수준)높음중간
강점 영역가성비·복잡한 작업최상위 품질빠른 단순 작업

표 한 장으로 줄이면 이렇습니다. Opus 5는 4.8 세대 대비 확실히 올라섰고, Fable과의 격차는 웬만한 난이도에선 손에 잡히지 않았어요. 그러면서 값은 절반이니, 고를 카드가 넉넉해진 셈이죠.

가운데가 완벽히 수평을 이룬 접시저울, 한쪽엔 반짝이는 동전 더미, 다른 쪽엔 작은 로봇 두 대가 나란히 앉아 균형을 잡은 미니멀 플랫 일러스트

내 상황이라면 뭘 골라야 할까

구독 상황별로 나눠보면 답이 꽤 또렷해집니다. 후기에서 제일 많이 보이는 질문도 결국 '내 요금제로 뭘 켤까'였어요.

  • 클로드만 구독 중이라면: 평소엔 Fable을 먼저 쓰고(별도 사용량이 있으니), 소진되면 어려운 작업만 Opus 5로 넘기는 조합이 만족도가 높습니다.
  • 토큰이 빠듯하다면: 전부 Opus 5로 돌리다가, 복잡한 작업에서만 상위 검증 옵션을 켜는 방식을 추천합니다.
  • 지금 GPT만 쓴다면: 이번 달이나 다음 결제부터 한 번쯤 클로드를 얹어볼 만합니다. 한국어 격차가 사라진 지금은 체감이 꽤 달라졌어요.

난이도로만 줄 세우면, 어려운 일은 Fable → Opus → Sol, 빠르고 단순한 일은 Sol → Opus → Fable 순입니다. Sol의 빠른 모드가 손에 안 익으면 그 자리를 Opus로 바꿔도 무방하고요.

오늘 딱 하나만 해보신다면, 지금 자주 하는 작업 한 개를 골라 세 모델에 같은 프롬프트로 넣어보세요. 벤치마크 백 줄보다, 내 손에 맞는 한 번의 결과가 훨씬 정확합니다. 결국 좋은 모델은 '1등'이 아니라 내 작업의 리듬에 맞는 모델이더군요.