같은 일을 시켰을 때 AI마다 결과가 얼마나 달라지는지 궁금했던 적 있으신가요? 발표 자료에 적힌 벤치마크 92점, 88점 같은 숫자만 봐서는 뭐가 어떻게 다른지 도무지 감이 안 오더라구요. 그래서 숫자 대신 챗GPT 5.6과 클로드 페이블 5에 똑같은 프롬프트를 던지고, 오직 결과물로만 승부를 가려 봤어요.
도시를 통째로 3D로 세우고, RPG를 처음부터 만들고, 디자인 툴을 복제하고, 제안서와 웹사이트까지. 이 글을 끝까지 보면 두 모델 중 내 작업에 맞는 쪽을 고르는 기준이 잡힐 거예요. 결과물로 승부를 가리는 5라운드, 지금 시작할게요.
바쁘면 여기만 — 3줄 요약
- 결과물 퀄리티만 놓고 보면 5라운드 중 대부분에서 클로드 페이블 5가 앞섰어요.
- 챗GPT 5.6은 무릎을 칠 정도는 아니어도 웬만한 건 다 무난하게, 그리고 훨씬 싼값에 해내더라구요.
- 시각화가 관건인 복잡한 작업엔 클로드, 매일 반복되는 실무엔 챗GPT가 현실적인 선택이에요.
링에 오른 두 선수, 조건은 딱 한 번씩
본격적인 대결에 앞서 두 선수의 설정부터 맞춰 둘게요. 이 비교는 2026년 7월 기준, 양쪽 모두에게 동일한 프롬프트를 단 한 번만 던지는 조건으로 진행했어요.
| 항목 | 챗GPT 5.6 | 클로드 페이블 5 |
|---|---|---|
| 세부 모델 | 솔(Sol) · 테라(Terra) · 루나(Luna) 3종 | 페이블 5 |
| 이번 대결 설정 | 솔 선택, 성능 옵션 울트라 | 울트라 코드 모드 |
챗GPT 5.6은 솔·테라·루나 세 갈래로 나뉘어요. 최고 성능을 뽑으려 이번엔 솔 + 울트라 조합을 꺼냈고, 클로드는 페이블 5 + 울트라 코드로 응수했죠.
같은 프롬프트, 같은 한 번의 기회. 이제 조명은 링 위로 넘어가요.

1라운드 — 서울을 통째로 3D로 세우면 누가 진짜일까
첫 미션은 "서울을 그대로 3D 모형으로 만들어라". 예쁜 그림이 목적이 아니었어요. 진짜 시험대는 자연 현상과 물리 법칙을 얼마나 진짜처럼 구현하느냐였죠.
챗GPT 5.6은 꽤 그럴듯한 서울을 뽑아냈어요.
- 가운데 한강과 야경, 아파트와 건물, 한강 대교들
- 남산타워와 롯데타워, 도심의 고층 단지
- 교통량 0부터 최대까지 조절, 낮과 밤 전환, 비·눈 효과
문제는 하이라이트인 물리 검증 아레나였어요. 지진 규모를 최대로 키워도 흔들림이 미미하더라구요. 높은 곳에서 떨어뜨린 공은 실제라면 철퍼덕 내려앉아야 할 텐데 그 맛이 없었죠.
"생각했던 만큼은 아니다"라는 인상이 남더라구요.
클로드 페이블 5는 결이 다르더라구요. 오밀조밀한 오르골 같은 도시 안에 남산타워·한강·63빌딩·롯데타워는 물론, 달리는 차와 기차, 경복궁까지 채워 넣었죠. 여기까진 비슷했는데, 물리 아레나에서 격차가 벌어지더라구요.
- 공은 자연스럽게 튀고, 상자는 공과 다르게 모서리로 굴러 떨어짐
- 바람의 풍속·풍향에 따라 날아가는 방향이 정확히 반영
- 지진 규모 5.5와 9.0의 파괴력 차이, 운석 낙하 재난, 단계별 재건까지
- 화면 우측에서 높이·실측·속도를 실시간으로 계산
1라운드 승자: 클로드 페이블 5. 물리 법칙을 디테일 하나까지 살려낸 점이 승부를 갈랐어요.
2라운드 — 프롬프트 한 번으로 RPG가 굴러갈까
이번엔 "한국 판타지 RPG 게임을 처음부터 만들어라". 스토리 전개, 퀘스트, 전투, 보스전까지 실제로 다 굴러가야 하는 고난도 과제예요.
챗GPT 5.6은 시작은 나쁘지 않았는데 이내 무너지더라구요. 캐릭터는 어설프고 공격 동작은 어색했고, 무엇보다 대사에서 "딱 봐도 AI가 쓴 티"가 나더라구요.
몬스터 디자인은 성의가 없고 난이도 밸런스도 맞지 않아서, 끝까지 보기가 힘들었죠.
근데 클로드 페이블 5는 「붉은 맹약」이라는 제목의 게임을 내놨어요.
- 프롤로그부터 진짜 RPG 같은 분위기
- 자연스러운 퀘스트 대사와 확연히 나은 게임 내 글쓰기
- 레벨업, 동료 합류, 스킬, 보스전
- 처음 퀘스트를 준 기사 단장이 배신자였다는 반전 결말까지
이 모든 걸 프롬프트 딱 한 번으로 만들어냈어요.
2라운드 승자: 클로드 페이블 5. 글쓰기 능력 차이가 게임 시나리오에 그대로 드러나더라구요.

3라운드 — 캔바를 클릭 한 번에 복제한다면
세 번째는 "캔바(Canva) 같은 디자인 서비스를 클릭 한 번으로 복제하라". 겉모습만 흉내 내는 게 아니라, 편집기가 실제로 작동해야 점수를 받아요.
양쪽 모두 기본기는 탄탄하더라구요. 이미지 업로드, 회전·투명도 조정, 사각형·원·화살표 같은 요소, 5종 폰트, 테두리·그림자 효과, 완성본 다운로드까지 다 됐죠.
차이는 단 한 곳, AI 생성 기능에서 났어요.
- 챗GPT 5.6: "AI 생성"이 사실상 샘플 디자인에 텍스트만 바꿔 끼우는 수준. 그 부분만 빼면 나무랄 데 없었어요.
- 클로드 페이블 5: 첫인상은 거의 판박이인데 요소·스타일 항목이 조금 더 많고, 브랜드 키트와 배경 제거까지 지원.
두 결과를 나란히 띄워 놓고 한참을 들여다봤는데, 우열을 가리기가 정말 애매하더라구요.
3라운드: 무승부. 완성도가 서로를 거울처럼 닮았어요.
4라운드 — 커피 브랜드 제안서, 누가 더 깔끔할까
짧게 "커피 브랜드 제안서를 PPT로 만들어라"도 시켜 봤어요.
한쪽 결과물은 디자인이 깔끔하고 줄바꿈·배치·이미지가 안정적이었고, 커피 매장 공간 배치도에 브랜드 컬러 기반의 가구·벽·인테리어 콘셉트까지 잡아냈더라구요.
근데 다른 쪽('LS 로스터리')은 정렬이 살짝 흔들리고 폰트가 기본형이라, 폰트·자간·이미지 활용에서 한 끗씩 아쉬운 느낌이었죠.
더 깔끔했던 1번이 클로드, 아쉬웠던 2번이 챗GPT였어요.
4라운드 우세: 클로드 페이블 5. 제안서의 완성도에서 반걸음 앞섰어요.

5라운드 — 시선을 멈추게 하는 웹사이트
마지막은 "사람들의 시선을 멈추게 하는 감각적인 웹사이트". 여기선 둘 다 인상적이더라구요.
- 챗GPT 5.6: 태양계를 그린 듯한 화면. 스크롤을 내릴수록 우주가 펼쳐지고, 원을 클릭하거나 꾹 누르면 「라스트 시그널」이라는 영화 예고편 같은 연출이 등장해요.
- 클로드 페이블 5: 「별의 수심」이라는 작품. 마우스를 따라 움직이고, 클릭하면 퍼지고, 스크롤에 스토리가 흘러요. 해파리와 거대 고래를 만나는 잔잔한 환상 동화 같은 분위기 — 화려하되 고요했죠.
5라운드: 취향의 영역. 화려한 연출이냐 잔잔한 서사냐, 둘 다 합격점이에요.
최종 스코어보드로 정리하면
| 라운드 | 미션 | 결과 |
|---|---|---|
| 1 | 서울 3D 모형 + 물리 검증 | 클로드 승 |
| 2 | 오리지널 RPG 게임 | 클로드 승 |
| 3 | 캔바 복제 | 무승부 |
| 4 | 커피 브랜드 PPT | 클로드 우세 |
| 5 | 인터랙티브 웹사이트 | 취향 |
그래서, 나는 뭘 골라야 할까
결과물의 퀄리티만 놓고 하나만 고르라면 답은 클로드 페이블 5예요. 특히 중요하고 복잡한 일, 시각화가 관건인 작업이라면 두루뭉술하게 말해도 원하는 걸 정확히 가져오는 쪽이 강하더라구요.
근데 결정적인 약점이 하나 있어요. 이번 대결에서 두 모델의 이용 가격을 나란히 놓고 보면, 클로드가 챗GPT보다 체감상 두 배가량 비싸더라구요. 매일 여러 번 돌리는 작업이라면 이 격차가 한 달 단위로 꽤 묵직하게 쌓이죠.
반대로 챗GPT 5.6 솔은 전형적인 가성비형이에요. 무릎을 칠 감탄까진 아니어도 웬만한 건 다 무난하게 해내고, 무엇보다 지갑에 부담이 적어요.
| 이런 분이라면 | 추천 |
|---|---|
| 퀄리티·시각화가 최우선, 예산은 그다음 | 클로드 페이블 5 |
| 가성비로 매일 쓰는 실무 파트너 | 챗GPT 5.6 (솔) |
판단 기준은 딱 한 줄로 좁혀져요. 두 배의 가격 차이를 감수할 만큼, 그 결과물이 나에게 절실한가. 지금 하려는 작업 하나를 이 질문에 그대로 대입해 보세요.
여러분이라면 이 두 모델, 어느 쪽에 지갑을 여시겠어요?