你有沒有好奇過,同一件事丟給不同的 AI,做出來的東西到底能差多少?看發表會上那些 92 分、88 分的跑分數字,老實說真的沒什麼感覺。所以這次我不看分數,直接把同一組提示詞(prompt)丟給 ChatGPT 5.6 和 Claude Fable 5,純粹用成品一決勝負。
從把一整座城市 3D 重建、從零打造一款 RPG、複製一套線上設計工具,到品牌提案簡報和互動網站通通都有。看完這篇,你大概就抓得到這兩個模型裡,哪一邊比較合自己的工作流。用成品分高下的五回合,現在開始。
沒時間的話看這裡 — 三句話總結
- 單看成品品質,五回合裡大多數都是 Claude Fable 5 勝出。
- ChatGPT 5.6 雖然沒有到讓人拍案叫絕,但該做的都做得四平八穩,而且便宜很多。
- 視覺化吃重的複雜任務選 Claude;每天都要跑的日常實務,ChatGPT 才是務實解。
上場的兩位選手,條件都只給一次
開打前先把設定講清楚。這次比較以 2026 年 7 月 為準,兩邊都丟一模一樣的提示詞,而且只給一次機會、不重跑、不追問。
| 項目 | ChatGPT 5.6 | Claude Fable 5 |
|---|---|---|
| 細分模型 | Sol(索爾)· Terra(泰拉)· Luna(露娜)三種 | Fable 5 |
| 本次對決設定 | 選 Sol,效能選項開到 Ultra | Ultra Code 模式 |
ChatGPT 5.6 分成 Sol、Terra、Luna 三條路線。這次為了把效能榨到最高,我端出 Sol + Ultra 這組;Claude 那邊則以 Fable 5 + Ultra Code 應戰。
同一組提示詞,同樣只有一次機會。燈光交給擂台上。

第一回合 — 把整座首爾 3D 重建,誰做得比較像真的
第一道題目是「把首爾原封不動做成 3D 模型」。重點不是畫面漂不漂亮,真正的考場在於 自然現象和物理法則能還原到多真。
ChatGPT 5.6 交出來的首爾,其實蠻像樣的。
- 正中央的漢江與夜景、公寓大樓與市區建築、橫跨漢江的幾座大橋
- 南山塔(N Seoul Tower)、樂天世界塔,還有市中心的高樓群
- 車流量可從 0 調到最大、日夜切換、雨與雪的特效
問題出在整場的重頭戲——物理驗證競技場。地震規模拉到最大,建築也只是輕輕晃了一下;從高處丟下去的球,照理說落地要有那種「啪」一下的重量感,結果完全沒到位。
看完只留下一句「沒有想像中厲害」的印象。
Claude Fable 5 的路數就不太一樣了。它做出一座精巧得像音樂盒的城市,南山塔、漢江、63 大廈、樂天世界塔通通有,連在路上跑的車、行駛的火車,以及景福宮(朝鮮王朝的正宮,等級大概像故宮之於台北那種地標感)都塞進去了。到這裡兩邊還算平手,真正拉開差距的是物理競技場。
- 球會自然彈跳,而 箱子則和球不同,是從邊角翻滾著掉下去
- 風速與風向會精準反映在物體飛出去的方向上
- 地震規模 5.5 與 9.0 的破壞力差異、隕石墜落災難,甚至還有分階段的重建流程
- 畫面右側即時計算高度、實測距離與速度
第一回合勝者:Claude Fable 5。 物理法則連細節都顧到,這一點就決定勝負了。
第二回合 — 一組提示詞,RPG 真的跑得起來嗎
這次的題目是「從零打造一款韓國風奇幻 RPG」。劇情推進、任務、戰鬥、王關全部都得真的能跑,難度相當高。
ChatGPT 5.6 開頭還可以,但很快就崩了。角色做得有點粗糙、攻擊動作僵硬,最要命的是台詞 「一看就知道是 AI 寫的」。
怪物設計敷衍,難度平衡也沒抓好,說真的很難撐著玩到最後。
反觀 Claude Fable 5,端出了一款叫《赤色盟約》的遊戲。
- 從序章開始就有 真正 RPG 該有的 氛圍
- 任務對白自然,遊戲內文本的文筆明顯高出一截
- 升級、夥伴加入、技能系統、王關戰一應俱全
- 最後還來個反轉:一開始發任務給你的騎士團長,其實就是叛徒
而這一切,都是一組提示詞跑出來的。
第二回合勝者:Claude Fable 5。 寫作能力的差距,直接原封不動反映在遊戲劇本上。

第三回合 — 一鍵複製一個 Canva
第三題是「一鍵複製一個像 Canva 的線上設計服務」。光是外觀像沒有用,編輯器要 真的能操作 才算分。
兩邊的基本功都很紮實:上傳圖片、旋轉與透明度調整、方形圓形箭頭等元素、五種字型、外框與陰影效果,到成品下載通通都做得出來。
差別只出現在一個地方——AI 生成功能。
- ChatGPT 5.6:所謂的「AI 生成」,實際上比較像是拿現成範本換掉文字而已。撇開這塊,其他真的挑不出毛病。
- Claude Fable 5:第一眼幾乎和對手長一樣,但元素和樣式的選項多一些,還多了品牌套件(Brand Kit)和去背功能。
我把兩份成果並排開著看了好一陣子,真的很難分高下。
第三回合:平手。 完成度像照鏡子一樣接近。
第四回合 — 咖啡品牌提案簡報,誰做得比較乾淨
接著也丟了一題比較短的:「做一份咖啡品牌提案的 PPT」。
其中一份的設計相當俐落,斷行、版面配置和圖片都很穩,甚至連 咖啡店的空間平面配置圖 都畫出來,家具、牆面和室內設計概念全部依品牌色去發想。
另一份(品牌名叫「LS Roastery」)則是對齊稍微歪了一點、字型用的是預設款,字型選擇、字距和圖片運用上都差了那麼一點點。
比較乾淨的那份是 Claude,稍微可惜的那份是 ChatGPT。
第四回合小勝:Claude Fable 5。 提案簡報的完成度上贏了半步。

第五回合 — 讓人停下滑鼠的網站
最後一題是「做一個能讓人停下目光的質感網站」。這回合兩邊都讓人蠻驚豔的。
- ChatGPT 5.6:畫面像一整個太陽系。往下滾動,宇宙就一層層展開;點擊圓形或長按,會跑出一段像電影預告的演出,作品叫《最後訊號》。
- Claude Fable 5:作品名為《星之水深》。畫面會跟著滑鼠移動、點擊就擴散開來,滾動時故事跟著流動。一路遇見水母與巨鯨,氣氛像一則安靜的奇幻童話——華麗,但很沉靜。
第五回合:看個人喜好。 要華麗的演出還是安靜的敘事,兩邊都及格。
最終計分板
| 回合 | 任務 | 結果 |
|---|---|---|
| 1 | 首爾 3D 模型 + 物理驗證 | Claude 勝 |
| 2 | 原創 RPG 遊戲 | Claude 勝 |
| 3 | 複製 Canva | 平手 |
| 4 | 咖啡品牌 PPT | Claude 小勝 |
| 5 | 互動式網站 | 看喜好 |
所以,我到底該選哪一個?
如果只看成品品質、逼我二選一,答案是 Claude Fable 5。特別是重要又複雜、視覺化佔關鍵的任務,就算你講得含糊,它也比較能精準端出你要的東西。
但它有一個致命傷。這次把兩個模型的訂閱/使用費用擺在一起看,Claude 體感上大概貴了兩倍。如果是每天要跑好幾輪的工作,換算成台幣,一個月累積下來的差距其實相當有感。
反過來說,ChatGPT 5.6 Sol 就是典型的 CP 值型選手。雖然沒到讓人拍案叫絕,但一般需求幾乎都能穩穩交差,而且對錢包非常友善。
| 如果你是這種人 | 推薦 |
|---|---|
| 品質與視覺化最優先,預算擺第二 | Claude Fable 5 |
| 看 CP 值,找每天上工的實務夥伴 | ChatGPT 5.6(Sol) |
判斷標準其實可以濃縮成一句話:那份成品對你來說,值不值得多付兩倍的價錢? 拿你手上正要處理的那件工作,直接套進這個問題試試看。
換作是你,會把錢包打開給哪一邊呢?