Claude Fable 5 靚啲,GPT-5.6 Sol 識講產品:同一 brief 實驗拆解
3C 產品

Claude Fable 5 靚啲,GPT-5.6 Sol 識講產品:同一 brief 實驗拆解

圖片:via XDA Developers — https://www.xda-developers.com/built-website-with-fable-5-and-gpt-56-sol-winner-wasnt-who-i-expected/
TechLab 編輯部(譯)·

XDA 用同一份網站要求起稿,結果反映首輪理解同執漏成本嘅差距

同一份 brief,起步線仍然唔完全相同

XDA 作者 Nolen Jonker 想整一個叫 Priming 嘅 landing page,概念係提供參考素材包,畀設計師連同 prompt 一齊交俾 AI。兩款模型收到相同文案、頁面結構、無外部依賴等要求,顏色、間距、動態效果同 icon 就由模型決定;Fable 5 喺 Claude Code 工作,GPT-5.6 Sol 則喺 Codex 寫檔。作者亦埋咗一個幾何碎片動畫陷阱,用嚟睇模型識唔識控制視覺層次。

不過個比較有一個幾大嘅缺口:Fable 全程用 High effort,Sol 由 ChatGPT 轉去 Work 再交俾 Codex 時,設定跌咗落 Medium,作者做完先發現。兩邊嘅 agent、檔案管理同驗證流程亦唔一樣。相同初始要求,只代表輸入接近;成個執行環境其實冇完全對齊。 所以呢次結果適合用嚟觀察工作風格,未夠證明邊款模型全面勁過另一款。

Fable 首輪靚得完整,但兩次都執錯動畫

按 XDA 交代,Fable 用約 20 分鐘同 15,600 tokens 完成頁面,期間自己檢查 HTML 結構、console error 同動畫有冇運作。七個區塊齊全,深色底、鼠尾草綠點綴、玻璃感導覽列、金屬紋理按鈕同字體選擇都貼近 brief;見到「無外部依賴」後,佢亦改用系統 serif 字體,冇拉 Google Fonts。以首輪交付嚟講,完整度同視覺一致性都幾高。

問題出喺幾何碎片動畫。作者想要低透明度細碎片落喺背景,Fable 第一次整到又大又實,似一堆壞咗嘅介面元件;再改仍然捉錯方向。產品表達亦偏泛用:個頁面睇落似高級設計工具,但冇清楚講素材包點樣配合 AI 工具,換個品牌名都仲講得通。換句話講,佢好識完成視覺要求,但要人手再補產品語境同執動畫。

Sol 兩分幾鐘交貨,較快睇明個產品

XDA 記錄 Sol 實際生成時間係 2 分 25 秒,首次已經將碎片收細、分散到背景,冇阻住主要介面。佢亦自行加入 v0、Claude、Lovable、Bolt 同 ChatGPT 等工具名稱,再整一張素材包預覽卡,令人一眼睇明 Priming 賣緊咩。作者認為呢種產品理解令 Sol 嘅版本較適合 landing page,文案亦較直接;代價係玻璃感導覽列同金屬按鈕冇 Fable 咁細緻。

不過唔可以直接攞呢啲時間數字比較模型跑速。Fable 花咗時間自我驗證,Sol 用另一套 agent 流程,推理強度亦較低;XDA 仲錄得 Codex 開咗 11 個程序、佔約 1.9GB RAM。原文冇公開完整程式碼、重複測試、手機版結果、無障礙檢查或效能數據,程式碼質素暫時只可講 Fable 驗證做得較足,未夠資料判 Sol 寫得乾淨啲。

真正慳到嘅,係幾多輪修改

對 freelance developer、設計師或者細公司嚟講,兩分鐘同二十分鐘嘅差距未必最大;如果首稿理解錯產品,後面逐句補資料、改版面,再重新檢查,人工時間好快貴過模型用量。呢次 Sol 一輪已捉到受眾同用途,修改方向會較集中;Fable 個視覺完成度高,但動畫同產品定位仍要再傾。實際揀工具時,可以用自己過往項目計一計:邊款模型平均少一兩輪來回,通常有用過單次生成快幾分鐘。

成本亦要分開睇。XDA 作者嘅 Sol 經 ChatGPT 方案使用,冇逐次收 API token 費,但文章冇交代兩邊訂閱總成本。官方 API 價方面,GPT-5.6 Sol 每百萬 input/output tokens 分別係 US$5/US$30;Claude Fable 5 則係 US$10/US$50。Fable 今次只披露總 token 數,冇 input、output 分拆,計唔到實際 API 費。訂閱用量上限同 API 計費又係兩套數,唔應該攞今次時間直接推算邊款較抵。

香港帳戶可用性仍有實際門檻

截至 2026 年 8 月 3 日,OpenAI 官方話 GPT-5.6 Sol 正逐步開放畀合資格 Plus、Pro、Business 同 Enterprise 方案,Codex 亦視乎方案提供;Anthropic 就列明 Fable 5 可供 Pro、Max、Team 同 Enterprise 用戶使用。不過兩間公司現行官方支援地區名單都搵唔到香港,ChatGPT、OpenAI API、Claude.ai 同 Claude API 嘅標準香港帳戶支援狀況都唔應寫成已全面開放。經企業雲端平台取得模型亦可能有另一套地區、合約同收費限制,落單前要按實際帳戶再核對。

呢次測試最有用嘅訊息係兩款模型會用唔同方式理解同一份設計要求:Fable 偏向視覺打磨同自我檢查,Sol 今次較快補齊產品脈絡。下次值得睇嘅係多跑幾次、鎖定相同推理強度,再公開程式碼同修改紀錄,先可以比較邊款工具長期慳到較多人工。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook