# 影片筆記:OpenAI最新AI「GPT-5.6」「ChatGPT Work」が登場!Claude Fable 5との比較や新機能を解説してみた ## 一句話總結 影片介紹 OpenAI 發布 GPT 5.6 系列新模型(索爾、泰拉、露娜)及 ChatGPT 介面更新,並透過實測比較 GPT 5.6 與 Anthropic 的 Fable 5 在搜尋、設計、客觀性等方面的表現,結論認為 GPT 5.6 適合邏輯與搜尋任務,而 Fable 5 在創意與語感上仍具優勢。 ## 核心重點 * **新模型發布**:OpenAI 推出 GPT 5.6 系列,包含索爾(Sol)、泰拉(Tera)、露娜(Luna)三款模型,其中索爾為最高級別,需訂閱月費 20 美元的方案。 * **介面與功能更新**:ChatGPT 應用程式分為「Chat」(快速提問)、「Work」(長任務、研究、文件製作)與「Codex」(開發者功能)三個區塊。桌面版支援本地檔案存取。 * **技術優勢**:GPT 5.6 採用「程式化工具呼叫」(Programmatic Tool Calling),可預先規劃多個工具呼叫順序,降低 Token 消耗與成本,官方數據顯示其成本效益優於競爭對手。 * **實測比較結果**: * **客觀性**:在評價低需求事業案時,Fable 5 較客觀,GPT 5.6 Sol 帶有偏見(過度褒獎),Sol Ultra 模式較好但仍存偏差。 * **搜尋精度**:GPT 5.6 Sol 的搜尋網羅性與完整性優於 Fable 5。 * **設計與簡報**:Fable 5 在視覺設計美感與文章易讀性上獲作者偏好;GPT 5.6 設計能力大幅提升但有時過於花俏或雜亂。 * **使用建議**:GPT 5.6 被視為具備強「左腦」能力(搜尋、準確性、邏輯),適合撰寫文章與邏輯推演;Fable 5 被視為具備強「右腦」能力(發想、語感、易讀性),適合創意與腦力激盪。建議依需求切換使用。 * **其他功能**:ChatGPT 的「Site 功能」(建立網站)現開放給個人用戶;Anthropic 因競爭延長了 Fable 5 的開放時間。 ## 詳細大綱 ### 一、 GPT 5.6 發布概況與介面更新 1. **新模型陣容** * 發布三款新模型:索爾(Sol)、泰拉(Tera)、露娜(Luna)。 * 命名含義:分別對應太陽、地球、月亮。 * 等級劃分:索爾為最高級別,需訂閱月費 20 美元的 ChatGPT 方案方可使用。 2. **應用程式介面(UI)重大更新** * **Chat 標籤**:用於快速提問、搜尋、短時間對話。 * **Work 標籤**:用於研究、分析、文件製作、試算表與簡報等長任務。 * **Codex 模式**:原網頁版功能,現整合於桌面版應用程式中,支援開發者功能(如 Git 相關操作)。 * **平台差異**: * 網頁版:僅有 Chat 與 Work 兩個標籤。 * 桌面版:支援 ChatGPT Work 與 Codex,可存取本地電腦檔案(如 MyWorkspace 資料夾)。 ### 二、 技術背景與性能優勢 1. **成本效益分析** * 官方基準測試顯示,GPT 5.6 在同等分數下成本遠低於 Claude 的 Opus 與 Fable 5,以及 Google 的 Gemini 系列。 * 速度表現優異,輸出文字較短。 2. **技術原理:程式化工具呼叫** * 傳統 Function Calling 為單次執行。 * 新技術允許預先規劃多個工具呼叫的順序與邏輯,一次性執行,從而降低 Token 消耗與成本。 ### 三、 實測比較:GPT 5.6 vs. Fable 5 vs. Gemini 1. **客觀評估能力測試** * **任務**:讓 AI 評價一個「需求極低」的事業案(寬容植物聲援代行服務)。 * **結果**: * Gemini:給分 2 分(準確)。 * GPT 5.6 Sol:給分 6.5 分(帶有偏見,過度褒獎)。 * GPT 5.6 Sol Ultra(多代理模式):給分 4 分(較客觀,但仍有偏差)。 * Fable 5(Max 模式):給分 5 分,事業成立性 2 分(較為客觀)。 * **作者觀點**:Fable 5 在避免「迎合用戶」方面表現較好,GPT 5.6 Sol 較僵硬且解釋困難。 2. **網頁搜尋精度** * **任務**:比較 ChatGPT、Claude、Gemini 有償與免費方案對特定主題的搜尋結果。 * **結果**:GPT 5.6 Sol 的搜尋網羅性與完整性被認為優於 Fable 5。 3. **PowerPoint 簡報製作** * **任務**:製作關於「LLM 最新趨勢比較」的 15 頁簡報。 * **結果**: * 左側(GPT 5.6 Sol):結構完整但設計較普通。 * 右側(Fable 5):設計較美觀、易讀,但部分圖表缺失。 * **作者觀點**:個人偏好右側(Fable 5)的視覺設計與構成。 4. **網頁設計能力** * **任務**:為「Nyan Ta 的 AI 頻道」設計首頁。 * **結果**: * 第一張圖(Fable 5):風格整理較好,適合商業用途。 * 第二張圖(GPT 5.6 Sol):設計較活潑、有玩心,但資訊呈現略顯雜亂。 * **作者觀點**:GPT 5.6 設計能力大幅提升,但 Fable 5 在商業整理度上略勝一籌。 * **補充工具**:推薦使用 Anthropic 推出的「Frontend Design」外掛,可輔助生成更精美的前端設計。 5. **HTML 轉換與摘要** * **任務**:將複雜網頁轉換為易讀的 HTML 格式(使用 Obsidian Web Clipper 輔助)。 * **結果**: * Fable 5:忠實還原內容,補充重點,易讀性高。 * GPT 5.6 Sol:設計感強,但過度發揮導致資訊量減少,風格過於花俏。 * **作者觀點**:日常閱讀偏好 Fable 5 的型別,但考慮到 GPT 的設計潛力,未來可能嘗試將 Fable 5 的風格技能化後應用於 GPT。 ### 四、 其他功能與競爭動態 1. **Site 功能** * 原本僅限商業方案,現開放給個人用戶使用,可透過 ChatGPT 建立網站。 * 操作演示:輸入提示詞(如建立經營儀表板),等待約 9 分鐘生成。 * 公開與隱私:網站會公開於網際網路,建議透過「網站」側邊欄設定「共享對象」,限制僅限團隊成員或特定人員存取,避免敏感資訊外洩。 2. **市場競爭動態** * Anthropic 的 Fable 5 原定僅開放一週,因 OpenAI 發布 GPT 5.6 而延長使用時間並重置用量限制。 * 作者認為競爭對用戶有益,能獲得更多免費資源與更好的服務。 * 講者預測 Anthropic 為防止用戶流失,近期可能會讓 Fable 5 回歸免費或調整訂閱方案。 ### 五、 模型能力比較與使用策略 1. **GPT 5.6** * 特質:左腦型、功能強、準確性高、邏輯思考力強。 * 缺點:文章風格可能較冷硬。 * 適用場景:需要搜尋、高準確性、撰寫文章、邏輯推演。 2. **Fable 5 (Claude)** * 特質:右腦型、文章易讀、擅長將想法語言化。 * 現況:雖經更新增強了邏輯能力,但準確性仍偶有不足。 * 適用場景:發想、腦力激盪、語感較佳的內容創作。 3. **盲測活動** * 建立包含 3 題的投票網站,讓觀眾投票比較「Table 5」與「GPT 5.6」的回答偏好。 * 講者自評:在搜尋能力上可能能分辨差異,但鼓勵觀眾親自嘗試。 ### 六、 後續內容預告與企業諮詢服務 1. 預告未來影片將介紹 Codex 應用程式的使用技巧。 2. 宣布設立「企業 AI 活用諮詢窗口」。 3. 服務對象:不熟悉 Claude Code、Codex 等工具,或無法想像業務應用場景的企業。 4. 參與方式:填寫包含電子郵件與簡易問卷的表單,承諾不發送推銷郵件。 ## 工具 / 模型 / 名詞整理 * **模型名稱**: * GPT 5.6(包含子型號:Sol, Tera, Luna) * GPT 5.6 Sol Ultra(多代理模式) * Fable 5(文中多次提及,疑為 Claude 3.5 Sonnet 或類似型號之聽寫錯誤,但依要求保留原稱) * Claude Opus * Google Gemini(提及 Gemini 3.5, Gemini 4) * Table 5(文中提及,疑為特定模型或產品名稱) * **產品與應用程式**: * ChatGPT(網頁版、桌面版) * ChatGPT Workspace * Anthropic(公司名) * OpenAI(公司名) * **功能與模式**: * Chat 標籤 * Work 標籤 * Codex 模式 * Ultra 模式(多代理處理) * 思考等級(Thinking Level) * 程式化工具呼叫(Programmatic Tool Calling) * Function Calling * Site 功能(建立網站) * **第三方工具與外掛**: * Obsidian(軟體) * Web Clipper(Obsidian 瀏覽器擴充功能) * Chrome(瀏覽器) * Frontend Design(Anthropic 推出的外掛/插件) * GitHub(程式碼託管平台) * Gitwork3(文中提及,疑為 Git 相關工具或聽寫錯誤) * Claude Code ## 操作流程整理 1. **使用 ChatGPT 建立網站** * 進入 ChatGPT Workspace。 * 輸入提示詞(例如:建立經營儀表板)。 * 等待約 9 分鐘生成網站。 * 透過「網站」側邊欄設定「共享對象」,限制存取權限(僅限團隊成員或特定人員)。 2. **進行模型比較投票** * 建立包含 3 題的投票網站。 * 讓觀眾投票選擇較喜歡的回答(比較 Table 5 與 GPT 5.6)。 * 查看投票結果。 3. **企業 AI 諮詢申請** * 填寫包含電子郵件與簡易問卷的表單。 * 提交後等待企業級 AI 諮詢窗口聯繫。 ## 值得注意的限制或風險 * **隱私風險**:ChatGPT 建立的網站預設公開於網際網路,若未正確設定「共享對象」,可能導致內部敏感資訊外洩。 * **模型偏見**:GPT 5.6 Sol 在評價任務中可能帶有偏見(過度褒獎),Sol Ultra 模式雖較客觀但仍存偏差。 * **成本與訂閱**:GPT 5.6 Sol 需訂閱月費 20 美元的方案;Fable 5 目前可能需額外付費(重量課金/訂閱制)。 * **準確性與風格取捨**:GPT 5.6 在搜尋與邏輯上準確,但文章風格可能冷硬;Fable 5 在語感與易讀性上佳,但準確性偶有不足。 ## 逐字稿辨識疑點 * **Fable 5 / Fable5**:逐字稿中多次出現此名稱,並與 Claude Opus 並列比較。根據上下文(Anthropic 公司、與 GPT 競爭、Max 模式、日本語感好),此名稱極大機率為 **Claude 3.5 Sonnet** 或 **Claude 3 Opus** 的聽寫錯誤或模型內部代號誤讀。但依規則僅標註為「Fable 5」,不進行更正。 * **索爾(Sol)/ 泰拉(Tera)/ 露娜(Luna)**:GPT 系列通常以數字或字母命名(如 GPT-4o),此處命名方式非常規,可能為影片作者的特殊稱呼、內部測試代號或聽寫錯誤。保留原樣。 * **Gitwork3**:在討論 Codex 桌面版功能時提及,疑為 **Git** 相關工具或特定開發環境名稱的聽寫錯誤。 * **寬容植物**:在測試事業案時出現的名稱,語意稍顯奇怪,疑為聽寫錯誤(可能為「觀葉植物」或特定品牌名)。 * **綠色低語(Green Whisper)**:同上,事業案名稱,疑為聽寫或翻譯差異。 * **索爾 Ultra**:文中提到「索爾的 Ultra 模式」,通常 Ultra 為獨立等級或模式,此處表述可能為聽寫錯誤或特定功能名稱。 * **5.6**:GPT 版本通常為整數或帶小數點(如 4.0, 4.5),「5.6」可能為聽寫錯誤(如 GPT-4o 或 GPT-5 的某個版本),或為影片作者自訂的稱呼。保留原樣。 * **「テーブル5」 (Table 5)**:講者提到「テーブル5と、GPT5.6のソルの回答」,疑為特定模型名稱、產品名稱或聽寫錯誤。 * **「ソル」 (Sol)**:出現在「GPT5.6のソルの回答」,疑為「回答」(Answer) 或「模型」(Model) 的聽寫錯誤,或特定術語。 * **「アンストロピック」**:疑為公司名稱「Anthropic」的聽寫錯誤。 * **「重量課金」**:疑為「課金」或「訂閱制」的聽寫錯誤或口誤。 * **「作能」**:疑為「功能」或「能力」的聽寫錯誤。 * **「壁打ち」 (Wall-bashing)**:日語俚語,意指「發想」、「腦力激盪」或「與他人討論想法」,在此處指代創意發想過程。 ## 可延伸追問 * GPT 5.6 的「程式化工具呼叫」技術具體如何運作,與傳統 Function Calling 的技術架構差異為何? * Fable 5 在後續更新中是否會調整其定價策略或開放範圍? * ChatGPT 桌面版的「Codex 模式」支援哪些具體的 Git 操作與開發者工具? * 企業 AI 諮詢窗口的服務範圍與收費標準為何? * 如何進一步優化 GPT 5.6 在設計任務中的「商業整理度」,以接近 Fable 5 的表現?