# 影片筆記:OpenAI最新AI「GPT-5.6」「ChatGPT Work」が登場!Claude Fable 5との比較や新機能を解説してみた ## 一句話總結 影片介紹 OpenAI 發布的新型品牌「GPT 5.6」(含 Sol、Terra、Luna 模型)及介面重構(Chat/Work 分離),並透過實測比較 GPT 5.6 與 Claude 新模型(影片稱「Fable 5」或「Feble 5」),指出 GPT 在搜尋準確性與成本效益上優異,而 Fable 5 在設計美感與文章閱讀體驗上具優勢。 ## 核心重點 * **新品牌與模型**:OpenAI 推出新型品牌「GPT 5.6」,包含三個級別的模型: * **Sol**:最高級別(太陽),需訂閱 20 美元以上方案;Pro 方案(100 美元以上)可使用 Sol 的「Pro 模型」並享有更高回應速度。 * **Terra**:地球級別。 * **Luna**:月亮級別。 * **介面與功能重構**: * **網頁版**:分為「Chat」(提問、搜尋、快速回覆)與「Work」(研究、分析、文件製作)兩個標籤。 * **桌面版**:新增「Codex」模式,支援 Git Worktree 及存取本地檔案。 * **Ultra Mode**:Work 模式下的多 AI 代理(Multi-agent)處理模式。 * **Site 功能**:可生成並分享互動式網站(如經營儀表板),目前個人用戶公開需注意隱私設定。 * **技術亮點**: * **Programmatic Tool Calling**:允許事先以程式方式規劃工具呼叫順序,再一次性執行,提升成本效益與效率。 * **實測比較結果(GPT 5.6 vs. Fable 5)**: * **事業案評估**:GPT 5.6 Sol 傾向褒揚,Sol Ultra 較中立;Fable 5 (Max) 評價較準確。 * **簡報與設計**:Fable 5 在視覺設計、美觀度與易讀性上勝出;GPT 5.6 在搜尋資訊準確性(如訂閱數數據)上勝出。 * **結論**:講者認為 GPT 5.6 在搜尋準確性與成本效益上表現優異,但 Fable 5 在文章閱讀體驗與設計美感上仍有優勢。 ## 詳細大綱 ### 一、 GPT 5.6 新型品牌與模型介紹 * **模型名稱與含義**: * **Sol**:太陽,最高級別。 * **Terra**:地球。 * **Luna**:月亮。 * **訂閱與使用條件**: * Sol 模型:需加入月費 20 美元的 ChatGPT 方案。 * Pro 方案(月費 100 美元以上):可使用 Sol 的「Pro 模型」。 * 回應效能:20 美元方案為「High」,100 美元以上方案可達「Extra High」。 * **應用案例**: * 北海道農家利用 GPT 5.6 開發自動捲起塑膠大棚側面以進行換氣的機械裝置,強調非工程師也能透過熱情完成開發。 ### 二、 技術背景與效能比較 * **Programmatic Tool Calling(程式化工具呼叫)**: * 傳統 Function Calling 為語言模型逐一執行並使用結果。 * 新技術允許事先以程式方式規劃工具呼叫順序,再一次性執行,從而降低成本並提高效率。 * **基準測試(Benchmark)結果**: * GPT 系列在成本效益(橫軸為成本,縱軸為分數)上表現優於 Claude 的 Opus 與 Fable 5。 * Fable 5 在圖表中僅有一個數據點,推測其「Effort Level」為自適應(Adaptive),若使用 Max 等級可能分數會更高。 * Google 的 Gemini 模型在測試中相對落後。 ### 三、 介面與功能架構變更 * **網頁版(Web App)結構**: * 分為兩個主要標籤:**Chat** 與 **Work**。 * **Chat**:用於提問、搜尋、快速回覆、短時間對話。 * **Work**:用於研究、分析、文件製作、試算表、簡報等工作場景。 * **桌面版(Desktop App)結構**: * 新增 **Codex** 模式,可存取電腦本地檔案(如 MyWorkspace 資料夾)。 * **Work 模式**:類似網頁版,用於專案管理。 * **Codex 模式**:開發者專用,具備 Git Worktree 等功能。 * **Work 模式詳細設定**: * 可選擇模型:Sol、Terra、Luna。 * **思考層級(Thinking Level)**:Pro 方案可設為 5 階段。 * **Ultra Mode**:非單純思考層級,而是使用多個 AI 代理(Multi-agent)進行處理的模式。 * 專案管理:透過「選擇專案」來管理對話歷史與工作內容。 ### 四、 實測比較:GPT 5.6 vs. Fable 5 * **測試情境 1:事業案客觀評估** * 輸入一個需求較低的「觀葉植物聲援代行服務」提案。 * **Gemini**:給分 2/10。 * **GPT 5.6 Sol**:給分 6.5/10,傾向褒揚(如命名好),缺乏中立性。 * **GPT 5.6 Sol Ultra**:給分 4/10,評估較中立(企劃與話題性 8/10)。 * **Fable 5 (Max)**:給分 5/10,指出事業成立性僅 2/10,評價較準確。 * **測試情境 2:PowerPoint 簡報製作** * 主題:LLM 最新趨勢比較報告(Claude, GPT, Gemini)。 * **左側(GPT 5.6 Sol)**:內容完整但設計較普通。 * **右側(Fable 5)**:設計較美觀、易讀,構成類似「30分鐘了解當前三強」。 * 講者偏好右側(Fable 5)的可視化與設計感。 * **測試情境 3:網頁設計(前端)** * 主題:製作「Nyan Ta AI Channel」首頁。 * **Fable 5**:設計整理較好,適合商業用途。 * **GPT 5.6 Sol**:設計較活潑,但講者認為在搜尋正確資訊能力上 GPT 勝出(訂閱數數據準確性)。 * **建議插件**:使用 Anthropic 官方推出的「Frontend Design」插件可提升設計品質。 * **測試情境 4:HTML 轉換與閱讀體驗** * 將英文長文轉換為易讀的 HTML 格式。 * **Fable 5**:資訊保留完整,理解度高,講者認為適合日常使用。 * **GPT 5.6 Sol**:設計感強,但有時過度創意導致資訊減損。 * 講者計劃將 Fable 5 的處理方式技能化後應用於 GPT 5.6。 ### 五、 新功能:Site 功能 * **功能描述**: * 原本僅限商業計劃,現開放給個人用戶。 * 在 ChatGPT Work 中透過「@Site」插件使用。 * 可根據指令(如輸入虛構銷售數據)生成互動式經營儀表板網站。 * 生成時間約 9.5 分鐘。 * **注意事項**: * 網站會公開於網際網路。 * 建議透過設定限制訪問對象(目前可能僅團隊計劃的工作區可設定)。 * 個人用戶公開資訊時需謹慎。 ### 六、 模型使用體驗與比較(第二段重點) * **工具選擇與比較**: * 作者傾向於使用「Fable 5」進行發想與壁咚(Brainstorming),認為其適合右腦型思考。 * GPT 系列被形容為左腦強,具備高準確性與邏輯力,但文章風格較冷硬。 * Claude(Fable 5)被形容為右腦強,擅長語言化與易讀性。 * **功能恢復預測**: * 「Fable 5」目前可能因訂閱制被移除而導致用戶流失,預測 Anthropic 會盡快恢復該功能。 * **後續規劃與服務**: * 作者表示將繼續介紹「Codex」等工具的使用方式。 * 宣布將設立企業級 AI 諮詢窗口,協助不熟悉業務應用或缺乏內部專家的人員,強調僅透過電子郵件與簡易問卷進行諮詢,無營業郵件,旨在協助業務效率化。 ## 工具 / 模型 / 名詞整理 * **模型/產品名稱**: * **GPT 5.6**:影片提及的新型品牌/模型系列。 * **Sol**:GPT 5.6 中的最高級別模型(太陽)。 * **Terra**:GPT 5.6 中的模型(地球)。 * **Luna**:GPT 5.6 中的模型(月亮)。 * **Fable 5 / Feble 5**:影片對 Claude 新模型的稱呼(疑點:實際應為 Claude 3.5 Sonnet 或類似版本,但影片稱 Fable 5)。 * **Opus**:Claude 系列中的高階模型。 * **Gemini**:Google 的模型系列(提及 Gemini 3.5, Gemini 4)。 * **ChatGPT**:OpenAI 的聊天機器人產品。 * **Codex**:ChatGPT 桌面版中的開發者模式/功能。 * **Work**:ChatGPT 中的工作模式標籤。 * **Chat**:ChatGPT 中的對話模式標籤。 * **Ultra Mode**:GPT 5.6 Work 模式中的一種多 AI 代理處理模式。 * **Site**:ChatGPT 中用於生成網站的功能/插件。 * **Obsidian**:提及的知識管理軟體,內含 Web Clipper。 * **Chrome**:瀏覽器。 * **GitHub**:程式碼託管平台。 * **Anthropic**:Fable 5 的開發公司。 * **Claude Code**:Claude 的程式碼工具。 * **技術/概念名稱**: * **Programmatic Tool Calling**:程式化工具呼叫技術。 * **Function Calling**:傳統函數呼叫技術。 * **Multi-agent**:多代理模式。 * **Effort Level**:努力層級(Fable 5 的設定選項)。 * **Frontend Design**:Anthropic 推出的前端設計插件。 * **Git Worktree**:Codex 模式中的開發功能。 * **壁打ち(Wadachi)**:日語詞彙,意指發想、對談或腦力激盪。 ## 操作流程整理 1. **訂閱與模型選擇**: * 訂閱 ChatGPT 方案(20 美元或 100 美元以上)。 * 在 Work 模式下選擇模型(Sol, Terra, Luna)。 * 設定思考層級(Pro 方案可設為 5 階段)。 2. **使用 Site 功能生成網站**: * 在 ChatGPT Work 中輸入指令。 * 使用「@Site」插件。 * 輸入數據(如虛構銷售數據)。 * 等待約 9.5 分鐘生成互動式經營儀表板網站。 * 設定訪問限制(若為團隊計劃)。 3. **實測比較流程**: * 輸入相同提示詞(如事業案評估、簡報製作、網頁設計)。 * 分別使用 GPT 5.6 Sol/Sol Ultra 與 Fable 5 (Max)。 * 比較輸出結果的準確性、設計美感與中立性。 4. **企業諮詢流程**: * 透過電子郵件發送簡易問卷。 * 接收諮詢回覆(無營業郵件)。 ## 值得注意的限制或風險 * **Site 功能公開風險**:生成的網站會公開於網際網路,個人用戶需注意隱私設定,目前可能僅團隊計劃的工作區可設定訪問限制。 * **Fable 5 訂閱狀態**:影片提及 Fable 5 目前可能不在訂閱範圍內,或原本只能用一週,因 ChatGPT 發布而延長,存在功能恢復的不確定性。 * **GPT 5.6 Sol 中立性不足**:在事業案評估中,GPT 5.6 Sol 傾向褒揚,缺乏中立性,需使用 Sol Ultra 或依賴 Fable 5 以獲得更準確評價。 * **資訊減損風險**:GPT 5.6 Sol 在設計感強時,有時會因過度創意導致資訊減損。 ## 逐字稿辨識疑點 * **「GPT 5.6」**: * 逐字稿多次提及「GPT 5.6」,並描述為「新型品牌」。目前 OpenAI 官方主流版本為 GPT-4 系列或即將發布的 GPT-4o 等,「5.6」可能為聽寫錯誤、內部代號、或影片製作者的特定稱呼。 * **「Fable 5」或「Feble 5」**: * 逐字稿將 Claude 的新模型稱為「Fable 5」或「Feble 5」,並提及「Opus」。實際 Anthropic 的模型系列為 Claude(如 Haiku, Sonnet, Opus)。「Fable/Feble」可能為「Sonnet」或「Fast」的聽寫錯誤,或為影片製作者的誤稱。 * **「ソル(Sol)」、「テラ(Terra)」、「ルナ(Luna)」**: * 影片明確指出這三個新模型分別代表太陽、地球、月亮。需查證 OpenAI 是否正式發布以此命名的模型系列。 * **「ウルトラモード(Ultra Mode)」**: * 影片描述此模式為「複數的 AI 進行處理」的多代理模式。需查證此功能是否為 GPT 5.6 的正式名稱或功能描述。 * **「ニャンタ(Nyan Ta)」**: * 影片提及「ニャンタのAIチャンネル」(Nyan Ta AI Channel)作為測試案例,可能為影片創作者或特定頻道的暱稱。 * **「1週間しか使えない(只能用一週)」**: * 影片提到 Fable 5 原本只能用一週,但因 ChatGPT 發布而延長。此為影片中的特定敘述,需視為影片內容的一部分,不確定是否為真實情況。 * **「重量下記」**: * 語意不明,疑為聽寫錯誤,可能意指「無料化」或「無料化下記」等相關詞彙。 * **「作能的」**: * 語意不明,疑為聽寫錯誤,可能意指「創造的」或「作業的」等相關詞彙。 * **「動畫」**: * 在「今後の動畫で紹介」中出現,疑為「動画」(影片)的聽寫錯誤。 * **「お會いしましょう」**: * 日語詞彙,疑為「お会いしましょう」(再會)的聽寫錯誤。 ## 可延伸追問 * GPT 5.6 的 Sol、Terra、Luna 模型是否為 OpenAI 官方正式發布的名稱? * Fable 5 是否為 Anthropic 即將發布的 Claude 新模型代號? * Programmatic Tool Calling 技術如何具體降低 API 呼叫成本? * Site 功能生成的網站在隱私保護方面有哪些具體技術限制? * Ultra Mode 的多 AI 代理架構如何協調不同代理之間的任務分配?