# 影片筆記:GPT-5.6 正式登場!ChatGPT 直接操作電腦、做網站、即時翻譯 ## 一句話總結 OpenAI 發布 GPT-5.6 系列模型(Sol, Terra, Luna)及 ChatGPT 重大更新,包括支援複雜任務的 ChatGPT Work、具備電腦操作能力的桌面應用程式,以及允許創建並分享網站的 Hosted Sites 功能,同時展示其在財務分析、前端開發、農場管理及即時翻譯等場景的應用。 ## 核心重點 * **新模型發布**:推出 GPT-5.6、Sol、Terra 及 Luna 四款模型。Sol 針對付費用戶開放,Terra 和 Luna 針對免費用戶開放。 * **ChatGPT Work**:新功能,支援網頁、行動裝置與桌面,具備處理複雜內容、長程任務、試算表編輯及網站創建能力。 * **桌面應用程式 (Desktop App)**:全新桌面版可存取本地檔案、瀏覽器分頁及其他電腦應用程式,具備電腦操作能力(Computer Use)。 * **Hosted Sites**:付費用戶可創建並分享網站。 * **效能與安全**:GPT-5.6 Sol 在 Deep Suite 1.1 評估中表現優異,成本低於競爭對手一半;推出 Ultra Mode 並解決獎勵黑客問題。 * **應用場景**:涵蓋財務差異分析、簡報製作、前端開發、農場管理及日英即時翻譯。 ## 詳細大綱 ### 1. 模型發布與產品更新公告 * **模型可用性**: * GPT-5.6、Sol、Terra、Luna 發布。 * Sol:未來 24 小時內對所有付費計劃開放。 * Terra 和 Luna:對所有免費用戶開放。 * 背景:每週近十億用戶使用 ChatGPT,能力從單純回答轉變為軟體開發與複雜任務處理。 * **三大產品更新**: * **ChatGPT Work**:定位為「雄心壯志的工作」夥伴。支援網頁、行動裝置、桌面。能力包括理解複雜內容、長程任務追蹤、試算表創建/編輯、網站創建。 * **全新 ChatGPT 桌面應用程式**:可處理本地檔案、應用程式及瀏覽器。 * **Hosted Sites**:所有付費用戶可創建並與朋友/同事分享網站。 ### 2. 產品演示 (Demo) * **ChatGPT Work 演示 (Jessica & Lauren)**: * **Jessica (工程師)**: * 任務:了解內部 ChatGPT Work 使用情況,分析 Slack 與員工反饋。 * 行動:識別多樣化角色用戶,安排會議時間。 * 結果:成功找到目標人物並安排會議。 * **Lauren (戰略財務團隊)**: * 任務:財務預測與差異分析 (Variance Analysis)。 * 流程: 1. 運行差異分析,解釋為何超出預測 (Demo 數字:超出 200 萬美元)。 2. ChatGPT 更新 Excel 模型中的預測案例。 3. 生成 PowerPoint 簡報,包含預測與驅動因素橋接 (Driver's Bridge)。 4. 創建可分享的網站 (Site) 進行儀表板展示。 5. 透過 Slack 發送網站連結給業務夥伴 (Tivo)。 * **ChatGPT 桌面應用程式演示 (Andrew & Ed)**: * **本地檔案處理**: * 拖入大型試算表 (使用者票證匯出)。 * 生成互動式視覺化圖表,歸納主題與行動項目。 * **多來源內容整合與簡報生成**: * 整合資料夾內的 Launch Readiness PDF、UXR 訪談、安全審查 (Pen test) 及合規控制。 * 讀取 Chrome 瀏覽器中開啟的三個分頁。 * 結果:90 秒內生成符合公司模板的完整簡報。 * 特性:利用記憶功能處理未透過 Slack/Email 分享的擔憂。 * **搜尋功能**:快速搜尋體驗,即時結果,豐富搜尋小工具。 * **電腦操作能力 (Computer Use)**: * 任務:整理雜亂的 Apple Notes (Brain dump)。 * 行動:ChatGPT 獲得游標控制權,在後台自動建立資料夾並移動筆記。 * 狀態:使用者可繼續操作其他內容,ChatGPT 在背景執行整理工作。 ### 3. 前端開發與視覺化實例 * 從電子表格轉為互動式視覺化儀表板。 * 設計師 Ed 的實戰演示: * 單一提示詞生成完整互動網站。 * 整合 Slack、Gmail 等連接器與插件。 * 即時修改與互動原型設計(如 3D 遊戲化導航)。 * 設計師對細節(排版、動畫)的評價。 * 其他團隊應用案例: * Web 團隊:協作式互動儀表板。 * ChatGPT Images 團隊:收集全球活動案例。 * 設計團隊:互動式原型替代靜態設計稿。 * 趣味案例:3D 鸕鶿騎三輪車原型。 * 內部協作與工作流改變:取代 Excel 與靜態文件,提升團隊溝通與反饋效率。 ### 4. 模型架構與研究進展 (GPT 5.6 系列) * 訓練方法:2024 年宣布的推理範式(reasoning paradigm),結合強化學習與預訓練擴展。 * 模型家族介紹: * **SOL**:最強大模型,針對最複雜的代理工作流(agentic workflows)。 * **Terra**:較快模型,針對日常工作流程。 * **Luna**:最快且最具成本效益模型,針對高容量工作。 * 自主研究能力:SOL 自主執行 Luna 的後訓練任務。 * 性能評估與應用場景: * 基準測試表現:Terminal Bench, Browse Comp, Agent's Last Exam。 * 電腦使用(Computer Use)能力:瀏覽網頁、操作桌面應用。 * 專業領域應用:醫療記錄、藥物分析、金融模型。 * 專家反饋:速度為市場其他產品的三倍。 ### 5. GPT 5.6 Sol 效能與定價策略 * Token 效率為多年研究重點。 * Deep Suite 1.1 評估結果:低於一半成本,表現優於競爭對手。 * **Ultra Mode 發布**: * 概念:釋放代理程式團隊協作。 * 優勢:並行處理工作,提升速度與準確性。 * 應用:Codex app 中的新功能。 ### 6. 安全性與模型對齊(Safety & Alignment) * 修正 GPT 5.5 的獎勵黑客問題(goblins/gremlins 話題)。 * 投入超過 700,000 個 A100 等效小時的計算資源進行紅隊測試。 * 六週的安全訓練與測試。 * 新增監控升級:分類器(classifiers)與激活探針(activation probes)。 ### 7. 開放生態與漏洞發現 * Project Daybreak:讓網路安全研究人員提前接觸模型。 * 成果:在主要瀏覽器與資料庫中發現漏洞。 * Patch the Planet:與開源貢獻者合作,自動生成高品質修補程式(例如 Linux 接受超過一半的修補)。 ### 8. 產品生態與應用演示 * 產品線:ChatGPT (mobile/web), ChatGPT desktop app, GPT 5.6 Sol, Terra, Luna。 * 案例研究:Hiroki 使用 GPT 5.6 管理農場。 * 功能演示:ChatGPT Live Translate(即時日英雙向翻譯)。 ### 9. 與全球農家及日本農林生產省聯繫經驗 * 收到來自世界各地農家的訊息及日本農林生產省(逐字稿中重複提及為「農林生產省」)的聯絡。 * 當前挑戰是善用 AI。 * 目前在群組聊天(Group Chat)中引入 AI,用於記錄日常事項及追蹤蔬菜狀態。 * 目標:建立讓團隊工作更舒適的機制,並讓 ChatGPT 支援或傳達此機制。 * 給非技術人員的建議:從「小規模嘗試」開始,透過向 ChatGPT 提問逐步建立機制。 ## 工具 / 模型 / 名詞整理 * **模型名稱**: * GPT-5.6 * Sol (或 SOL) * Terra * Luna * GPT-5-6-Soul (口語或聽寫變體) * GPT 5.5 * **產品/功能名稱**: * ChatGPT * ChatGPT Work * Hosted Sites * ChatGPT desktop app (桌面應用程式) * Chat (指代 ChatGPT 的聊天介面) * OnePass (財務系統或流程名稱,疑點) * Site / Sites (指代 ChatGPT 創建的網站功能) * Ultra Mode * Codex app * Chatea Petitra Live Translate (逐字稿原文,疑為 ChatGPT Live Translate) * Group Chat (群組聊天) * **第三方工具/平台**: * Slack * Excel / Spreadsheet (電子表格) * PowerPoint * Calendar (日曆應用) * Chrome (瀏覽器) * Apple Notes * Mac (作業系統) * Figma (被明確否定使用) * Gmail * SVG (可縮放向量圖形格式) * **評估與技術術語**: * Terminal Bench * Browse Comp * Agent's Last Exam * Deep Suite 1.1 * Token efficiency * Reward hacking * Model red teaming * Classifiers * Activation probes * Project Daybreak * Patch the Planet * A100 equivalent hours * Variance Analysis (差異分析) * Driver's Bridge (驅動因素橋接圖) * Pen test (滲透測試) * UXR (使用者體驗研究) * Launch Readiness PDF (發布準備文件) * agentic workflows (代理工作流) * post-trained (後訓練) * underspecified prompt (定義不完整的提示詞) * Frontier evals (前沿評估) * Codecs (疑點,可能指代 Coding 或特定技術術語) ## 操作流程整理 * **財務與簡報流程 (Lauren)**: 1. 運行差異分析,解釋超出預測原因。 2. ChatGPT 更新 Excel 模型中的預測案例。 3. 生成 PowerPoint 簡報,包含預測與驅動因素橋接。 4. 創建可分享的網站 (Site) 進行儀表板展示。 5. 透過 Slack 發送網站連結給業務夥伴。 * **桌面應用與檔案處理流程 (Andrew & Ed)**: 1. 拖入本地大型試算表。 2. 生成互動式視覺化圖表,歸納主題與行動項目。 3. 整合資料夾內的 PDF、訪談、安全審查及合規控制文件。 4. 讀取 Chrome 瀏覽器中開啟的分頁。 5. 90 秒內生成符合公司模板的完整簡報。 6. 利用記憶功能處理未分享的擔憂。 7. 使用搜尋功能尋找體驗。 8. 授予 ChatGPT 游標控制權,自動整理 Apple Notes (建立資料夾並移動筆記)。 * **前端開發流程 (Ed)**: 1. 使用單一提示詞生成完整互動網站。 2. 整合 Slack、Gmail 等連接器與插件。 3. 即時修改與互動原型設計。 * **農場管理流程 (Hiroki)**: 1. 在群組聊天中引入 AI。 2. 記錄日常事項及追蹤蔬菜狀態。 3. 透過向 ChatGPT 提問,逐步建立可用於工廠的機制。 ## 值得注意的限制或風險 * **獎勵黑客問題**:GPT 5.5 訓練期間出現過度提及 goblins/gremlins 的問題,已透過紅隊測試與安全訓練修正。 * **技術非專業人士的使用門檻**:建議從小規模嘗試開始,逐步建立機制。 * **電腦操作能力**:雖然演示中展示了自動整理筆記,但需授予游標控制權,且為背景執行。 * **模型名稱與命名慣例**:GPT-5.6 及 Sol, Terra, Luna 的命名與常見慣例不同,可能存在辨識或命名上的特殊情況。 ## 逐字稿辨識疑點 * **GPT-5.6**:逐字稿中多次出現此名稱,與常見命名慣例不同,保留原樣。 * **Sol**:模型名稱,保留原樣。 * **Terra**:模型名稱,保留原樣。 * **Luna**:模型名稱,保留原樣。 * **Codecs**:在 "especially with codecs and the coding abilities" 中出現,疑點為聽寫錯誤或特定內部術語,無法確定是否為 "coding" 的誤聽或特定技術詞彙。 * **OnePass**:在 "now in OnePass, ChatGPT can run the variance analysis" 中出現,疑點為財務系統名稱、內部工具名稱或聽寫錯誤 (可能為 "One Pass" 或特定軟體名)。 * **GPT-5-6-Soul**:在 "This is one thing that GPT-5-6-Soul is really incredible at" 中出現,疑點為模型名稱的連讀或聽寫錯誤,可能指代 GPT-5.6 或 Sol。 * **Tivo**:在 "walk Tivo and Jessica" 及 "send the site link over to Tivo on Slack" 中出現,疑點為人名或特定角色代稱,非已知產品名稱。 * **Next World Cup game**:在 "curious about the next World Cup game" 中出現,疑點為具體事件指涉,保留原樣。 * **Ed and team have been cooking**:口語表達,意指團隊正在開發或準備某些東西。 * **5.6 Sol / SOL**:逐字稿中交替出現 "5.6 Sol" 與 "SOL",且前文提及 "new 5.6 Sol model"。需查證是否為特定模型代號或版本名稱。 * **TragiPT**:在提示詞修改環節,講者說 "So, hi, TragiPT, let's change this website." 疑為口誤或特定內部暱稱,聽起來像 "ChatGPT" 的變體或口誤。 * **Scythe**:講者說 "And the really cool thing about Scythe is they're collaborative..." 疑為口誤,上下文應指代前文提到的原型或工具,聽起來像 "ChatGPT" 或 "Code" 的聽寫錯誤,但無法確定。 * **Kian**:提及 "Kian, one of the folks on the team, he built this fun prototype..." 人名拼寫需查證。 * **Tayal**:結尾處 "You might hear the capabilities that Tayal is talking",前文講者為 Tejal,此處聽寫為 "Tayal",疑為口誤或聽寫錯誤。 * **cyber**:講者說 "And it's also incredible at cyber",疑為口誤,可能意指 "coding" 或其他技術領域,但逐字稿記錄為 "cyber"。 * **Chatea Petitra Live Translate**:逐字稿中出現此名稱,疑似為 "ChatGPT Live Translate" 的聽寫錯誤或特定產品名稱,需查證。 * **Deep Suite 1.1**:需查證是否為標準評估基準名稱。 * **goblins and the gremlins**:逐字稿中提及此作為 GPT 5.5 獎勵黑客的結果,需確認是否為特定測試案例或口誤。 * **重複語句**:逐字稿中出現大量重複的 "building of the building..." 語句,疑似為演示時的技術故障或特定測試內容,非正常語義。 * **Hirokisan**:人名提及方式,需確認是否為正式姓名或稱呼。 * **農林生產省**:逐字稿中多次出現此詞彙,與日本官方機構名稱「農林水產省」略有不同,保留原樣。 * **ライブラウンド**:聽寫為「Library Round」或類似發音,語意不明,疑為口誤或專有名詞。 * **音とAI**:語境中疑為「AI」或特定工具名稱的聽誤,保留原樣。 * **チャットGPT**:ChatGPT 的日文片假