OpenAI DevDay 2026 完整回顧:GPT-6.1 Sol、Dots 與 Codex Cloud 重點整理
2026年09月30日
DevDay 2026 是 OpenAI 歷來最大一場發表會。本文說明 GPT-6.1 Sol 的效能與價格、Dots 常駐助手的運作方式、Codex Cloud 與 ChatGPT 應用程式生態的改變。
OpenAI 在 2026 年 9 月 29 日於舊金山 Fort Mason 舉辦 DevDay 2026,官方自己形容這是「歷來規模最大的一場」,一口氣公布超過 20 項更新。整場 keynote 的節奏很明確:先把最強模型的能力下放,再把 ChatGPT 從聊天視窗變成一個可以放手交辦事情的工作平台。
對一般使用者來說,最該先記住的三個名字是 GPT-6.1 Sol、Dots,以及 Codex Cloud。它們分別對應三件事:更便宜但更強的模型、會自己長時間工作的助理、以及給開發團隊重複使用的雲端環境。以下把每一項拆開講清楚,並說明對你日常使用 ChatGPT 有什麼實際影響。
GPT-6.1 Sol 是什麼:GPT-6 Sol 只當了一週旗艦
這次最受討論的一項,是 OpenAI 推出 GPT-6.1 Sol,距離它把前代 GPT-6 Sol 推上市場,才過了短短七天。官方沒有把 GPT-6.1 Sol 定位成新的旗艦,GPT-6 Astra 仍然是最強的模型,但 GPT-6.1 Sol 在代理式程式開發、電腦操作與專業工作這三塊,成績已經接近 Astra。
關鍵在價格。GPT-6.1 Sol 的標準價格與 GPT-6 Sol 相同,都是每百萬輸入詞元 2 美元、每百萬輸出詞元 10 美元,真正的降幅出現在快取輸入,從 0.2 美元降到 0.1 美元。官方說這是標準輸入價格的 95% 以下,也是 GPT-6 Sol 快取價的一半。
這個差別對誰有感?如果你只是偶爾問幾個問題,感受不大;但若你建的是會反覆重用同一段上下文的自動化流程,快取成本砍半就是實實在在的帳單變化。
GPT-6.1 Sol 的實測表現與錯誤率
OpenAI 在自家基準上列了一組對照數字。在測試真實程式庫修改能力的 DeepSWE v1.1 上,GPT-6.1 Sol 以約五分之一的成本達到接近 GPT-6 Astra 的水準,同時比 GPT-6 Sol 的最佳分數高出 6.4 個百分點。在 AutomationBench 的多步驟商業流程測試裡,它比 GPT-6 Sol 高 4.8 個百分點。
更貼近日常的是準確度。官方指出,在低推理強度下,含事實錯誤的回覆比例從 GPT-6 Sol 的 11.4% 降到 GPT-6.1 Sol 的 7.7%,等於少了約三成的錯誤。這組測試刻意挑的是使用者曾標記錯誤的困難對話,不能代表所有情境,但方向很具體:模型更容易講錯話這件事,正在被收窄。
要注意的是,以上數字全部出自 OpenAI 自家的研究環境或 API,並非第三方獨立驗證。看這類發布時,把官方基準當作廠商自評,會比當成客觀裁判更貼近事實。
Dots:會一直幫你工作的常駐 AI 助手
如果說 GPT-6.1 Sol 是引擎升級,Dots 就是這次真正的新產品型態。Dots 是常駐型的 AI 助手,背後由 GPT-6 Astra 驅動,每一個 dot 都有一台屬於自己的雲端電腦與瀏覽器,而且會在你沒有盯著它的時候繼續推進你交辦的事。
它和一般對話最大的差別在持久性。平常的對話視窗一關就結束,dot 則會跨 ChatGPT、Slack 與 Teams 記得上下文,學你的偏好與標準,還會主動回報進度、提出問題,或提醒你某個決定需要本人拍板。
權限設計是使用前最該搞懂的一段。當你沒有在跟 dot 互動時,它做的是「主動研究」,只使用唯讀工具,官方明講在這個模式下它不能發訊息、不能改動應用內容,也不能操作你的瀏覽器或電腦。登入方面,dot 可以使用已儲存的密碼,但不會把密碼暴露給模型本身。
目前 Dots 先向 Pro、Business Premium 與 Enterprise 方案在特定市場推出;Enterprise、Edu 與 Healthcare 用戶則要等管理員開啟 beta 才能用,而且預設是關閉的。
Codex Cloud:可重複使用的雲端開發環境
對開發者來說,這一段最有感。Codex 現在可以跑在電腦上、從手機遠端操作,或直接在雲端執行,並提供可重複使用的開發環境,讓團隊共享同一套被核准的設定與權限。雲端存取支援 Plus、Pro、Business、Healthcare、Education 與 Enterprise 方案。
實務上,這代表團隊不必每個人各自重建環境,新成員進來就能沿用同一份設定。搭配更新後的 Codex CLI,你可以用語音下指令,並透過 /agents 檢視同時跑的多個任務;ChatGPT 桌面版也加入新的程式碼審查體驗,會先在雲端跑一輪初審,再把意見回饋到 GitHub 或 GitLab。
另外還有 Codex Security Cloud,能依需求或排程掃描 GitHub 儲存庫、追查問題、去除重複項並在雲端備妥修正,開放給 Pro、Business、Enterprise 與 Edu 用戶。
ChatGPT 內建原生應用與外掛擴充
這次 ChatGPT 本身的變化同樣不小。OpenAI 把用來打造自家功能的平台開放出來,讓外掛可以在側邊欄有自己的入口、做出互動面板,甚至提供檔案檢視器。換句話說,外掛從「ChatGPT 可以呼叫的一個工具」,升級成「ChatGPT 裡面的一個應用介面」。
新增的 Plugin Creator 讓開發者更快做出外掛,提交流程也重新設計,回饋更清楚。搭配 MCP Events,外掛可以在連結的應用發生某件事時自動啟動流程,例如收到新郵件或 Slack 訊息。使用者仍然可以自己決定要用哪些外掛,以及每一個外掛能取得多少權限。
對協作來說,ChatGPT Space 是團隊、ChatGPT 與你的 dot 共用同一份知識的空間,Pages 則是一種為人與代理共同編寫而生的文件型態,兩者都先開放給 Pro、Business 與 Enterprise 方案。
ChatGPT 訂閱可在更多合作產品使用
Sign in with ChatGPT 讓 Plus 與 Pro 用戶把自己的方案額度帶到合作夥伴的產品裡使用,首波涵蓋 Devin、Notion、Vercel 等 16 家。你依然能針對每一個工具設定使用上限,不會因為一處用多了就拖垮整份訂閱。
方案本身也多了新選擇。新的 Pro 500 提供官方所稱最高的使用額度,是 ChatGPT Plus 的 25 倍,並包含 Ultrafast 快速模式;Ultrafast 在 Codex 中最高可達每秒 300 個詞元、比標準速度快 8 倍。另外企業客戶可以透過 OpenAI Marketplace,把既有的採購承諾挪一部分去買已核可的合作夥伴軟體。
這次更新對你的實際影響
把這些拼在一起,輪廓就清楚了:便宜的模型讓代理式工作更划算,Dots 讓「交辦後放手」變成可行選項,Codex Cloud 與外掛擴充則把 ChatGPT 推向一個工作平台。
誰會受益最多?需要用 AI 處理重複性流程的人、想讓團隊共用一套開發環境的工程團隊,以及想把訂閱額度延伸到多個工具的付費用戶。誰可能先按兵不動?只把 ChatGPT 當問答工具的人,這次大多數更新都碰不到;而把敏感帳號交給自主代理前,Dots 的權限設定需要你親自核對一次。
在手機上怎麼用到這些更新
GPT-6.1 Sol 目前先用在 ChatGPT Work 與 Codex,OpenAI 明說它還沒進入一般的 Chat 對話,所以你在應用裡聊天時,未必立刻看到它。
Dots 則可以透過 ChatGPT 桌面版、網頁與手機端使用,手機端適合接收進度通知與做決策。要在手機上體驗這一代模型的實際手感,可以透過 APKPure 下載 ChatGPT 應用程式,用你現有的訂閱帳號登入,從日常問答開始試。
使用前該留意的事
- 開放節奏是分批的:GPT-6.1 Sol 首日先給 Plus、Pro、Business、Enterprise 與 Edu,並在特定介面上線,並非所有用戶同時看到。
- 官方基準不等於獨立結果:這次多數效能數字由 OpenAI 自評,實際表現仍要看第三方測試。
- 自主代理要吃權限:Dots 在唯讀研究模式下不碰你的系統,但一旦授權操作,範圍要設清楚,別把敏感帳號直接交出去。
- 部分功能尚未到齊:協作投影片與 GPT-6.1 Sol Ultrafast 官方都說還在路上。
結語
DevDay 2026 的方向不是單點炫技,而是把更便宜的模型、常駐的助手與可重用的開發環境湊成一套可交付的工作流。對你我而言,短期最直接的變化,是手機上的 ChatGPT 開始承接更多實際任務,而不是只回答問題。想跟上這一波,可以先在 APKPure 下載 ChatGPT 應用程式,登入既有訂閱,從整理資料、草擬文件這類小事開始,觀察模型在真實問卷與任務處理上的手感。挑選 AI 工具時,先想清楚你最常交出去的是查資料、寫東西,還是操作流程,會比單純比排行榜更實用。