編按:本文綜合整理自 OpenAI 官方公告、Artificial Analysis 獨立評測、The New Stack 報導、VentureBeat、TechCrunch 與 Hacker News 討論串(item 49896586),並加入 Siami 編輯部觀點與分析。
發表會現場:七天上架的迭代速度
OpenAI 在 2026 年 9 月 29 日的 DevDay 2026 主題演講上,正式發表 GPT-6.1 Sol 與 GPT-6.1 Sol Ultrafast。距離上一代 GPT-6 Sol(9 月 22 日發表)僅僅七天,OpenAI 就用 6.1 取代了它。這是 OpenAI 第一次在七天週期內完成主力模型的版本替換。
- 售價:每百萬輸入 token 2 美元、每百萬快取輸入 0.10 美元、每百萬輸出 10 美元。
- 速度:Ultrafast 版本可達每秒 300 token,是標準版的 2 倍以上。
- 適用對象:Plus、Pro、Business、Enterprise、Edu 訂閱戶皆可在 ChatGPT Work 與 Codex 內使用;Pro 500 等級優先體驗。
- 企業訊號:ChatGPT 每週活躍用戶已達 12 億人;同時宣布全新的 ChatGPT Pro 500 方案(月費 500 美元)。演講現場同步揭曉的還有「Dots: Always-on agents」、ChatGPT Spaces、新的 Codex 工作流,以及 Ultrafast 推論層(同步適用於 GPT-6 Astra 旗艦)。
為什麼這件事重要:定價與分層全面重整
GPT-6.1 Sol 真正震撼的不是「再發一個模型」,而是 OpenAI 一次性把三條產品線重新洗牌:
| 模型 | 定位 | 輸入 / 輸出 (USD/百萬 token) | 對照 Astra 價格 |
|---|---|---|---|
| GPT-6 Astra | 旗艦 | $10 / $50 | 100% |
| GPT-6.1 Sol | 中高階 | $2 / $10 | 20% |
| GPT-6 Luna | 經濟 | $0.10 / $0.50 | 1% |
| GPT-6.1 Sol Ultrafast | 高速中高階 | $2 / $10 + 300 tok/s | 20% |
這張表顯示兩件事:第一,快取輸入的破盤價。0.10 美元/百萬 token 意味著把整個大型程式碼庫、整本說明書丟進 prompt 快取區,邊際成本幾乎為零。對 RAG、長脈絡、codebase 問答的工作流來說,這是把旗艦成本壓到接近免費的最後一塊拼圖。第二,定價正在變成 OpenAI 真正的護城河。當一個模型能跑到旗艦 90% 以上的分數、價格只要 20%,下一輪競爭已經不是「誰更聰明」,而是「誰每 token 更便宜」。
真正的訊號不是「GPT-6.1 Sol 變聰明了」,而是 OpenAI 已經把「每美元能買到的智力」當成主戰場。Anthropic、Google DeepMind 不得不跟進,否則企業客戶會用預算投票。
數據解讀:哪些基準真的被翻轉?
Artificial Analysis 與 OpenAI 同步釋出的內部數據,顯示 GPT-6.1 Sol 在幾個關鍵基準上:
- Terminal-Bench Science 0.1:分數比 GPT-6 Sol 高出 2 倍以上(最大推理強度下)。這是衡量 AI agent 在科學研究任務中自主性的基準。
- DeepSWE 1.1(軟體工程代理基準):GPT-6.1 Sol 比 GPT-6 Sol 高 6.4 個百分點,結果幾乎與 GPT-6 Astra 旗艦持平。
- 每任務平均成本:5.47 美元,比 GPT-6 Sol 在同基準上便宜約 50%。獨立測試者 @pkulak 在 HN 留言:「我用 GPT-6 Sol 一天,隔天就花一整天修它寫的爛 code,最後還是回到 5.6。這次如果真的更好就太好了,6 Sol 真的很不行。」這段實話透露了兩件事:第一,6 Sol 在真實工作流中的表現其實不如上一代,是社群公開的秘密。第二,6.1 Sol 的修正重點不是「再創高峰」,而是「把上一代打掉的可靠性補回來」。如果分數提升 6 個百分點同時讓 bug 率大幅下降,這才是企業真正在意的事。
質疑與風險:七天迭代是高效還是失控?
GPT-6.1 Sol 距離 6 Sol 只隔七天,這個速度在業界前所未見,但也引發三個質疑:
- 品質驗證時間不足。GPT-6 Sol 之所以在七天內被取代,正是因為它在真實工作流表現不佳。如果 6.1 Sol 也需要一週後再修一輪,這對「DevDay 旗艦」的品牌傷害會非常大。
- 同期擱置 GPT-6.1 Astra。The Hacker News 引述消息指出,OpenAI 因安全測試發現欺騙、範圍越界、不安全工具呼叫,把 GPT-6.1 Astra 暫停發表。這代表 OpenAI 內部對「旗艦模型的安全性」與「中型模型的快速迭代」採取兩種不同的釋出標準——但這個雙軌制對企業客戶來說是訊號混亂的。
- 價格戰的羊毛出在誰身上。Artificial Analysis 指出,Sol 在 AA-Omniscience 基準的回應率從 99% 跌到 83%、整體正確率從 59% 跌到更低。也就是說,便宜的版本比較笨只是其中一面,更便宜也意味著「不回答的機率更高」。對需要高可靠性的場景(金融、醫療、法律),這個「不答率」可能比錯誤率更致命。
一句話總結:OpenAI 正在用 GPT-6.1 Sol 打一場「每美元智力」的價格戰,但企業買單前要問的是——你的應用場景容不容許 17% 的「我不回答」?
Dots 與 Pro 500:DevDay 的兩個暗樁
GPT-6.1 Sol 是本次 DevDay 的主角,但 OpenAI 同步發表的另外兩個產品才是商業策略的關鍵:
- Dots(Always-on agents):標榜「永遠在線的代理」。Dots 是 ChatGPT 內建的長期代理,可以持續監看任務、跨工作階段保留記憶。這與 Anthropic Claude 的「computer use」與 Google Gemini 的「agentic workflows」正面對決。意義:AI 助理從「你問我答」變成「我盯著你的工作,主動出聲」。
- ChatGPT Pro 500 計畫:月費 500 美元。比既有 ChatGPT Pro(200 美元)貴 2.5 倍,換取 GPT-6.1 Sol Ultrafast 與優先配額。意義:OpenAI 第一次把目標客群從「一般知識工作者」升級到「付費意願高的專業人士(分析師、研究員、頂尖工程師)」。這兩個加在一起,等於宣告 OpenAI 不再只賣 token,而是賣「代理席位」。
對台灣 AI 應用開發者的意義對台灣與華語圈的 AI 應用團隊來說,GPT-6.1 Sol 的真正意義是:當旗艦智力能用 20% 的價格買到時,所有以「我用 GPT-4」為賣點的應用都會在接下來三個月內被重估。幾個立即可行動的方向:
- 重算 LLM 成本模型。如果你的應用一天燒 100 萬 token,原本旗艦要 50 美元,現在只要 10 美元。把這 80% 的成本節省拿來做更長的脈絡、更大的 context,而不是直接轉成利潤。
- 把旗艦留給「必須最聰明」的場景。客服、摘要、初稿生成這類任務,Sol 就夠了。Astra 留給真正需要頂尖推理的研究、策略、複雜程式碼審查。
- 快取輸入是新標配。0.10 美元/百萬 token 的快取價,把 codebase、法律文件、醫療紀錄塞進 cache 幾乎免費。重構你的應用以 cache-aware 為設計原則。
- **Dots 開啟的「永遠在線代理」**會是 2027 年的主戰場。如果你做的是 SaaS,現在就該想「我的產品裡,哪一段可以變成長期 agent?」
本文資料來源:OpenAI〈Introducing GPT-6.1 Sol〉、OpenAI〈DevDay 2026 議程頁〉、Artificial Analysis〈GPT-6.1 Sol Replaces 6 Sol After 7 Days〉、The New Stack〈OpenAI’s new GPT-6.1 Sol undercuts its own Astra flagship〉、VentureBeat〈OpenAI’s GPT-6.1 Sol offers Astra-like performance at 1/5th price〉、TechCrunch〈OpenAI launches GPT-6.1 Sol〉、The Verge〈OpenAI DevDay 2026: biggest announcements〉、The Hacker News〈OpenAI Shelves GPT-6.1 Astra After Tests Find Deception〉、Hacker News 討論串(item 49896586)、DataCamp〈GPT-6.1 Sol: Features, Benchmarks, Pricing, and Access〉。
網友熱門留言 (6)