OpenAI 推出 GPT-6.1 Sol!只要五分之一價格,就能用到接近 Astra 的能力

GPT-6.1 Sol

本文重點:GPT-6.1 Sol 是 OpenAI 推出的中階主力模型,主打寫程式、電腦操作與專業工作,能力接近旗艦的 GPT-6 Astra,API 價格卻只有五分之一,這次官方也把 Claude Opus 5.5 列入跑分對照。

2026 年 9 月 23 日才介紹過 OpenAI 的 GPT-6 Sol 與 Luna,時隔一週,OpenAI 在 2026 年 9 月 29 日的 DevDay 上又推出升級版的 GPT-6.1 Sol。GPT-6 Astra 是 OpenAI 最強的旗艦模型,但價格也高,這次的 Sol 升級版把重點放在「用更少的錢做到差不多的事」,在寫程式、電腦操作與專業工作上都逼近最強模型 Astra,成本卻只有五分之一左右。上一篇提到 OpenAI 沒有拿 Claude Opus 5.5 比較,這次官方直接把它列入對照,有興趣的讀者可以往下看跑分結果。

Anthropic 也在 2026 年 9 月 28 日推出全新 Sonnet 5.5,同樣主打成本上的改進,以更低價格做到接近 Opus 5.5 的效果。

GPT-6.1 Sol 是什麼?

GPT-6.1 Sol 是 GPT-6 Sol 的升級版,屬於 GPT-6 家族裡的中階主力模型,主打寫程式、電腦操作與專業工作。官方說明它在這些「代理型」任務上,表現接近旗艦的 GPT-6 Astra,但 API 價格只有 Astra 的五分之一。

GPT-6 家族目前的分工可以這樣看:

模型定位適合的工作
GPT-6 Astra旗艦模型大型複雜專案、進階科學與數學問題
GPT-6.1 Sol中階主力模型(本次更新)寫程式、電腦操作、專業工作、AI Agent 任務
GPT-6 Luna輕量平價模型摘要文件、擷取資料、快速問答等大量單純的任務

國外科技媒體 TechCrunch 也提到,OpenAI 這次沒有推出 GPT-6.1 Astra,原因在於內部測試時發現該模型有較高的欺騙傾向,以及未經授權自行執行任務的問題。因此目前最新的旗艦仍是原版 GPT-6 Astra,GPT-6.1 Sol 則成為這次更新的主角。

GPT-6.1 Sol 跑分表現:和 GPT-6 Astra、Claude Opus 5.5 比較

OpenAI 這次公布的成績,和上一版一樣強調「每項任務花多少錢」。從數字來看,GPT-6.1 Sol 在寫程式的 DeepSWE 上追平 Astra,電腦操作也只差 2.1 個百分點,成本卻大幅降低。

Gpt 6 1 sol 3.

和 Claude Opus 5.5 比較時,專業工作與商業流程自動化都領先,成本只要三分之一到一半。

Gpt 6 1 sol 7.

科學研究這一項 Astra 依然最強,如果要處理最困難的研究型任務,旗艦模型仍有優勢。

Gpt 6 1 sol 4.

事實正確性方面,官方在特高推理強度下測到的事實錯誤率為 4.1%,低於 GPT-6 Sol 的 4.5%,非常接近 Astra 的 4.0%,每項任務成本則比 Astra 低約 83%。要留意的是,這項測試使用的是使用者曾指出先前模型出錯的對話,屬於刻意挑選的高難度情境,一般使用時的錯誤更少見。

GPT-6.1 Sol 的安全與對齊表現

上一代 GPT-6 Sol 最受好評的改進之一,是遇到工具故障時會主動告知。GPT-6.1 Sol 延續這個方向,官方公布的對齊評估重點如下:

Gpt 6 1 sol 5.

其他方面,OpenAI 表示沒有觀察到 GPT-6.1 Sol 試圖繞過自動化安全審查,規避警告的表現接近 GPT-6 Astra,電腦操作的安全失敗率也低於 GPT-6 Sol。官方特別說明,這些評估刻意挑選具挑戰性的情境,並不代表一般使用下的失敗率。完整結果可到官方發表頁與系統卡查看。

GPT-6.1 Sol 要付費嗎?API 價格與 Ultrafast 極速版

在 ChatGPT 上,GPT-6.1 Sol 需要 Plus 以上的付費方案。開發者透過 API 使用時,標準價格與 GPT-6 Sol 相同,但快取輸入價格再降低,官方表示比標準輸入價格低 95%:

模型(每百萬 token)輸入快取輸入輸出
GPT-6 Astra10 美元1 美元50 美元
GPT-6.1 Sol2 美元0.1 美元10 美元
GPT-6 Luna0.1 美元0.01 美元0.5 美元

輸入與輸出價格是 Astra 的五分之一,需要反覆帶入大量上下文的 AI Agent 與寫程式工具,可以靠快取輸入省下更多費用。

Gpt 6 1 sol 6.

OpenAI DevDay 同一天還推出了 Ultrafast 極速版,OpenAI 表示 GPT-6 Astra Ultrafast 是全球速度最快的前沿模型,速度最高可達 GPT-6 Astra 的 8 倍(API 最高 6 倍)。GPT-6.1 Sol Ultrafast 則預計近期推出,能以接近 Astra 的智慧提供最高 8 倍的速度。極速版透過 API 提供,ChatGPT Work 與 Codex 則需要新推出的 Pro 500 或 Enterprise 訂閱,提供最高的用量額度。

如何使用 GPT-6.1 Sol?

使用管道可以依身分分成幾種:

使用者類型主要管道可用模型
Plus、Pro、Business、Edu 方案ChatGPT Work、CodexGPT-6.1 Sol
月費 500 美元的 Pro 級方案、EnterpriseChatGPT Work、CodexGPT-6.1 Sol、Ultrafast 極速版(Sol 版近期推出)
開發人員OpenAI APIgpt-6.1-sol
AWS 用戶Amazon BedrockGPT-6.1 Sol

一般使用者

Plus、Pro、Business、Enterprise 與 Edu 方案用戶,開啟 ChatGPT 後切換到 ChatGPT Work 或 Codex,就能在模型選單選擇 GPT-6.1 Sol(如下圖),但要注意的是目前一般的聊天模式(Chat)還沒有提供這個模型。常用 Codex 的話,可以用 CodexBar 在 Mac 選單列隨時查看額度與重置時間。

官方發表文中沒有提到免費方案可以使用 GPT-6.1 Sol,免費用戶目前仍以上一篇介紹的 GPT-6 Luna 為主。

Gpt 6 1 sol 2.

開發人員

透過 OpenAI API 呼叫時,模型名稱為 gpt-6.1-sol,目前已開放使用。已經在用 GPT-6 Sol 的服務,通常只要把模型名稱換成新版就能升級,標準價格不變,快取命中的部分還會更便宜。需要更快回應的即時型應用,可以評估 Ultrafast 版本,但價格約為標準版的 6 倍,要先算清楚成本。

企業與雲端平台使用者

企業可以透過 ChatGPT Business、Enterprise 方案使用。AWS 也在同一天宣布 GPT-6.1 Sol 在 Amazon Bedrock 正式開放,支援寫程式、除錯、電腦操作、多步驟工作流程、複雜程式碼庫分析與明確的提示快取。

總結

GPT-6.1 Sol 這次的重點在於「用五分之一的價格,換到接近旗艦的能力」。

寫程式與電腦操作追平或逼近 Astra,專業工作與商業流程自動化領先 Claude Opus 5.5,成本卻只有三分之一到一半,加上快取輸入降到每百萬 token 0.1 美元,對要大量跑 AI Agent 與寫程式工具的開發者相當划算。

一般用戶如果已經是 Plus 以上方案,可以在 ChatGPT Work 或 Codex 直接切換試試看;免費用戶則暫時還是以 GPT-6 Luna 為主,等後續是否開放再留意。我自己會先把日常寫程式的工作切到 GPT-6.1 Sol,遇到最困難的研究型任務再回頭用 Astra。

常見問題

GPT-6.1 Sol 要付費嗎?

ChatGPT 端需要 Plus 以上的付費方案,並在 ChatGPT Work 或 Codex 使用。透過 API 串接則依用量計費,每百萬 token 輸入 2 美元、快取輸入 0.1 美元、輸出 10 美元。

GPT-6.1 Sol 和 GPT-6 Sol 有什麼不同?

GPT-6.1 Sol 是升級版,價格相同,但在 DeepSWE 上比 GPT-6 Sol 最佳成績高 6.4 個百分點,電腦操作高 7 個百分點,事實錯誤率也從 4.5% 降到 4.1%。快取輸入價格同時降低。

GPT-6.1 Sol 和 GPT-6 Astra 差在哪裡?

Astra 仍是能力最強的旗艦模型,科學研究等最困難的任務表現最好。GPT-6.1 Sol 在寫程式、電腦操作與專業工作上接近 Astra,API 價格只有五分之一,日常開發與 Agent 任務選 Sol 比較划算。

為什麼我在 ChatGPT 找不到 GPT-6.1 Sol?

目前只在 ChatGPT Work 與 Codex 提供,一般聊天模式還沒開放,也需要 Plus 以上方案。

Ultrafast 極速版是什麼?

是速度最高可達 8 倍的版本,API、月費 500 美元的 Pro 級和 Enterprise 方案可用。GPT-6.1 Sol Ultrafast 預計在近期推出。

本資訊最後檢核於 2026 年 9 月。

探索更多來自 免費資源網 的內容

訂閱即可透過電子郵件收到最新文章。

Pseric

Pseric

「免費資源網」創辦人,自 2006 年起專注於網路資源、雲端服務與軟體評測,累積 20 年實測經驗,於免費資源網發表超過 7,000 篇教學文章,內容受國內外主流科技媒體引用。致力於透過深度測試,為使用者篩選安全且高品質的數位工具。