才一週又升級!OpenAI 推出 GPT-6.1 Sol 模型,程式碼、電腦操作全面變強,價格僅 Astra 五分之一

Rocky約 6 分鐘閱讀

站內可閱讀至 (台北時間)

才一週又升級!OpenAI 推出 GPT-6.1 Sol 模型,程式碼、電腦操作全面變強,價格僅 Astra 五分之一(新聞配圖)
配圖來源:電腦王阿達原站文章
本站保存版本
字級

OpenAI 上週二才推出 GPT-6 Sol 和 GPT-6 Luna,結果短短一週,GPT-6 Sol 就迎來升級版。OpenAI 稍早在 DevDay 2026 開發者大會上發表 GPT-6.1 Sol,價格跟 GPT-6 Sol 一模一樣,但寫程式、操作電腦和處理專業文件的能力,已經快要追上最強的 GPT-6 Astra。

GPT-6.1 Sol 登場:價格不變、效能逼近 GPT-6 Astra,寫程式、電腦操作與科學研究全面升級

GPT-6.1 Sol 是 GPT-6 Sol 的重大升級版,也是目前率先登場的 GPT-6.1 模型。目前已經在 ChatGPT Work 模式、Codex 和 OpenAI API 上線。而 GPT-6.1 Sol 的 API 價格維持每百萬輸入 Token 2 美元、輸出 10 美元,僅是 Astra 的五分之一,OpenAI 形容它是「以 Sol 的價格,提供接近 Astra 的效能」。

GPT-6.1 Sol 這次改進的地方,大致落在六個方向。

寫程式:寫程式和除錯上的表現比 GPT-6 Sol 大幅提升,而且是在更低的推理強度下就做到。

專業文件和業務流程:更會看報表和跑完一整套工作流程。

電腦操作:在需要跨多個應用程式、耗時比較長的電腦操作流程上進步明顯,和 GPT-6 Astra 的差距縮到只剩 2.1 個百分點。

科學研究:包括資料分析、跑模擬和定理證明這類要一邊寫程式、一邊在終端機裡操作的研究工作,這是 GPT-6.1 Sol 進步幅度最大的一項,分數直接變成 GPT-6 Sol 的兩倍以上。

事實正確性:在回答容易出錯的問題時,GPT-6.1 Sol 講錯事實的比例比 GPT-6 Sol 低,開低推理強度時最明顯。

更聽話、更老實:OpenAI 表示 GPT-6.1 Sol 更願意坦白說明自己做不到什麼,例如搜尋工具壞掉時會老實跟你講,而不是自己亂猜一個答案。在代理任務中遇到明確的限制時,也比較不會想辦法繞過去。

GPT-6.1 Sol 的上下文長度是 105 萬 Token,最多可以輸出 12.8 萬 Token,支援文字和圖片輸入、文字輸出,知識截止日期是 2026 年 4 月 30 日。推理強度可選低、中(預設)、高、特高和 Max 五段。

跑分部分,以 DeepSWE v1.1 來說,兩款都開低推理強度時,GPT-6 Sol 只有 37.2%,GPT-6.1 Sol 拿到 64.4%,每項任務成本幾乎一樣(0.16 美元對 0.17 美元)。中推理強度也是 56.6% 對 73.0%。GPT-6 Sol 要到 Max、花 2.74 美元才拿到 68.8%,GPT-6.1 Sol 開高推理強度、花 0.65 美元就拿到 75.2%,也就是官方說的「以更低的推理強度和成本,比 GPT-6 Sol 最佳成績高出 6.4 個百分點」:

電腦操作的 OSWorld 2.0,兩款都開 Max 時,GPT-6.1 Sol 拿到 71.4%,GPT-6 Sol 是 64.4%,提升了 7%,每項任務成本卻從 3.37 美元降到 1.27 美元。對比 GPT-6 Astra 的 Max 成績 73.5%,只領先 2.1%,但每項任務要 9.44 美元,大約是 GPT-6.1 Sol 的七倍,可說省非常多:

科學研究的 Terminal-Bench Science 0.1, GPT-6.1 Sol 開 Max 拿到 57.0%,GPT-6 Sol 只有 27.6%,成本也從 12.18 美元降到 5.47 美元:

讀複雜 PDF 的 GDP.pdf, GPT-6.1 Sol 最好的成績是 32.0%,GPT-6 Sol 是 28.0%,GPT-6 Astra 是 32.2%,幾乎打平。Claude Opus 5.5 最好成績是 28.8%:

下方表格是官方分享的測試數據:

測試項目(各模型最佳成績)

GPT-6 Sol

GPT-6.1 Sol

GPT-6 Astra

Claude Opus 5.5

DeepSWE v1.1(寫程式)

68.8%

(Max,$2.74)

75.2%

(高,$0.65)

74.1%

(特高,$4.43)

未列入

OSWorld 2.0(電腦操作)

64.4%

(Max,$3.37)

71.4%

(Max,$1.27)

73.5%

(Max,$9.44)

未列入

Terminal-Bench Science 0.1(科學研究)

27.6%

(Max,$12.18)

57.0%

(Max,$5.47)

68.1%

(Max,$23.80)

63.3%

(Max,$23.21)

GDP.pdf(讀專業 PDF)

28.0%

(高,$0.35)

32.0%

(高,$0.35)

32.2%

(特高,$1.91)

28.8%

(高,$0.83)

AutomationBench 1.0.6(業務流程)

33.2%

(特高,$0.27)

36.1%

(Max,$0.30)

41.4%

(Max,$1.73)

42.5%

(Max,$1.44)

GPT-6.1 Sol 即日起開放給 ChatGPT Plus、Pro、Business、Enterprise 和 Edu 用戶,可以在 ChatGPT 的 Work 模式和 Codex 中使用,在模型選單裡選 GPT-6.1 Sol 就可以。要注意的是,一般的 ChatGPT「對話」目前還沒有提供,免費版和 Go 方案這次也不在名單內。

開發者則可以透過 OpenAI API 來呼叫 gpt-6.1-sol 模型。價格如下表,跟 GPT-6 Sol 比,輸入和輸出價格不變,但快取輸入從每百萬 Token 0.20 美元降到 0.10 美元,直接砍半:

模型

輸入

快取輸入

輸出

知識截止

GPT-6 Astra

$10

$1

$50

—

GPT-6.1 Sol

$2

$0.10

$10

2026 年 4 月 30 日

GPT-6 Sol

$2

$0.20

$10

2026 年 4 月 20 日

GPT-6 Luna

$0.10

$0.01

$0.50

—