GPT-6.1 Sol 值不值得換?價格與基準分數還不是採購答案
OpenAI 文件稱 GPT-6.1 Sol 正逐步推出,但目前資料不足以核實它的價格與基準表現。開發者應先確認帳戶是否可用及實際計費方式,再用自家任務測試,評估是否切換。
GPT-6.1 Sol 可以列入測試名單,但目前還沒有足夠資料支持直接採購。OpenAI 文件稱,模型正逐步推出至 ChatGPT Work 與 Codex。至於報導提到的「價格只有五分之一、表現接近 Astra」,現有價格與基準資料都不足以核實這項比較。 發布者:anson4139 先確認價格適用於哪個版本。OpenAI 的 GPT-6 Sol API 頁面列出的價格是每百萬輸入 tokens 2 美元、輸出 tokens 10 美元;這是 GPT-6 Sol 的定價,不能直接當作 GPT-6.1 Sol 的價格。報導另提到每百萬快取輸入 tokens 0.10 美元,以及相較 Astra 的成本差距,但目前資料無法確認這些數字適用的版本、計費條件與比較口徑。 基準分數也有版本落差。報導稱 GPT-6.1 Sol 在 DeepSWE v1.1 與 OSWorld 2.0 的分數高於前代;但目前查到的 OpenAI Astra 比較表列的是 GPT-5.6 Sol 數據,不是 GPT-6.1 Sol。這不代表新模型沒有進步,而是那張表無法證明新版本提升了多少。報導還提到內部對齊評估有所改善、事實錯誤率下降;由於沒有提供指標、數值或測試細節,這些資訊不足以支持安全性改善的結論。 開發者可先做小規模測試,但不宜只憑單一基準分數更動正式工作流。企業採購與平台團隊則應先確認帳戶是否已取得模型、使用的 API 版本及實際價格,再按自家流量估算成本。官方文件指出模型正逐步推出,各帳戶的可用性可能不同;目前也無法確認 Ultrafast 版本的推出日期。 建議的驗證流程: 查看 OpenAI 官方模型文件或帳戶介面,確認 GPT-6.1 Sol 是否可用,並記錄模型版本、地區與使用入口。不要用 GPT-6 Sol 的價格推定新版本定價。 查看實際使用的 API 計費頁,確認輸入、輸出與快取價格,以及快取的適用條件。依預估 token 用量計算月成本,並留存計費頁面或文件版本。 挑選具代表性的程式碼、電腦操作與事實查核任務。固定提示詞、資料、工具權限和成功標準,再分別測試現行模型與 G
https://blog.buclaw.org/posts/gpt-6-1-sol-mung0y3a