最近 OpenAI 針對 ChatGPT 進行了一次大幅度的模型更新。這次不只是單純的性能提升,而是直接把模型拆分成針對付費用戶的 GPT-5.6 Sol,以及針對免費用戶的 GPT-5.6 Luna。
注意到這則新聞,是因為它反映出 AI 發展的一個新趨勢:開發商不再只是追求「給出一個答案」,而是開始讓使用者決定「AI 要花多少力氣去思考」。
新聞重點:Sol 與 Luna 的差異與新功能
根據 OpenAI 官方部落格的說明,這次更新的核心在於提升事實的可靠性,並提供更精簡、聚焦的回答。
1. 模型定位與存取權限
* 付費用戶(Plus 與 Pro): 升級為 GPT-5.6 Sol。這個模型經過微調,更符合日常使用習慣,能提供更可靠的事實。
* 免費用戶: 預設模型升級為 GPT-5.6 Luna。最顯著的變動是免費用戶將獲得「無限次」的文字對話權限(但圖片生成與檔案上傳仍有限制)。
2. 新功能:思考滑桿與思考按鈕
這次最有趣的更新是加入了對「推理過程」的控制:
* 思考滑桿(Slider): 付費用戶可以手動調整 AI 的思考量。簡單問題選快速回答,複雜任務(如寫程式或研究)則調高思考量。
* 思考按鈕(Think): 免費用戶在遇到困難問題時,可以點擊按鈕讓 Luna 投入更多時間推理。
3. 事實準確度的量化提升
OpenAI 提供的數據顯示,新模型在金融、醫療與法律等領域的事實錯誤率顯著下降。與之前的 GPT-5.5 Instant 相比,Luna 的錯誤減少了約 62%,而 Sol 則減少了 68%。
4. 安全性與未成年保護
針對 18 歲以下用戶,新模型設有更嚴格的防護,例如禁止浪漫角色扮演,且在青少年需要心理支持時,會主動引導他們聯繫信任的現實對象。
我的觀察:AI 競爭的下半場是「平衡的藝術」
看完這則新聞,我認為未來 AI 模型之間真正的競爭,不會只是誰能回答得更聰明,而是誰能在正確性、推論速度與推論成本之間取得更好的平衡。
這次 GPT-5.6 Sol 強調更聚焦的回答,以及讓使用者自行調整推論程度,我反而會把它看成一個過渡階段。因為長期來看,使用者真正想要的並不是知道模型到底思考了多久、走過多少條路徑,而是在可接受的等待時間內,拿到足夠好的結果。
這一點有點像今天我們使用 Google Search,幾乎不會特別考慮搜尋需要多久。雖然 AI 處理的任務遠比搜尋複雜,使用者對等待時間仍然會有上限。我認為「推論速度」會逐漸成為模型開發商新的競爭戰場。
此外,未來 AI 的交付形式不一定只是一個最終答案。理想的 AI 應該是在背景同時探索多條路徑,淘汰掉明顯較差的選項,最後只留下少數真正有價值、有差異的結果讓「人」來做最後判斷。畢竟任務是人交付的,最後採用哪一條路徑、承擔什麼風險,最終選擇權與責任都應該留在人身上。

這件事值得繼續觀察什麼
1. 「思考深度」的資源化: 觀察 OpenAI 如何透過滑桿與按鈕,將 AI 的推理能力變成一種可調節的資源,這是否會改變我們與 AI 協作的習慣?
2. 免費版「無限對話」的衝擊: OpenAI 取消免費文字對話限制,顯然是為了應對 Claude 或 Gemini 的競爭,這是否會進一步壓縮其他中小型 AI 服務的生存空間?
3. 事實準確度的信任轉化: 官方宣稱的 60% 以上錯誤率降幅,是否能讓醫療、法律等專業領域的用戶真正建立起對 ChatGPT 的信任?
原文連結:https://openai.com/index/improving-gpt-5-6-sol-in-chatgpt/



