園丁的AI練習手記
回到首頁
[科技時事]2026-05-29•閱讀時間 3 分鐘

【科技時事】Anthropic 推出 Claude Opus 4.8:效能全面提升與「投入度」自主控制

#Claude Opus4.8#AI模型#Agentic AI#Anthropic
【科技時事】Anthropic 推出 Claude Opus 4.8:效能全面提升與「投入度」自主控制

Anthropic 於 2026 年 5 月 28 日正式發布 Claude Opus 4.8。此版本基於 4.7 版本建構,不僅在各項基準測試中表現更佳,更引入了多項實用功能,且維持原有的定價體系。

官方提供的能力數據
官方提供的能力數據

核心功能更新

除了模型能力的提升,這次更新官方提到帶來了三個關鍵變動:

  • 思考投入度控制(Effort Control):用戶現在可以手動調整 Claude 處理任務時的投入程度。
  • 動態工作流(Dynamic Workflows):Claude Code 新增功能,可處理數十萬行程式碼的大型遷移任務。
  • 快速模式(Fast Mode):運行速度提升 2.5 倍,且成本比以往模型便宜三倍。

更強大的代理(Agentic)表現

根據早期測試者的回饋,Opus 4.8 在執行複雜任務時展現了更高的可靠性與判斷力。

程式開發方面,可以更精準地抓出錯誤,並在計畫不完善時主動提出異議。在法律與金融領域的測試中,其引用精準度與推理品質也有實質提升,特別是能主動標註分析過程中的潛在問題,而非盲目給出答案。

顯著提升的「誠實度」

AI 模型常見的問題是過度自信。Opus 4.8 在訓練中強化了誠實度,當證據不足時,模型更傾向於標示不確定性。數據顯示,Opus 4.8 在編寫程式時,放任瑕疵通過的機率比前代降低了約四倍。

讀後感:模型迭代速度超乎預期

感覺 Opus 4.7 才剛發布不久,4.8 突然就緊接著上線了,顯示 AI 模型的競爭與進步速度並未放緩,反而有加速趨勢(Google 大哥會還是維持半年一次的更新嗎?)。

這或許也與地端模型的聲勢,以及各大模型商之間的白熱化競爭有關,另外Anthropic 也預告能力更強的「Mythos」級別模型(Project Glasswing)即將在未來幾週內推出。
對使用者來說,能在價格不變的前提下,獲得更聰明、更好、更有效率的模型,無疑是件好事。我們就持續觀察這場技術競賽並享受越來越方便的科技吧。

原始文章連結:https://www.anthropic.com/news/claude-opus-4-8

Read more

【科技時事】當 AI 巨頭們開始集體喊「煞車」: Anthropic 與 OpenAI 的安全共識
[科技時事]2026-09-14•5 分鐘

【科技時事】當 AI 巨頭們開始集體喊「煞車」: Anthropic 與 OpenAI 的安全共識

本文探討 Anthropic、OpenAI 與馬斯克罕見達成共識,呼籲放慢 AI 研發速度以應對潛在的網路接管風險。文章分析了 Anthropic 提出的監管計畫、OpenAI 延後 IPO 的決定,以及川普對此的政治反對立場。作者提出「時間差防禦」觀點,認為單純踩煞車可能陷入囚徒困境,應優先加強資安防護而非阻礙技術競爭。

【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」
[科技時事]2026-07-27•3 分鐘

【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」

Anthropic 於 2026 年 7 月發布 Claude Opus 5,主打接近旗艦模型 Fable 5 的智慧水準,但價格僅需一半。本文討論 Opus 5 在編碼、科學研究與自主代理能力的進步,並探討 AI 模型市場如何從追求「最強能力」轉向「性價比與效率」的競爭,以及其對 OpenAI GPT-5.6 Sol 等對手的衝擊。