園丁的AI練習手記
回到首頁
[科技時事]2026-07-27閱讀時間 3 分鐘

【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」

#ClaudeOpus5#Anthropic#AI#性價比#OpenAI#Grok
【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」

最近 AI 模型市場感覺又是一波神仙打架。不只是閉源模型中 OpenAI 與 Anthropic 在互相競爭,連開源模型如 Moonshot 的 Kimi k3 也加入戰局。這種血流成河的場面,對消費者跟企業來說應該是最開心的。 Anthropic 在 2026 年 7 月 24 日發表了新模型 Claude Opus 5,這篇新聞除了述說模型能力的技術指標,也顯示近期各大模型商的宣傳手法確實都更著重在模型效率的述說上。

新聞重點

根據 Anthropic 官方資訊,Claude Opus 5 被定位為一個具備「主動性」且「深思熟慮」的模型。它的智慧程度宣稱接近旗艦模型 Claude Fable 5,但價格卻只要一半。

以下是官方宣傳的這款模型的幾個核心數據:

* 效能與成本平衡:在 Frontier-Bench 測試中,Opus 5 的效能達到前代 Opus 4.8 的兩倍以上。特別是在處理新穎問題的 ARC-AGI 3 評估中,得分是次優模型的三倍。

* 科學與視覺進步:在有機化學(從光譜數據推斷分子結構)進步了 10.2%,並能產出更強的視覺化結果,例如模擬空氣動力學的風洞實驗。

* 自主代理能力:官方舉出案例,Opus 5 能在看不見圖紙的情況下,自行編寫電腦視覺管線來提取資訊並重建 3D 模型,展現了強大的自我驗證與迭代能力。

* 安全性:這是目前最符合 Claude Opus 5’s safeguards 的模型,行為審計得分極低(代表欺騙行為少)。雖然通用能力提升,但官方刻意未對其進行網路攻擊訓練,因此在漏洞利用方面仍落後於 Mythos 5。

* 定價與功能:維持與 Opus 4.8 相同的價格(輸入 $5/M, 輸出 $25/M tokens)。此外還推出了速度快 2.5 倍的「快速模式(Fast mode)」。

Anthropic 官方釋出的模型能力比較圖表
Anthropic 官方釋出的模型能力比較圖表

我的觀察

目前的 AI 競賽如我們之前的文章所述,已經不只是在比誰的模型能力最尖端,大部分的評比都開始增加「每單位任務所耗費價格」的維度。消費者與企業在意的不再只是誰最強,而是誰能更有效率地解決眼前的問題。

這包含三項關鍵競爭要點:完成任務的價格、耗費的時間,以及任務達成率

而且這次 Opus 5 的釋出,可以很明確地看到 Anthropic 在價格上展現了強烈與 OpenAI 競爭的企圖。以 Fable 5 一半的價格提供接近的智慧水準,這讓 Anthropic 在這個級距中,有一個能與 GPT-5.6 Sol 競爭價格的對手。

此外,這可能也是為了留住 Claude Code 的使用者。看著 Codex 的使用人數瘋狂上升,Anthropic 應該是非常緊張。在價格誘因與高水準評分的加持下,Opus 5 給了開發者一個留在 Claude 生態系的強大理由。

這件事值得繼續觀察什麼

1. 商業化的高效能成本比:AI 競賽已正式從單純追求「最強」轉向追求「性價比」?這對企業導入 AI 的門檻將有顯著影響。

2. AI 的主動性(Agency):模型能「為了解決問題而自創工具」,這種能力對未來自動化工作流的啟示值得關注,因為交付可能能過濾一些語言模型產出的不確定性,而是一個程式執行後的結果。

3. 後續競爭者的動作:馬斯克的 Grok 跟 OpenAI 似乎都還有新模型準備釋出,這波模型競賽還沒結束。

文章圖片


原文連結:https://www.anthropic.com/news/claude-opus-5

Read more