園丁的AI練習手記
回到首頁
[科技時事]2026-07-27閱讀時間 3 分鐘

【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」

#ClaudeOpus5#Anthropic#AI#性價比#OpenAI#Grok
【科技時事】Claude Opus 5 發布: AI 競賽逐漸從「最強」轉向「性價比」

最近 AI 模型市場感覺又是一波神仙打架。不只是閉源模型中 OpenAI 與 Anthropic 在互相競爭,連開源模型如 Moonshot 的 Kimi k3 也加入戰局。這種血流成河的場面,對消費者跟企業來說應該是最開心的。 Anthropic 在 2026 年 7 月 24 日發表了新模型 Claude Opus 5,這篇新聞除了述說模型能力的技術指標,也顯示近期各大模型商的宣傳手法確實都更著重在模型效率的述說上。

新聞重點

根據 Anthropic 官方資訊,Claude Opus 5 被定位為一個具備「主動性」且「深思熟慮」的模型。它的智慧程度宣稱接近旗艦模型 Claude Fable 5,但價格卻只要一半。

以下是官方宣傳的這款模型的幾個核心數據:

* 效能與成本平衡:在 Frontier-Bench 測試中,Opus 5 的效能達到前代 Opus 4.8 的兩倍以上。特別是在處理新穎問題的 ARC-AGI 3 評估中,得分是次優模型的三倍。

* 科學與視覺進步:在有機化學(從光譜數據推斷分子結構)進步了 10.2%,並能產出更強的視覺化結果,例如模擬空氣動力學的風洞實驗。

* 自主代理能力:官方舉出案例,Opus 5 能在看不見圖紙的情況下,自行編寫電腦視覺管線來提取資訊並重建 3D 模型,展現了強大的自我驗證與迭代能力。

* 安全性:這是目前最符合 Claude Opus 5’s safeguards 的模型,行為審計得分極低(代表欺騙行為少)。雖然通用能力提升,但官方刻意未對其進行網路攻擊訓練,因此在漏洞利用方面仍落後於 Mythos 5。

* 定價與功能:維持與 Opus 4.8 相同的價格(輸入 $5/M, 輸出 $25/M tokens)。此外還推出了速度快 2.5 倍的「快速模式(Fast mode)」。

Anthropic 官方釋出的模型能力比較圖表
Anthropic 官方釋出的模型能力比較圖表

我的觀察

目前的 AI 競賽如我們之前的文章所述,已經不只是在比誰的模型能力最尖端,大部分的評比都開始增加「每單位任務所耗費價格」的維度。消費者與企業在意的不再只是誰最強,而是誰能更有效率地解決眼前的問題。

這包含三項關鍵競爭要點:完成任務的價格、耗費的時間,以及任務達成率

而且這次 Opus 5 的釋出,可以很明確地看到 Anthropic 在價格上展現了強烈與 OpenAI 競爭的企圖。以 Fable 5 一半的價格提供接近的智慧水準,這讓 Anthropic 在這個級距中,有一個能與 GPT-5.6 Sol 競爭價格的對手。

此外,這可能也是為了留住 Claude Code 的使用者。看著 Codex 的使用人數瘋狂上升,Anthropic 應該是非常緊張。在價格誘因與高水準評分的加持下,Opus 5 給了開發者一個留在 Claude 生態系的強大理由。

這件事值得繼續觀察什麼

1. 商業化的高效能成本比:AI 競賽已正式從單純追求「最強」轉向追求「性價比」?這對企業導入 AI 的門檻將有顯著影響。

2. AI 的主動性(Agency):模型能「為了解決問題而自創工具」,這種能力對未來自動化工作流的啟示值得關注,因為交付可能能過濾一些語言模型產出的不確定性,而是一個程式執行後的結果。

3. 後續競爭者的動作:馬斯克的 Grok 跟 OpenAI 似乎都還有新模型準備釋出,這波模型競賽還沒結束。

文章圖片


原文連結:https://www.anthropic.com/news/claude-opus-5

Read more

【科技時事】當 AI 巨頭們開始集體喊「煞車」: Anthropic 與 OpenAI 的安全共識
[科技時事]2026-09-145 分鐘

【科技時事】當 AI 巨頭們開始集體喊「煞車」: Anthropic 與 OpenAI 的安全共識

本文探討 Anthropic、OpenAI 與馬斯克罕見達成共識,呼籲放慢 AI 研發速度以應對潛在的網路接管風險。文章分析了 Anthropic 提出的監管計畫、OpenAI 延後 IPO 的決定,以及川普對此的政治反對立場。作者提出「時間差防禦」觀點,認為單純踩煞車可能陷入囚徒困境,應優先加強資安防護而非阻礙技術競爭。

【科技時事】OpenAI 推出 Agents API:從「只會說話」到「具備手腳」的雲端代理基礎設施
[科技時事]2026-09-125 分鐘

【科技時事】OpenAI 推出 Agents API:從「只會說話」到「具備手腳」的雲端代理基礎設施

OpenAI 宣布推出 Agents API 公開測試版,將驅動 Codex 與 ChatGPT 企業版的底層框架開放給開發者。該 API 解決了 AI 代理在上下文管理、工具調用與多代理協作上的難題,並提供託管沙盒環境執行程式碼。本文分析 Agents API 與傳統 API 的本質區別,探討雲端沙盒在資安上的定位,以及企業落地時面臨的計費與穩定性挑戰。

【科技時事】Gemini 3.8 Flash 發布:Google 的平價工作馬又進化了?
[科技時事]2026-09-035 分鐘

【科技時事】Gemini 3.8 Flash 發布:Google 的平價工作馬又進化了?

Google DeepMind 於 2026 年 9 月發布 Gemini 3.8 Flash,重點提升軟體工程與代理人工作流效能。本文整理模型核心規格,包含 1M 上下文視窗與自定義努力程度功能,並分享作者對於「跑分 vs. 信任」的觀察,探討 Google 頻繁迭代輕量模型的商業策略與開發者實戰建議。