There is no item in your cart
Anthropic 近日正式發布了全新旗艦模型 Claude Opus 5。其市場定位相當明確——能力接近 Fable 5,價格卻僅需一半。此舉無疑為高端 AI 模型市場投下了一枚震撼彈。
核心效能數據一覽
Opus 5 在多項業界標準基準測試中表現亮眼:
| 測試項目 | Opus 5 分數 | 領先幅度 |
|---|---|---|
| Frontier-Bench | 43.3% | 超越 Fable 5 的 33.7% |
| GDPval-AA v2 | 1861 | 業界頂尖水準 |
| ARC-AGI-3 | 30.2% | 遠超 GPT-5.6 Sol 的 7.8% |
| OSWorld 2.0 | 70.6% | 電腦操作領域領先 |
| AutomationBench | 26.0% | 業務自動化表現優異 |
ARC-AGI-3:拉開差距的關鍵指標
其中最具話題性的,莫過於 ARC-AGI-3 測試的表現:
- Opus 5:30.2%
- GPT-5.6 Sol:7.8%
- Opus 4.8:1.5%
如此巨大的差距,顯示 Opus 5 在通用推理與任務遷移能力上有著顯著突破。
編程能力:Frontier-Bench 表現突出
在編程基準測試 Frontier-Bench 中,Opus 5 同樣展現領先姿態:
- Opus 5:43.3%
- Fable 5:33.7%
- GPT-5.6 Sol:34.4%
並非全面碾壓:其他領域的對手
值得注意的是,Opus 5 並非在所有項目皆屬第一:
- DeepSWE:GPT-5.6 Sol 表現更佳
- FrontierCode:Fable 5 略勝一籌
- 法律任務:Fable 5 領先
- 網絡攻擊利用能力:Mythos 5 仍屬最強
由此可見,Opus 5 的策略並非追求所有榜單第一,而是致力於在高端模型市場中取得最佳性價比位置。
定價結構
| 項目 | 價格(每百萬 tokens) |
|---|---|
| 輸入(Input) | NT$165 左右 |
| 輸出(Output) | NT$825 左右 |
定價與 Opus 4.8 維持不變,Fast 模式約快 2.5 倍,價格為基礎模式的兩倍。
市場定位分析
目前業界最熱烈的討論集中於以下三個問題:
- Opus 5 與 Fable 5 的實際差距究竟有多大?
- Claude Pro 用戶是否迎來重大利多?
- 它能否正面對抗 GPT-5.6 Sol?
從官方數據分析,答案漸趨清晰:Opus 5 或許並非最昂貴、最頂尖的選項,但絕對是目前最接近頂級能力、同時兼顧使用便利性與成本效益的解決方案。
總結
對於需要強大推理能力、編程輔助及複雜任務處理的企業與開發者而言,Claude Opus 5 的出現提供了一個極具吸引力的新選擇。其以不到頂級模型一半的價格,提供接近旗艦等級的效能,這種「性價比旗艦」的市場定位,預計將對當前 AI 模型競爭格局產生深遠影響。





