
定價與性能:高性價比對標(biāo)競品
在定價方面,Opus 5 的輸入和輸出價格統(tǒng)一為每百萬代幣 2.5 美元。相比之下,F(xiàn)able 5 的定價為輸入每百萬代幣 10 美元、輸出每百萬代幣 50 美元;OpenAI 的 GPT-5.6 Sol 模型則為輸入 5 美元、輸出 30 美元。
盡管單價大幅降低,但評估實際成本還需考慮完成同一任務(wù)所需的代幣數(shù)量。據(jù) Artificial Analysis 數(shù)據(jù)顯示,在 " 智能指數(shù) " 任務(wù)中,各模型的加權(quán)平均成本分別為:Fable 5 為 2.75 美元,Opus 5(最大規(guī)格)為 2.03 美元,GPT-5.6 Sol(最大規(guī)格)為 1.04 美元,Kimi K3 為 0.95 美元。在智能指數(shù)得分上,Opus 5 以 61 分領(lǐng)先,僅比 Fable 5 高出 1 分。Anthropic 表示,Opus 5 在保持與前代 Opus 4.8 相同成本的前提下,實現(xiàn)了性能的大幅提升。
技術(shù)優(yōu)化:上下文擴容與回復(fù)風(fēng)格調(diào)整
通過對系統(tǒng)提示詞進(jìn)行精簡,Opus 5 為用戶留出了更多的上下文空間。Claude Code 工程師 Thariq Shihipar 透露,Anthropic 在新模型中移除了 80% 的 Claude Code 系統(tǒng)提示詞內(nèi)容。他建議開發(fā)者在編寫提示詞、技能指令及 CLAUDE.md 文件時同步進(jìn)行簡化,并可利用 `claude doctor` 命令輔助優(yōu)化。
值得注意的是,Opus 5 的默認(rèn)回復(fù)長度較前代模型有所增加。Anthropic 警告稱,若用戶不希望出現(xiàn)這種冗長風(fēng)格,需在提示詞中明確要求控制回復(fù)長度,否則可能面臨更高的費用支出。
安全與應(yīng)用:降低拒絕率,增強企業(yè)友好度
在開源代碼漏洞挖掘方面,Opus 5 表現(xiàn)強勁。在 OSS-Fuzz 基準(zhǔn)測試中,其得分為 80%,略高于 Mythos 模型的 79.4%。然而,在漏洞武器化利用方面,Opus 5 明顯較弱:14 次嘗試中僅成功 4 次,而 Mythos 的成功率高達(dá) 13/14。
系統(tǒng)卡片顯示,Opus 5 在代理編程、計算機使用和長周期知識工作領(lǐng)域的提升最為顯著,整體性能可與 Fable 5 媲美,部分場景下甚至超越 Fable 5 及 Claude Mythos 5。由于網(wǎng)絡(luò)分類器限制比例低于 Fable 5,Opus 5 在網(wǎng)絡(luò)安全和生物學(xué)任務(wù)中的拒絕率大幅降低,允許查找源代碼漏洞,但仍會阻止基于二進(jìn)制的漏洞掃描、滲透測試及漏洞利用生成。
為解決模型拒絕服務(wù)帶來的困擾,Anthropic 在 API 中引入了自動回退功能。當(dāng)請求被判定為過于危險而不適合由 Opus 5 或 Fable 5 處理時,系統(tǒng)將自動將其路由至能力較弱的其他模型,而非直接阻斷。官方稱,Opus 5 是 Anthropic 迄今為止 " 對齊度最高 " 的模型,最難突破安全護(hù)欄。此外,該模型支持無數(shù)據(jù)保留模式,進(jìn)一步提升了其對 enterprise 客戶的吸引力。
【星途科訊 圖文丨 LCC 首發(fā)于 ZAKER 科技,轉(zhuǎn)載請注明出處】