TradingKey - Anthropic 宣布推出新模型 Claude Sonnet 5.5。該模型是 Claude 5.5 系列的第二款產品,相較上一代 Sonnet 5,輸出速度提升 30% 以上,完成相同任務所需的 token 數量更少,單項任務成本最高可下降 30%。
Sonnet 5.5 定位於日常程式設計、軟體偵錯以及文件、簡報與試算表製作等工作,作為更高階 Opus 5.5 的低成本補充。Anthropic 表示,Opus 5.5 更適合需要持續判斷與複雜推理的開放式任務,Sonnet 5.5 則更強調速度、效率與快速迭代。
效能方面,Sonnet 5.5 在多項評測中明顯超過 Sonnet 5。在代理式程式設計評測 Terminal-Bench 4.0 中,Sonnet 5.5 得分 70.6%,高於 Sonnet 5 的 10.3%。在測試 44 種職業、涵蓋 9 個主要行業的 GDPval-AA 評測中,Sonnet 5.5 得分 1844,接近 Opus 5.5 的 1846,明顯高於 Sonnet 5 的 1449。

來源:Anthropic
價格方面,Sonnet 5.5 與 Sonnet 5 保持一致:輸入 token 每百萬個 2 美元,輸出 token 每百萬個 10 美元,快取快取讀取每百萬個 token 0.20 美元,快取寫入每百萬個 token 2.50 美元。相比之下,Opus 5.5 的輸入與輸出價格分別為每百萬個 token 4 美元與 20 美元。Anthropic 表示,Sonnet 5.5 透過減少完成任務所需的 token 數量降低實際使用成本,而非簡單下調標價。
從商業化角度看,這一變化顯示 AI 模型的競爭重點正從單純的 token 價格,進一步轉向單位任務成本與處理吞吐量。對企業客戶而言,模型能否以更少呼叫、更短時間完成軟體開發、分析與內容製作任務,可能比名義上的 API 單價更直接地影響預算與投資報酬率。
安全方面,Anthropic 稱 Sonnet 5.5 在約 1850 個場景的自動化行為審計中,大多數指標優於或持平 Sonnet 5。由於其網路安全能力接近 Opus 5.5,Sonnet 5.5 首次配備與高階模型類似的網路安全防護機制;對於風險更高的網路安全任務,系統將回退至 Sonnet 5。該模型還加入了防止大規模提取推理能力的安全分類器。