Anthropic 的 Claude Sonnet 5.5 被打造為可靠的工作馬:吞吐量更快、每項任務成本更低,並在實際工作流程中展現更敏銳的代理能力。在 Terminal-Bench 4.0 上達到 70.6%,相較 Sonnet 5 有顯著提升,而 CursorBench 顯示其表現接近 Opus 5.5。結果是模型在程式碼編輯、文件潤飾和使用者介面設計建議上更迅速且果斷。重要的是,標記價格與 Sonnet 5 相同,但模型通常需要更少標記即可完成任務,因此您能在不調整預算或採購條款的情況下節省成本。
經濟效益至關重要。輸入成本約為每百萬標記2美元,輸出成本約為每百萬標記10美元,Sonnet 5.5 透過更少的重試、更少的工具調用和更少冗長的繞行來達成更多成果。在代理程式碼測試和企業試點中,這表現為更短的鏈條和更小的追蹤,降低了延遲和支出。團隊也反映對大型程式碼庫的理解更快,工具使用批次更佳,使長時間任務能在更少段落中完成。當您擴展到數百個持續整合檢查、支援巨集或資料清理工作時,整體每項任務成本差異會在數日內顯現,而非數季。
在 Anthropic 自家產品線中,Sonnet 5.5 是 Opus 5.5 的補充而非替代。Opus 仍在需要持續判斷的複雜開放式工作中領先,但 Sonnet 現在承擔更多範圍明確的任務:錯誤修正、結構化編輯、圖表解讀和簡報製作。與評估中分享的 GPT-6 Sol 參考相比,Sonnet 5.5 在關鍵程式碼與長期任務指標上具競爭力,且在相似努力下每項任務成本明顯較低。實務建議是:預設將常規工作導向 Sonnet 5.5,當面對細節、多重限制權衡或高風險推理時,則升級至 Opus 5.5。
在運營層面,Sonnet 5.5 也強化了安全防護。它搭載與 Opus 5 相當的升級網路安全措施,同時保留 Sonnet 5 的生物安全防護,並新增蒸餾防護以阻止大規模能力提取。對開發者而言,有兩點設置須注意:模型在主要雲端平台均可使用,且提供零資料保留選項;若您之前關閉了思考功能,則需採用 between_tools 設定以順利遷移。實務上,這可保持常規工作的快速迭代,同時確保高風險請求的對齊性。


