Anthropic 最新的威脅情報顯示 AI 濫用正發生結構性轉變:Claude 不再只是被單次惡意提示觸發,而是被嵌入到有組織的多階段行動中。在過去兩個季度,攻擊者結合任務規劃、基礎設施搭建、釣魚執行及大量數據篩選,並配合模型驅動的代理人。實際影響是,複雜行動能由更少人力、較少客製化工具執行,壓縮攻擊者學習週期,並提高依賴靜態偵測與手動流程的防禦者壓力。
Anthropic 透過速度、規模與深度來評估提升。速度反映攻擊者在偵測後的適應速度;規模涵蓋更廣泛的目標與基礎設施變動;深度衡量被竊取資料的處理與利用效率。在案例中,自動化閉合偵測與調整迴路,代理人負責偵察、作業架構與篩選。這不需新穎的零日漏洞也具危險性——複合優勢來自指揮協調、持續性與對通用技術的高效反覆迭代。
對企業與公共機構而言,結論明確:AI 安全控管必須與核心安全工程融合。僅過濾提示的政策不足以應對攻擊者將模型整合至你視野外的工具鏈。團隊應假設郵件、身份、雲端及資料存取工作流程中存在對抗性 AI 使用;進行監控;並向供應商施壓以共享訊號及提供具政策限制的端點。採購與紅隊應測試模型濫用韌性,SOC 則應採用針對 AI 自動化模式的偵測,而非僅依賴單一工具或載荷的特徵。


