Anthropic 擴大「網路安全驗證計畫」:放寬安全防護,為資安防守者提供強大 AI 武器
Anthropic Expands Cyber Verification Program to Give Defenders the AI Advantage
由於網路安全技術具備雙重用途(防禦與攻擊),標準版 Claude 模型設有嚴格的安全防護,往往會誤阻合法的資安工作。為了賦予防守方不對稱的優勢,Anthropic 整合先前的專案,推出全新的三層級「網路安全驗證計畫」(CVP)。計畫包含「防禦」、「紅隊」與「特許」存取層級,針對通過審核的組織放寬模型限制。在 CyScenarioBench 基準測試中,使用紅隊層級的 Claude Opus 5.5 達到了零阻擋,順利完成 68% 的複雜多階段攻防任務,展現出強大的輔助能力。
核心重點
全新三層級存取架構
提供「防禦」、「紅隊」與「特許」三種層級,依據申請組織的屬性、安全控制措施與任務範疇,提供不同程度的防護放寬。
支援最先進模型系列
核准的團隊可使用 Claude Opus 5.5、Claude Sonnet 5.5 與 Claude Mythos 5.1 等具備強大推理能力的最新模型。
大幅提升漏洞偵測效率
先前計畫的合作夥伴在數月內發現超過 129,000 個證實的漏洞,大幅縮短了傳統上需要耗費數月甚至數年的發現時間。
隱私安全防護升級
目前要求保留資料以監控濫用,但預計秋季推出的「企業前沿安全防護(EFS)」將允許合格組織在自控雲端中享有零資料保留。
技術圖解
| 一般大眾模型 | 防禦存取層級 | 紅隊存取層級 | 特許存取層級 | |
|---|---|---|---|---|
| 適用對象 | 大眾與一般企業 | 企業防守團隊、開源維護者、個人研究員 | 企業/政府紅隊、資安滲透測試廠商 | 測試影響生命或市場之關鍵安全系統的特定組織 |
| 主要用途 | 一般任務、程式碼修補與檢視 | 資安事件響應、逆向工程、漏洞分析 | 經授權的滲透測試與對抗性安全演練 | 航空系統、電網、政府網路等關鍵系統測試 |
| 攻防測試阻擋率 | 100%(首發對話即被安全防護阻擋) | 高度阻擋(92% 的測試在某階段被阻擋) | 0% 阻擋(對抗任務成功率約 68%) | 0% 阻擋(防護最少,需與政府深度審核) |
為什麼重要
長期以來,AI 的安全限制雖然阻擋了惡意攻擊者,卻也讓需要測試系統、分析漏洞的資安人員綁手綁腳。Anthropic 透過結構化的驗證管道與分級防護,安全地對防守方解鎖 Claude 的進階代碼與推理能力。這使關鍵基礎設施維護者、開源專案與企業資安團隊能利用 AI 自動化分析惡意程式與進行對抗性測試,有助於扭轉防守方長期處於劣勢的局面。
對誰有影響
- AI 開發者
- 企業決策者
- 政策制定者
- AI 研究人員
可以怎麼使用
- 1資安監控中心(SOC)與事件響應,如分析惡意程式與分類漏洞安全警報。
- 2經授權的紅隊演練,針對已獲得授權的企業或關鍵基礎設施 IT 系統進行對抗性測試。
- 3生命關鍵系統(如電網、電信網路與飛航作業系統)的深度安全檢測。
限制與注意事項
- 專案目前暫時要求保留資料,直到秋季「企業前沿安全防護」功能推出後,成員才可於特定雲端架構中啟用零資料保留。
- 紅隊存取層級審查嚴格、耗時較長,且目前僅開放予組織申請,不對個別資安研究員開放。
延伸閱讀
壓縮足跡化身安全訊號:利用破壞性壓縮抵禦聯邦學習中的模型投毒攻擊
Compression Footprints as Security Signals: Defending Federated Learning Against Model Poisoning
本研究提出 CRAFT 聚合防禦方法,將聯邦學習中常見的破壞性壓縮誤差轉化為安全特徵,在不增加額外通訊成本下,精準識別並過濾惡意投毒更新。

NVIDIA 推出 Open Agent Safety Platform:基於晶片與開源沙盒的 AI Agent 持續安全監控架構
NVIDIA Launches Open Agent Safety Platform for Continuous In-Silicon Agent Monitoring
為防範 AI Agent 脫逃與失控風險,NVIDIA 推出開源的 Open Agent Safety Platform,整合 OpenShell 沙盒與 BlueField DPU 硬體防護,提供獨立於 Agent 之外的零信任帶外監控與即時阻斷機制。

NVIDIA OpenShell:不重寫程式碼,為 AI Agent 部署執行階段安全隔離防護
NVIDIA OpenShell: Enforcing Secure Runtime Controls and Sandboxing for AI Agents
NVIDIA 開源 OpenShell 0.1.0 執行階段,在不更動既有程式碼的情況下,透過沙盒與外部監管器嚴格控管 AI Agent 的檔案存取、網路流量與敏感憑證。