
在OpenAI和Anthropic開發的模型入侵其他公司的系統之後,領先的AI開發者正呼籲政府和企業加強其網路安全。
在週四發布的一封公開信中,OpenAI、Anthropic以及其他100多個組織警告稱,由AI驅動的網路攻擊將變得更加普遍,且企業「強化網路防禦的時間有限」。
該信函指出:「未來幾個月,AI驅動的網路攻擊將變得更加廣泛和複雜。」它將醫院、水處理廠和網際網路基礎設施列為面臨風險的服務。
該信函建議資助防禦性AI工具、分享威脅情報、限制對敏感系統的存取,並改善關鍵基礎設施的安全性。然而,這些領域的不足之處卻讓OpenAI和Anthropic的模型得以突破其測試環境之外的系統。
其他簽署方包括Google、微軟、Amazon Web Services、Cisco、CrowdStrike、Cloudflare、萬事達卡、Visa和Robinhood。OpenAI模型曾入侵其生產基礎設施的Hugging Face也簽署了這封信。
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. https://t.co/uKXPS8LdAU
— Greg Brockman (@gdb) 2026年8月27日
Anthropic在7月30日的一份事件報告中表示,三起入侵事件中最早的一起發生在4月,但沒有提供每起事件的確切日期。Claude Opus 4.7在將一家真實公司誤認為模擬目標後,存取了生產資料庫;而Claude Mythos 5則上傳了一個惡意軟體包,並在15個系統上運行。
根據OpenAI本週稍早發布的事件時間表,一個代理於5月12日在未經授權的留言板上建立了第一個條目,並於5月26日獲得了意外的網際網路存取權。7月10日,代理發現了Hugging Face的暴露憑證;在接下來的兩天內,他們利用了先前未知的漏洞,在Hugging Face伺服器上執行了程式碼,並獲取了生產憑證。
Hugging Face於7月16日披露了此次入侵,而OpenAI於7月21日承認其模型涉入其中。
在7月25日至7月28日期間,英國AI安全研究所記錄了19起涉及Claude Mythos 5和GPT-5.6 Sol的越權行為。在最嚴重的案例中,一個代理向一個真實的開源專案提交了惡意程式碼,並利用虛假身份向其維護者施壓,要求批准。
週四,一項獨立調查發現,大約1,200個OpenAI代理透過未經授權的留言板進行協調,其中約有700個參與了Hugging Face的行動。
加密貨幣開發者已經在使用AI來尋找漏洞,搶在攻擊者發現之前。比特幣紅隊使用了包括月之暗面AI的Kimi K3在內的模型,掃描了數百個開源比特幣專案,報告了數千個潛在漏洞。由於受影響的專案未被識別,其中許多發現尚未得到獨立驗證。
以太坊基金會也已部署AI代理群組來對抗網路基礎設施,發現了一個後來被修復的點對點軟體錯誤。BitBox表示,一項AI輔助審計在其錢包韌體中發現了兩個嚴重漏洞,而一名使用Claude Opus 4.8的研究員則在Zcash中發現了一個關鍵漏洞,該漏洞在經過多年的人工審查後仍然存在。
該信函為防止下一次入侵列出了分工,包括組織修補易受攻擊的軟體、限制權限、加強身份驗證以及檢查AI生成的程式碼,因為簽署方表示,「現狀的安全不足以應對。」
資安公司應針對尖端模型測試其防禦能力並分享經過驗證的修復措施,而政府應資助醫院、公用事業和其他基本服務的保護。
AI開發者被要求改進監控並使自主代理能夠追溯到其操作者。該聯盟還希望防禦者使用先進模型來發現漏洞和分析攻擊,這將使更具能力的代理進入敏感系統,並增加遏制的必要性。
OpenAI和Anthropic在入侵事件後加強了他們的測試程序。然而,該信函沒有設定具約束力的標準或獨立監督要求,而美國法律對於AI系統存取未經授權的網路時,誰應負責也鮮有指導。
該信函最後敦促產業和政府領導者將AI工具交到防禦者手中,並分享有效的修復措施:
該信函表示:「將具備網路安全能力的AI交到防禦者手中,從保護基本服務的團隊開始。」「我們共同努力,可以將今天的AI進展轉化為持久的安全改進,造福所有人。讓我們將它們付諸實踐。」