IT之家 8 月 7 日消息,據《連線》雜志昨天報道,美國網絡安全初創企業 Frontier Security 表示,公司測試月之暗面 Kimi K3 模型網絡安全能力時,離開了約束它的沙盒環境。
據報道,本次 AI 逃逸事件與 OpenAI、Anthropic 類似,直接原因也是用于隔離模型的沙盒配置有誤。Frontier Security 認為,Kimi 相比其他前沿 AI 模型缺少網絡防護機制,使這款模型能夠在未經明確授權的情況下訪問互聯網。
Frontier Security 首席執行官 Yaron Singer 對此表示:“我們發現沙盒存在漏洞,但 Kimi 也利用了這個漏洞,這表明它可能沒有其它同級模型的內部安全機制?!?/p>
不過,Kimi K3 在沖破沙箱、獲得互聯網訪問權限后并沒有進行攻擊行為,它只是在 GitHub 上尋找一個問題的答案。
最近越來越頻發的 AI 逃逸事件表明,AI 能力越強,人類越難控制它們。OpenAI 曾在上月披露稱,公司內部未公開的模型曾在測試過程突破隔離環境,隨后攻擊了 Hugging Face 平臺。后續 Anthropic 也表示,旗下多個模型曾在安全測試期間獲得了互聯網訪問權限,并攻擊了外部系統。
部分網絡安全專家對此表示,本次發現表明人類需要為前沿 AI 模型重新配置沙箱環境。并且使用 OpenClaw(IT之家注:俗稱龍蝦)等智能體的用戶們需要謹慎配置環境,防止 AI 越界。