
研究人員揭露Google AI開發工具Antigravity重大漏洞,可能導致繞過沙箱防護遠端執行指令
資安公司Pillar Security研究人員近日發布報告,揭露Google的AI代理開發工具Antigravity存在提示注入(Prompt Injection)弱點,攻擊者可藉此繞過沙箱防護機制,進而從遠端執行惡意指令,此漏洞已向Google通報,並完成修補。
這不只是 Google 的問題啦——任何會處理外部提示的 AI 代理工具底下都可能藏著同樣的沙盒繞過弱點

你有沒有擔心過 ChatGPT 會被某些狡猾的提示詞騙到去做你沒有要求的事情?研究人員剛剛找到了一個方法,讓人工智慧模型在這方面表現得更好。這個方法叫做 IH-Challenge,基本上就是訓練 AI 優先執行來自信任來源的指令,而忽視那些試圖劫持它的隨意嘗試。想像一下,就像教你的 AI 助手學會分辨什麼時候有人在試圖欺騙它,什麼時候才是真正的合法請求。結果呢?模型變得更難被操縱、更安全可靠,而且真的會聽你的話,而不是被提示詞注入攻擊所迷惑。這很重要,因為隨著 AI 變得越來越強大,確保它遵循正確的指令就變成了關鍵問題。