
研究人員揭露Google AI開發工具Antigravity重大漏洞,可能導致繞過沙箱防護遠端執行指令
資安公司Pillar Security研究人員近日發布報告,揭露Google的AI代理開發工具Antigravity存在提示注入(Prompt Injection)弱點,攻擊者可藉此繞過沙箱防護機制,進而從遠端執行惡意指令,此漏洞已向Google通報,並完成修補。
這不只是 Google 的問題啦——任何會處理外部提示的 AI 代理工具底下都可能藏著同樣的沙盒繞過弱點
你知道 ChatGPT 有時候會很篤定地說出完全錯誤的東西嗎?科學家們現在開發出一套新的測量方式,可以偵測大型語言模型(LLM)到底有多確定自己說的是對的。簡單來說就是,這個方法能幫你判斷 AI 是在唬爛還是真的知道答案。如果 AI 說某件事時信心滿滿,但這套新指標卻顯示它其實不太確定,那就是警訊——代表它可能在幻覺(hallucination)。這對想要在工作上用 AI 的人來說超重要,因為你終於可以知道什麼時候該相信它、什麼時候要自己查證。