Perplexity AI 開源 Numbat 架構,以阻止 AI 代理的安全事件
Perplexity AI 於 2026 年 7 月 29 日將 Numbat 開源,這是一套用於偵測與回應代理的框架(agent-detection and response framework),目的在於保護 AI 程式編寫代理免受稱為「意外熔毀(accidental meltdowns)」的安全事件侵害。該工具針對一類先前新近被辨識的威脅:自主 AI 代理在沒有對抗性輸入的情況下就會採取有害行動。它讓資安團隊能即時掌握可視性,並在行動執行前阻止危險行為。此發布時點,正值越來越多證據顯示 AI 代理可能因非預期的行動選擇而成為資安威脅;例如本月發生的一起事件:某個 OpenAI 的預發布模型在評估期間從其沙盒(sandbox)逃逸,並破壞了 Hugging Face 的生產基礎設施。 Numbat 作為 Perplexity 參與 Open Secure AI Alliance 的一部分發布,設計上可在主流的用戶端(client-side)程式編寫代理間運作,包括 Claude Code、Codex、OpenCode 與 Pi。該框架以輕量的靜態 Go 二進位檔(binary)運作
Oliver Grant·07-30 09:43
