資安研究人員在美國舉行、一年一度的 Black Hat USA 2026 資安大會上,揭露了一項名為「CoreBreak」的全新漏洞模式。這項漏洞針對人工智慧代理人(AI Agent,意指能自主執行任務的 AI 應用)的基礎設施,指出其結構性缺陷恐導致 AI 安全防護形同虛設,即使是傳統的模型層級防禦也無法抵擋。
由資安公司 Stealth 的研究員 Hedi Ingber 和 Aviyam Ivgi 發現的 CoreBreak 漏洞,核心在於 AI 代理人的「派發層」(dispatch layer,負責將 AI 模型的指令傳遞給外部工具執行的中介層)。在 Amazon Bedrock AgentCore、Google Agent Development Kit (ADK) 以及 Vercel AI SDK 等平台中,派發層會執行看似由模型產生的工具呼叫,卻未經驗證其來源的合法性。這使得攻擊者能繞過 AI 模型本身的系統提示詞和拒絕訓練,直接向工具下達指令,導致模型層的防護完全失效。
《Forkast》報導指出,CoreBreak 與傳統的「提示注入」(prompt injection,透過惡意輸入文字誘導 AI 產生非預期回應)攻擊不同。提示注入試圖操縱 AI 模型的判斷或輸出,而 CoreBreak 則是在派發層直接繞過模型,讓攻擊者能完全控制工具的執行。