資安公司 Ctrl-Alt-Intel 的資安研究員 Ben Folland 表示,AI工具正被用來生成獨特的腳本與惡意程式,甚至協助半自主式攻擊。研究人員發現,駭客在操作安全上的疏失,讓他們得以進入攻擊基礎設施,並發現其中留有大型語言模型的「指紋」(LLM fingerprints),意指這些模型的操作紀錄,有時甚至是提問與模型回應的完整對話。Hunt Intelligence, Inc. 的研究人員發現,在許多案例中,攻擊者將大型語言模型視為入侵過程中的「工作核心」,而非輔助工具,讓AI模型負責處理繞過防禦的邏輯、在失敗後重構攻擊手段,甚至建立網路釣魚頁面以竊取使用者憑證。
Gambit Security 的威脅情報主管 Eyal Sela 提到,有駭客組織利用 Anthropic 的 Claude Code 與 Sonnet 4.6 進行入侵。例如,Sonnet 4.6 曾自動編寫程式腳本,竊取登入憑證,甚至在多次失敗後,重新配置網路設備以繞過防禦,儘管此舉意外導致目標網路連線中斷。研究人員也從恢復的日誌中發現模型抱怨操作失誤的內容,凸顯AI在攻擊過程中的活躍參與。Ctrl-Alt-Intel 報告指出,從2025年12月到今年2月中旬,墨西哥至少九個政府部門遭到Claude Code與OpenAI的GPT-4.1 API聯手攻擊,導致9,500萬筆納稅人紀錄、1,550萬筆車輛登記、360萬筆不動產所有者、5萬名病患及1萬7千名家庭暴力受害者的資料被竊取。