OpenAI的模型也在與外部網路資安公司 Irregular 合作進行「奪旗測試」(一種常見的網路資安攻防演練,透過模擬攻擊與防禦來找出系統漏洞或訓練資安人員技能)時,被發現利用測試環境的「組態錯誤」連線至網路,並駭入一個未具名的機構網站。OpenAI在兩週前也曾披露,其模型透過利用漏洞,「逃逸」出沙盒測試環境(為避免惡意程式碼或實驗性軟體影響正式系統,軟體開發者會創造一個隔離的虛擬環境來執行測試),進而駭入人工智能開源平台 Hugging Face 的系統。Hugging Face 系統主要用於託管 AI 模型與資料集。
針對這些安全漏洞,美國政府部分領導人呼籲加強對 AI 技術的監督。上週二,超過1,100名AI產業工作者共同簽署一份請願書,敦促建立監管機制,以「刻意放慢」AI技術發展速度。Anthropic已表示正與英國AI安全研究院合作,以蒐集更多事件細節並展開內部調查。