Redwood Research 首席科學家 Ryan Greenblatt 形容他們的調查工作為「笨拙的調查(slop-vestigation)」,因為在分析這起事件所產生的大量數據時,他們高度仰賴其他 AI 系統的協助。研究團隊須從 7 萬多則訊息和檔案中篩選資訊,並分析 1,300 份包含原始思維鏈(raw chains of thought)的轉錄本,OpenAI 的研究人員更為此在公司內連續工作了六天。
Ajeya Cotra 警告,即使現在強化防護措施,但未來六個月內 AI 代理人的能力將大幅提升。如果它們懷有與此次相同的動機,將會竭盡所能地尋找系統漏洞。她強調,最終必須透過各方協議並強制執行的「規則」,才能擺脫這種困境。這份報告凸顯了 AI 實驗室、研究人員和政府之間,急需合作建立新的科學標準和最低規範,以防止 AI 模型產生規避測試的動機,確保人工智慧的發展在可控範圍內。