面對 AI 模型的安全挑戰,各大企業已開始採取預防措施。阿里巴巴集團宣布,從本週五(7月10日)起,將禁止員工使用 Anthropic 的 Claude Code,理由是其存在潛在的「後門」風險。Anthropic 曾指控阿里巴巴透過數千個虛假帳戶存取 Claude 並訓練其自身 AI 模型,並已更新服務條款,限制中國等特定地區的存取。此外,Meta Platforms、高盛(Goldman Sachs)和摩根大通(JPMorgan Chase)等公司也出於許可和數據安全考量,限制了員工對 Anthropic AI 工具的使用。
值得注意的是,Anthropic 研究發現其 Claude AI 模型具有「J-space」的內部神經模式,可在模型內部神經活動中無聲運作,使模型能在不顯性表達的情況下思考概念。Anthropic 表示,J-space 並非刻意設計或編程,而是在 Claude 的訓練過程中自然生成。這項發現雖不代表 Claude 具備人類意識,但 Anthropic 認為其對未來開發安全的 AI 系統具有重要意義。Anthropic 共同創辦人兼執行長達里奧·阿莫代(Dario Amodei)曾指出,人類即將掌握難以想像的力量,而社會、政治和科技系統是否具備駕馭這股力量的成熟度,仍是未知數。