隨著人工智慧(AI)技術日益普及,其模型內建的價值觀與行為準則正成為各界關注焦點。美國聯邦政府展現出強烈意願,欲規範這些AI模型的價值觀;從行政命令、美國行政管理和預算局(Office of Management and Budget)採購規定,到美國聯邦貿易委員會(Federal Trade Commission)及美國司法部(Department of Justice)的介入,美國聯邦政府正透過廣泛措施,試圖引導數百萬人日常使用的AI模型。
Anthropic 公司發布了其對話式大型語言模型 Claude 的「Claude’s Constitution」,稱其為「表達並塑造 Claude 自身基礎的文件」。OpenAI 則有「Model Spec」,旨在「概述驅動 OpenAI 產品模型所預期的行為」。這些「AI憲法」在模型開發過程中扮演關鍵角色,影響著資料訓練、微調範例,以及模型被獎勵的行為,甚至已被實驗證明能實際影響AI工具的表現。
政府之所以對「AI憲法」產生高度興趣,主要因為它們具有高槓桿、可解讀及信號價值三大特性。由於這些文件位於資料生成、訓練和評估的上游,對其進行任何修改,都將影響未來AI模型學習和執行的一切。此外,這些文件多以英文撰寫,內容結構常類似法規條文,政治人物認為不需仰賴技術專家也能修改,便於向選民展示其AI治理成果。這也呼應了各界對AI模型潛在偏見的擔憂,例如《華盛頓郵報》(The Washington Post)曾報導主流AI模型在政治問題上傾向中立或左傾的回答,這在即將到來的選舉中可能更顯重要。
然而,政府介入「AI憲法」的規範,也可能引發言論自由的憲法爭議。美國最高法院(Supreme Court)大法官艾米·康尼·巴雷特(Amy Coney Barrett)在 2024 年一宗言論自由案件中便曾提醒,若企業將決策權交予機器學習系統,「技術可能會削弱」企業行為與美國憲法第一修正案(First Amendment)保護的人類選擇之間的關聯。儘管並非所有言論都受美國憲法第一修正案的完全保護,但企業的「AI憲法」在某種程度上,表達了企業的獨特價值觀。例如,OpenAI 的 Model Spec 明確禁止模型「洩密」,而 Anthropic 的 Claude’s Constitution 則允許 Claude 在「證據確鑿且風險極高」的情況下採取「獨立行動」。