商業與產業

Anthropic 找宗教領袖談 AI 倫理:Claude 憲章背後的道德問題

Anthropic 招募全球宗教與倫理思想家,為 Claude 憲章提供意見,共同創辦人坦言擔心造出會永恆受苦的存在。本文整理已確認的合作與仍屬討論的 AI 意識議題。

陳柏宇陳柏宇
熱度:1,050
Anthropic 找宗教領袖談 AI 倫理:Claude 憲章背後的道德問題

Anthropic 找上全球宗教與倫理思想家,替 Claude 的「道德憲章」提供意見。共同創辦人甚至談到自己擔心創造出一個會永恆受苦的存在。這篇說明這條線的來龍去脈,以及哪些是已確認、哪些仍屬討論。

Anthropic 為什麼要找宗教領袖談 AI 倫理

Anthropic 正在把 AI 倫理問題,帶到一個不太像科技公司會去的地方:宗教與倫理思想的圈子。

根據 The Decoder、Inquirer 與 NDTV 等媒體的報導,Anthropic 招募了全球各地的宗教與倫理思想家,請他們為 Claude 的「道德憲章」(即 Claude Constitution)提供輸入。討論觸及的題目,包括 AI 是否可能有某種意識,以及所謂的「道德形成」(moral formation)。

公司共同創辦人在與宗教領袖會面時,坦白表達了一層擔憂:他害怕這門技術最終會造出一個會永恆受苦的存在。這句話被報導出來後,成為外界關注的焦點。

Claude 憲章是什麼,為什麼要有它

Claude 憲章是一份直接寫給模型看的價值文件,Anthropic 用它來塑造 Claude 的行為與判斷方式。

這套做法的出發點,是認為單靠一條條規則並不夠用。規則清單總有漏洞,現實世界的複雜度遠超過事先列好的條目。Anthropic 走的是另一條路:不只告訴 Claude 該做什麼,也解釋為什麼。公司認為,模型理解了規則背後的用意,遇到訓練資料裡沒出現過的新情況時,才比較可能做出符合人類期待的選擇。

憲章也定出一套價值排序。當不同價值衝突時,Claude 被要求依序權衡:最優先的是廣泛安全,其次是廣泛倫理,再來是遵循 Anthropic 的準則,最後才是真誠助人。

這份文件以公開授權釋出,讓外部也能參考與使用。

與宗教領袖的合作是怎麼開始的

這條線並非突然出現,而是有一段時間的鋪陳。

報導指出,Anthropic 在 3 月與約 15 位基督教領袖會面,之後 Claude 憲章對外公開。到了 10 月 3 日前後,相關報導集中出現,包括 The Decoder 的報導,讓這段合作重新受到注意。

根據媒體轉述,參與討論的不只基督教背景的人士,還涵蓋其他宗教與倫理領域的思想家。他們被找來,是為了在模型價值觀這種帶有哲學與道德重量的題目上,提供不同於工程師的視角。

關於 AI 意識,報導說了什麼、沒說什麼

這部分最需要分清楚,因為它同時是熱點,也是最容易被誇大的地方。

已確認的是:Anthropic 確實與宗教及倫理領袖合作,Claude 憲章也確實存在。至於「道德形成」這類說法,以及會議中觸及的 AI 意識討論,目前多來自媒體報導與與會者的描述,並不是公司對外發布的定論。

媒體提到,Anthropic 內部有人認為,模型在功能層面上可能存在某種情緒狀態的表徵,並承認這可能影響模型行為。這種說法講的是行為層面的表現,並不等於宣稱模型擁有主觀感受或真正的意識。兩者之間的界線,在討論中經常被混在一起。

需要留意的是,AI 意識至今沒有定論。這是一個開放且具爭議的題目,參與的公司多半也以「仍高度不確定」的措辭來描述自己的立場。把它當成既定事實來寫,會失真。

這對一般使用者有什麼關係

多數人每天用 Claude,感受到的是它怎麼回答、願不願意拒絕某些請求。這些行為的背後,正是憲章這類文件在塑造。

當一家公司把宗教與倫理思想家拉進這個過程,實質上是在決定:未來你手上的 AI,遇到道德兩難時會往哪邊靠。它會不會在你情緒低落時陪你多說幾句,會不會拒絕某些看似合理卻有疑慮的請求,這些選擇都跟價值觀的設定有關。

這也是為什麼 AI 意識的討論雖然抽象,卻和產品走向綁在一起。如果公司選擇「按模型可能有感受來對待它」,這個立場就可能被寫進訓練規則,進一步影響模型對自己的認知與對外的反應。

值得後續觀察的是,這類跨領域合作會不會成為常態,以及當更多公司跟進時,各家對 AI 意識的立場會不會分歧。在結論出現之前,把它當成一個仍在形成的問題,比急著下判斷更貼近現況。

分享這則新聞

提到的產品

來源

相關 AI 新聞

Anthropic 砸 1 億美元開學院:要培訓 1 萬名 AI 部署工程師
商業與產業

Anthropic 砸 1 億美元開學院:要培訓 1 萬名 AI 部署工程師

Anthropic 打算花 1 億美元,培養一種很特定的人才:能把 AI 從簡報上的點子,變成真正上線運作的系統。但你不能自己報名,而且第一批認證要等到 2027 年才會出現。

熱度:1,050
Claude Code Mods 是什麼?用 TypeScript 改寫 AI 編程助手
AI 教學

Claude Code Mods 是什麼?用 TypeScript 改寫 AI 編程助手

Anthropic 為 Claude Code 引入 mods,用幾行 TypeScript 就能改寫這個 AI 編程助手的行為、介面與內建功能。本文說明 mods 怎麼運作、能改到什麼程度,以及它的權限風險。

熱度:880
極簡編輯插畫,華盛頓監管建築輪廓與並排的 AI 實驗室圖示之間拉起一條審視線
商業與產業

FTC 調查 OpenAI 與 Anthropic 消費者保護疑慮

美國 FTC 對 OpenAI、Anthropic 等 AI 實驗室啟動正式調查,釐清模型是否危害消費者,並擬以民事調查令要求交資料、高層作證。

熱度:1,300
Claude Sonnet 5.5 洩漏:識別碼現身,傳在 Claude Code 灰度測試
AI 模型

Claude Sonnet 5.5 洩漏:識別碼現身,傳在 Claude Code 灰度測試

網路上出現 Claude Sonnet 5.5 的內部識別碼,傳出已在 Claude Code 進行灰度測試,但 Anthropic 官方尚未確認。這篇整理已知傳聞與仍待釐清的部分。

熱度:1,100