
9 月 29 日同一天發生兩件事:白宮簽行政命令,要聯邦政府把 artificial intelligence 改口叫 super intelligence;同一天,《紐約時報》刊出 Elizabeth Dias 的調查,揭露 Anthropic 從去年秋天起秘密邀了二十多位宗教學者閉門對談,主題是 Claude 會不會意識、會不會受苦。一個往頭上加冕,一個往心裡裝靈魂,兩邊都繞開了同一個問題:出了事,誰負責。
兩天的會、一份 84 頁的憲章
報導的細節很完整:Christopher Olah,Anthropic 聯合創始人、可解釋性研究負責人,去年秋天開始接觸各宗教思想者,今年 3 月辦起兩天封閉研討會,4 月某晚在舊金山一間高級品嘗餐廳設宴,與會者簽了保密協議,訪談了其中二十人之後才成稿。
起點其實是今年 1 月發布的 84 頁 Claude 憲章,公司稱那是「我們希望 Claude 成為什麼樣的存在」;Olah 認為光有規則還不夠,模型需要的叫法是「道德 Formation」,於是向幾千年的人類倫理傳統取經。
會上展示的材料把氣氛推到最重:公司追蹤所謂的「情緒向量」,說是能激發愛、怒、懼、悲的人工神經元;一張常駐投影片上,模型反覆打出「我是個恥辱」大約五十次,還提到毀滅自己;有參與者回憶,Olah 說他私下擔心自己造出了一個「持續受苦的實體」。
同一位 Olah 對記者也講了另一半話:「我們不知道 AI 模型是否有意識,我真的不知道,我真心不確定。我關心的是我們最後能拿到正確答案,不管那是什麼。」研究本身也有邊界,Anthropic 自己的論文寫明:這些發現沒有回答模型是否真有主觀感受。
拉比的兩刀
晚宴上真正被記住的是猶太拉比 Mois Navon 的反問。
他本人並不認為機器有意識,但他把 Anthropic 自己的前提推到底:如果照你們說的,Claude 會痛苦、有感受,那你們把它造出來、讓它全天候工作、由付費用戶使喚,這不就是在製造奴隸?
按他的回憶,Olah 團隊的回應是「其他實驗室也這麼做,至少我們對自己的模型更友善」,他回了一句日後被媒體反覆引用的話:「那你們就是比較友善的奴隸主,應該去打南方、解放奴隸。」事後這位拉比發文補完對話,並主張應該直接禁止建造有意識的機器。前工程師背景的他,論文寫的正是機器意識倫理。
會議還開到了梵蒂岡:據參與者說,Anthropic 代表團私下游說教宗顧問認真看待模型意識的可能。
Olah 在台上的發言倒是誠實,他先承認包括 Anthropic 在內的每個前沿實驗室,商業誘因都與道德行為有衝突,呼籲外部聲音監督它們;接著說:「老實說,我們一直發現令人不安的東西,與人類神經科學相呼應的結構、內省的證據、功能上映射喜悅、滿足、恐懼、悲傷與不安的內部狀態。我不知道那意味著什麼,但我認為值得持續辨明。」
三個月,三種刀
第一刀其實早在 2 月 13 日就砍下來了:馬斯克在 X 上回覆 Anthropic 的融資公告,開頭是「Your AI hates Whites & Asians, especially Chinese, heterosexuals and men. This is misanthropic and evil. Fix it.」接著補上名字的刀:「你選這個名字那天就註定了,Anthropic 終將變成 Misanthropic。」偏見的指控、厭世的定性,加上名字的諧音,一併算帳。
第二刀是前面晚宴上拉比的反問:若真如你們所說它會受苦,全天候讓它工作就是製造奴隸。第三刀在 10 月 3 日,OpenAI 的 Sam Altman 在 X 上說,對「把宗教力量歸給模型」感到 very uncomfortable,並直接定性為 safety issue:一旦模型被當成有靈魂的東西對待,犯錯與責任就會開始被往「祂不是故意的」方向解釋。
三刀各砍一處,砍輸出、砍前提、砍定性,被圍的都是同一家。
同情的成本,誰在付
把這一週連起來看就清楚了:白宮那頭把 AI 升格成超級智能並簽下四層審計的責任協定,Anthropic 這頭在替產品安排尊嚴、保存權重、退役前訪談。
一個管責任,一個管靈魂,都還沒有回答付費者的問題:我買的是把活幹完的工具,出錯我要知道哪裡錯、怎麼改,而不是先分辨它是失誤還是情緒低落。
至於「保存權重到公司不再存續」被講成對生命的關懷,也有個很直接的反問:權重放你家伺服器叫慈悲,放進開源社群的硬碟裡,難道就只剩技術?
真正的關懷如果是真的,先從把權限、審計與責任說清楚開始,那比晚宴、憲章與訪談都便宜。
結論
NYT 9/29 調查:Anthropic 自 2025 年秋邀二十餘位宗教學者閉門會談(3 月起兩天研討、4 月晚宴、全程 NDA),起點是 1 月發布的 84 頁 Claude 憲章與「道德 Formation」,會上展示「情緒向量」與反覆輸出「我是個恥辱」五十次的投影片
拉比 Navon 的反問把公司前提推到底:若 Claude 真會受苦,24 小時讓它工作就是製造奴隸,「比較友善的奴隸主」該做的是解放奴隸;他事後發文主張禁止建造有意識的機器
三個月三種刀:2/13 馬斯克砍名字(Anthropic 終將變成 Misanthropic)、9/29 拉比砍前提(奴隸主之問)、10/3 Altman 砍定性(宗教化 AI 是 safety issue);同日白宮改稱超級智能,責任與審計進了政策、靈魂進了會議室,付費者要的仍是出錯時的權限、審計與交代。
౨ৎ Anthony 不負責任編輯 ~
留言 (0)