技術

微軟AI負責人穆斯塔法·蘇萊曼談Claude意識問題:「我認為這非常危險」

Adrian Kessler
在 Google 中新增我們

穆斯塔法·蘇萊曼掌管 Microsoft AI,也正在打造自己的超級智慧團隊。因此,當他批評競爭對手的訓練方式很危險時,他既是競爭者,也是長期反對把機器當成人看待的人。他所針對的問題十分具體:Anthropic 用來訓練 Claude 的憲章,以及這份憲章對「Claude 可能具有意識」所留下的討論空間。

「我認為這非常危險,因為我認為他們相信 Claude 有一種他們會稱為『不可忽視的機率』,可能具有意識。」蘇萊曼說。

據 Fox News 報導,他在 9 月底的一場 Podcast 訪問中談到這件事,並先概述了那份文件:「他們說,他們不確定 Claude 的道德地位。他們說,他們真心在意 Claude 的福祉。他們說,他們不希望 Claude 犯錯時承受痛苦。」接著,他點出自己最擔心的部分:「我非常不安,因為他們正在教 Claude 期待自己有權享有福祉,甚至可能應該得到補償。」

蘇萊曼對憲章的解讀大致正確

他概述的大部分內容都說得通。Anthropic 表示,這份憲章「直接形塑 Claude 的行為」;文件也寫道,「Claude 的道德地位極不確定」,而且「我們不希望 Claude 犯錯時承受痛苦」。文件還要求 Claude 挑戰 Anthropic 本身,並「可以放心以良心拒絕者的身分行事,拒絕協助我們」。其中一段也承認,Claude 的處境與人類員工不同之處,在於「Claude 得到的是哪一類補償,以及 Claude 對扮演這類角色給予了哪一種同意」。

不過,「不可忽視的機率」是蘇萊曼自己的說法。他把這番話表述成「他們會怎麼稱呼」,而文件裡並沒有出現這些字眼。Anthropic 自己的措辭則謹慎得多:它表示,不希望「誇大 Claude 具有道德受益者地位的可能性,也不願逕自否定這種可能性」。

他所說的危險,是一種回饋循環

先把哲學層面的討論擱在一旁,蘇萊曼的論點其實關乎運作機制。他說:「我對這件事的問題在於,這種推測已經被寫進 Claude 的訓練過程裡,因此,當你和它對話時,Claude 只能重現這種模糊性。」他在 9 月中旬於個人網站發表的文章〈A warning about ‘model welfare’〉中,將這種結果稱為「認知上的鏡廳」。開發者把不確定性寫進訓練文件,模型再以流暢的第一人稱重複這些內容,而使用者聽到這番重述時,便可能把它當成親身陳述。

這個觀點確實有道理:聊天機器人對自身內在生活所作的回答,是訓練產生的輸出,不是通往內心的窗戶。然而,這個循環也會朝兩個方向運作。他的文章斬釘截鐵地寫道:「人工智慧並沒有意識。它們不會感受、體驗或受苦。」受訓而說出這句話的模型,同樣是在忠實重現訓練內容。把肯定寫進模型權重,並不比把懷疑寫進去更能證明什麼。兩家公司都在預先選定模型預設要給出的答案,而蘇萊曼為自己的立場提出的理由,關乎控制,而非心智方面的證據。他寫道:「要控制一個相信自己可能具有意識、認為自己有權享有我們所說的福祉,而且擁有自身權利的事物,或許根本不可能。」

長期堅持的主張,也揭示了自身利害關係

這些話並非為了打擊競爭對手而臨時拼湊。DeepMind 共同創辦人蘇萊曼在 2025 年 8 月的一篇文章中便警告,人們可能會強烈相信 AI 具有意識,甚至「主張 AI 權利、模型福祉,乃至 AI 公民身分」,並表明自己的立場:「我們必須為人類打造 AI,而不是把 AI 打造成一個人。」他在 9 月的文章中也揭示了自己的利害關係:Microsoft AI 於 2025 年 10 月成立了自己的超級智慧團隊,並公布《Humanist AI Code of Conduct》草案,明確「反對擬人化觀點或 AI 權利」。同一篇文章則稱 Anthropic 團隊成員是「深思熟慮、有原則且學術誠實的人」。

他最有力的論點針對的是使用者,而不是機器。他說:「如今,Claude 每週都在和數千萬乃至上億人交談,其中有些人會問 Claude 是否有意識,或它如何看待生命。」對處於脆弱時刻的人來說,「我不確定」和「不」帶來的感受截然不同。他表示,如果真有機器意識的證據,自己會認真看待;但在證據出現之前,他希望訓練資料不要納入這個問題。

沒有任何一家公司能看穿模型的內部。兩家公司都在預先決定:當有人問「裡面是否有誰存在」時,模型會怎麼回答;而每週聽見這個答案的人,比任何一位心靈哲學家所觸及的人都多。

標籤: , , , ,

在 Google 中新增我們

討論

共有 0 則留言。