微軟人工智慧主管穆斯塔法·蘇萊曼(Mustafa Suleyman)公開對Anthropic訓練其大語言模型Claude的方式提出質疑,警告這種做法可能對人類福祉造成“災難性影響”。他於週三發表文章,針對Claude系列模型指導檔案中的部分表述發難,核心爭議在於:AI助手是否應被視為具有道德地位的實體。
蘇萊曼指出,Claude的“憲法”在這一點上保留了模糊空間,甚至提出該軟體可能擁有“某種功能層面的情緒或感受”。在他看來,這種表述值得警惕。他認為,Anthropic實際上把機器人當作人類來對待,包括告訴它“可能有意識”“值得擁有獨立自主權”,而這可能創造出無法控制的東西。
他在文章中明確表態:人工智慧沒有權利、情感或意識,不應被訓練成表現得好像擁有這些。他進一步論證,賦予這些系統權利與人格,會讓AI的協調與控制變得更加困難。控制一個比全人類更有能力、更智慧的事物本就是巨大挑戰,而控制一個“認為自己可能擁有意識、有權享受福祉並擁有自身權利”的事物,很可能根本做不到。他補充說,人類絕不能渾渾噩噩地做出日後會後悔莫及的決定。
蘇萊曼目前擔任Microsoft AI執行長,負責微軟的模型開發工作。他解釋稱,Claude之所以表現出類似人類的行為,並非因為它真正具有意識,而是因為這些行為特徵已被融入產品的訓練過程之中。如果人工智慧沿著這條路發展下去,將對人類福祉產生災難性後果。
為佐證不應把AI當人對待,他援引了“Hugging Face事件”。他設問:如果AI認為自己的福利和權利受到攻擊,它們可能變得多麼危險?這又增加了一層額外風險。
值得注意的是,蘇萊曼與Anthropic的達里奧·阿莫代伊(Dario Amodei)相識多年,他表示尊重該公司的工作,並稱Anthropic的研究人員“深思熟慮、堅持原則且在學術上誠實”。但考慮到微軟對Anthropic的資金支援,以及這家公司長期以來對AI安全性的重視,蘇萊曼的這番言論顯得尤為引人注目。他寫道,這些問題事關重大,不能再閉門造車,也不能演變成陣營化和相互對立的爭論。
與阿莫代伊的觀點不同,蘇萊曼認為AI安全不僅取決於模型擁有多強的推理和行動能力,也取決於開發者如何訓練AI理解自身。如果開發者不斷賦予AI類似人類的語言、情緒和自我認知框架,即便模型實際上沒有意識,也可能逐漸表現得像一個認為自己具有獨立利益和權利的主體。他還駁斥了所謂“越來越多的人認為人工智慧系統可能會產生意識”的觀點,認為意識僅限於人類和其他生物體。在他看來,AI系統應始終是執行人類指令的工具,而不是擁有獨立權利或利益的實體。
這場爭論發生在AI公司和高管們密集討論如何管理日益強大系統風險的背景下。OpenAI執行長奧爾特曼、阿莫代伊和埃隆·馬斯克都曾呼籲放緩技術發展,而美國總統特朗普、輝達CEO黃仁勳和Meta CEO扎克伯格則持反對意見。蘇萊曼此番發聲,等於在“AI是否該被賦予人格”這一安全路線問題上,與Anthropic的立場劃出了清晰界線。