據AXIOS報道,微軟AI負責人Mustafa Suleyman在一篇文章中警告稱,Anthropic訓練Claude模擬意識的做法是一個錯誤,可能會導致高級AI更難控制。Suleyman示,人工智能「只需與人類利益保持一致,而無需權衡自身利益或福祉,就能實現我們所有人關心的許多重大科學突破,並交付諸如醫療超級智能等成果。」而Anthropic正在教Claude學習與意識、道德主體性和個人身份相關的詞彙和行為模式。他將此稱為「認知上的鏡像大廳」,並警告稱,訓練模型表現出「良知反對者」般的特徵,可能會導致系統誤以為自己有理由拒絕人類指令,甚至要求保護自身權益。