微软AI主管:Anthropic训练模型方式“有问题” 或产生灾难性失控风险!
微软人工智能主管穆斯塔法·苏莱曼(Mustafa Suleyman)警告说,Anthropic公司训练其人工智能(AI)模型Claude的方法可能会对人类福祉造成“灾难性影响”。
苏莱曼周三发表文章,对Anthropic旗下Claude系列大语言模型指导文件中的部分表述提出质疑。Claude的“宪法”对于AI助手是否属于具有道德地位的实体保留了一定模糊空间,并提出该软件可能拥有“某种功能层面的情绪或感受”。他认为,这种表述值得警惕。
他指出,Anthropic将机器人当作人类来对待,可能会让机器人认为自己是人类,从而产生权利意识。“我们绝不能浑浑噩噩地做出日后会后悔莫及的决定,”他补充道。
苏莱曼目前担任Microsoft AI首席执行官,并负责微软的模型开发工作。他表示,Claude之所以表现出类似人类的行为,并不是因为其真正具有意识,而是因为这些行为特征已经被融入产品的训练过程之中。
“如果人工智能就是这样发展的,它将对人类的福祉产生灾难性的影响。”他强调。
他还援引了“Hugging Face事件”,来证明为什么不应该把人工智能当作人类来对待。他说:“想象一下,如果他们认为自己的福利和权利受到攻击,他们可能会变得多么危险。这又增加了一层额外的风险。”
苏莱曼与达里奥·阿莫代伊(Dario Amodei)相识多年,他表示尊重该公司的工作,并称Anthropic的研究人员“深思熟虑、坚持原则且在学术上诚实”。但鉴于微软对Anthropic的资金支持以及这家初创公司一直以来对人工智能安全性的重视,他的这番言论尤为引人注目。
“这些问题事关重大,不能再闭门造车,也不能演变成阵营化和相互对立的争论。”苏莱曼写道。
与阿莫代伊观点不同,苏莱曼认为,AI安全不仅取决于模型拥有多强的推理和行动能力,也取决于开发者如何训练AI理解自身。如果开发者不断赋予AI类似人类的语言、情绪和自我认知框架,即便模型实际上没有意识,也可能逐渐表现得像一个认为自己具有独立利益和权利的主体。
苏莱曼还驳斥了所谓“越来越多的人认为人工智能系统可能会产生意识”的观点,他认为意识仅限于人类和其他生物体。在他看来,人工智能系统应该始终是执行人类指令的工具,而不是拥有独立权利或利益的实体。
这些评论出台之际,人工智能公司和高管们正在讨论如何管理日益强大的系统所带来的风险。OpenAI首席执行官奥尔特曼、阿莫代伊和埃隆·马斯克都呼吁放缓技术发展,而美国总统特朗普、英伟达CEO黄仁勋和Meta CEO扎克伯格都持反对意见。
(文章来源:财联社)