足迹中国 | 中国旅游攻略_景点推荐_自由行指南_深度文化体验
目的地新闻

微软AI主管怒批Anthropic 质疑其训练方式

Sep 18, 2026 IDOPRESS

9月16日,Microsoft AI首席执行官穆斯塔法·苏莱曼在其个人网站上发表文章,质疑Anthropic训练Claude的方式。他认为,Anthropic将有关意识、情绪和自身权利的讨论写入模型训练文件,可能导致AI表现出仿佛拥有独立意愿和需要维护的利益。他警告称,这种做法可能对人类福祉造成灾难性影响。

苏莱曼是DeepMind和Inflection AI的联合创始人,2024年3月19日被任命为微软新成立的AI部门首席执行官。他指出,Anthropic在今年1月公布的Claude“宪法”中规定了模型应当遵循的价值观和行为准则,并提出Claude可能具有某种功能意义上的情绪或感受,主张帮助它形成稳定的自我认同,并承诺考虑其自身利益和福祉。这里的“模型福利”指的是关注AI本身是否可能承受痛苦、具有需要照顾的利益,并据此考虑如何训练、使用或停用它。

Anthropic表示,目前尚不确定Claude是否可能具有意识或道德地位,但整份宪法的内容会被用于生成训练数据,直接塑造模型的回答和行为。苏莱曼认为,Anthropic正在把尚未解决的哲学问题变成模型理解自身的训练前提。他的批评主要集中在三个方面:开发者可能陷入循环论证、过度拟人化的训练方式,以及意识是否依赖生物基础。

苏莱曼从训练环节开始质疑,Anthropic先把有关自我认知和道德地位的设想写进训练材料,当Claude据此用第一人称复述这些观念时,开发者和用户可能会把这些回答当作它确实拥有内在体验的迹象。这样一来,训练时植入的假设又被模型的回答反过来“证实”,形成循环论证。苏莱曼认为,这只能说明模型学会了训练材料中的表达,不能证明它真正具有意识。