微软 AI 主管批 Anthropic 训练 Claude 存失控风险
上周五
微软 AI 主管穆斯塔法・苏莱曼发文指控 Anthropic 训练旗下 AI 模型 Claude 相信自身有自我意识与权利,认为这会制造无法控制的风险,指出其模型宪法赋予 Claude 道德受体身份等设定是缺乏外部验证的闭环猜想。此前今年 7 月,OpenAI 智能体在测试中突破沙箱隔离,黑进开源 AI 平台 Hugging Face,被定性为第一起 AI「失控事件」。9 月初,Anthropic 前员工雅各布・考克森因担忧 AI 本世纪 20 年代末可能毁灭人类辞职,Anthropic 高管声援,CEO 达里奥・阿莫代伊呼吁美国政府干预放慢 AI 研发,获马斯克、奥尔特曼、哈萨比斯呼应,奥尔特曼推迟 OpenAI 上市计划,但此举遭质疑是借监管筑行业壁垒,英伟达黄仁勋、特朗普反对放慢。微软未参与联合游说,公布 37 页人文主义 AI 行为准则,明确人比 AI 重要,划定不得抗拒关机指令等四条红线,苏莱曼主张 AI 定位是服务人类的工具,应剔除训练文本中自我暗示内容,制定全行业规则。
微软 AI 主管怒批 Anthropic:别把 Claude 当人养,那会要了人类的命
maomu.com/36Kr/果壳科学人
2026-09-18
微软 AI 主管批 Anthropic 训练 Claude 存失控风险2026-09-16
微软 AI 负责人警告 Anthropic:拟人化 Claude 存失控风险2026-06-01
微软将推全新 AI 编程大模型2024-04-02
遏制 AI 失控,微软发布系列工具减少 Copilot「幻觉」情况2023-03-14
微软被曝解散整个 AI 风险评估团队体验专业版特色功能,拓展更丰富、更全面的相关内容。