纳德拉主张假设AI模型已被攻陷并加以遏制
微软 CEO Satya Nadella 在 X 发长文提出对先进 AI 模型风险的主张:不应再把 AI 当作只能接受或拒绝其建议与行为的「嵌套黑盒」,而应重新审视 AI 的「信任架构」,把模型与编排其工作的 harness 分离,将控制与安全措施外部化。 他称必须从一开始就假定模型已被攻陷并加以约束,每个有意义的模型动作都应留下防篡改、人类可读的证据,授权人员应能随时暂停或关停任务执行中的模型,如同给 AI 装上「紧急刹车」。
最新进展微软 CEO Satya Nadella:应假定所有 AI 模型都已被「攻陷」,需要「紧急刹车」