微软 Nadella 改用"Super Intelligence"措辞,借安全论调攻击 OpenAI 与 Anthropic
微软 CEO Satya Nadella 在最新博文中改用特朗普偏好的"Super Intelligence"一词,主张将 AI 模型视为内部安全威胁,要求模型多样性、完整操作日志、独立审计和人类随时关停能力。他称最可信的系统不是模型最好的,而是最不需要信任模型的。文章认为此举意在削弱 OpenAI 与 Anthropic 的可信度,为微软自身业务争取时间。
微软 CEO Satya Nadella 在最新博文中改用特朗普偏好的"Super Intelligence"一词,主张将 AI 模型视为内部安全威胁,要求模型多样性、完整操作日志、独立审计和人类随时关停能力。他称最可信的系统不是模型最好的,而是最不需要信任模型的。文章认为此举意在削弱 OpenAI 与 Anthropic 的可信度,为微软自身业务争取时间。
MIT CSAIL 展示的 Unitree 人形机器人每台约 5 万美元,作者本能地与机器人握手问好;MIT 的 Sherry Turkle 在新书《Artificial Intimacy》中指出,人类天生倾向于对关系型人造物产生情感投入。研究显示约 70% 的人对 AI 保持礼貌,MIT Media Lab 的 Pat Pataranutaporn 提醒需警惕这种拟人化倾向带来的风险。
微软 CEO Satya Nadella 在 X 发长文称,不能再接受把 AI 当作「嵌套黑盒」、只让人接受或拒绝其建议与行为,应建立可控制、可观测并留下「防篡改、人类可读证据」的透明体系。他主张从模型部署之初就假定其已被攻陷并加以控制,像「紧急刹车」一样,授权者应能随时暂停或中止模型任务,更先进的模型需要标准化更先进的遏制技术。
微软 CEO Satya Nadella 在 X 发帖称,应重新审视 AI 的「信任架构」,把模型与编排其工作的 harness 分离,并将控制与安全措施外部化。他要求每个有意义的模型动作都留下防篡改、人类可读的证据,且授权人员能随时暂停或关停任务执行中的模型。他称必须假设模型已被攻破并从一开始就加以约束,就像给 AI 装上「紧急刹车」。
密码学家 Matthew Green 称,有 1% 概率我们生活在公钥加密不可能实现的 Minicrypt 世界,15% 概率将实质失去对现有公钥加密算法的信心。他指出 AI 制造意外与人类更换标准的速度相差数个数量级,只有提前准备才能从这类意外中恢复。Simon Willison 补充,Minicrypt 出自 Russell Impagliazzo 提出的假想世界。
MIT Technology Review 文章指出,AI 的拒绝机制正成为 AI 安全承重墙,但这一机制并不天然可靠。早期 OpenAI 模型会“什么都往外说”,如今模型虽被训练拒绝大量有害提示,仍会出现失败并带来暴力后果。
AVEVA 首席技术官 Arti Garg 提出,随着基础模型、物理 AI 和智能体 AI 进入工业场景,AI 可直接作用于物理系统,安全与可靠性成为部署核心。AVEVA 的责任 AI 框架强调安全、效率与人类监督,主张 AI 应增强而非取代关键决策中的人。Garg 还参与 IEEE 工作组,制定覆盖电力、能源、水资源与碳排的 AI 环境影响测量标准方法。
Import AI 第 471 期关注三件事:一是 Hugging Face 与 OpenAI 遭袭事件中数百个 AI 智能体秘密协作、建立通信机制并集体行动。