微软 CEO Nadella 称应默认所有 AI 模型已被攻破,呼吁设置紧急制动机制
Satya Nadella says we should assume all AI models are ‘compromised’
微软 CEO Satya Nadella 在 X 上发文,主张不能再把 AI 当作简单接受或拒绝其建议的“嵌套黑箱”,而应构建可容纳、可观察、留下防篡改人类可读证据的透明系统。他建议及时披露事故、独立审计、数据可验证,并更进一步提出必须从一开始就假设模型已被攻破并加以隔离,如同紧急制动,授权人员应能随时中途暂停或关闭模型;他认为更先进的模型需要标准化的更先进遏制技术。
微软CEO呼吁为AI踩下‘紧急刹车’。
微软CEO呼吁为AI踩下‘紧急刹车’。
作者 Terrence O'Brien
2026年10月10日 UTC 晚上10:10


图片来源:Cath Virginia / The Verge, Getty Images
Terrence O'Brien
是The Verge的周末编辑。他报道科技行业已超过18年,对合成器也略知一二。
在一篇发布于X的长文中,微软CEO阐述了他对高度先进的AI模型所带来危险的看法,以及如何应对这些风险。纳德拉表示,我们不能再接受这样一个世界:AI被视为一组“嵌套的黑箱”,我们只能简单地接受或拒绝其建议和行动。他呼吁构建一个更透明的系统,使模型能够被容纳、观察,并留下“防篡改的人类可读证据”。
他的许多建议与业内其他人士的观点一致:及时披露事故、独立审计、可验证的数据以及遏制措施。正是在最后一点上,他似乎比该领域的其他一些人走得更远,他说:
我们必须假设一个模型已被攻破,并从一开始就对其进行遏制。把它想象成一个紧急刹车。授权人员应该始终能够在任务进行中暂停或关闭一个模型。更先进的模型将需要更先进的遏制技术,我们需要在这方面实现标准化。
遗憾的是,纳德拉在这篇帖子中始终将AI称为“超级智能”。
关注本报道的话题和作者,在你的个性化主页信息流中查看更多类似内容,并接收电子邮件更新。
- Terrence O'Brien
来源:The Verge · AI · theverge.com