英文原标题:Satya Nadella says we should assume all AI models are ‘compromised’

本文为英文原文的机器翻译摘要,原文见:The Verge AI ↗

  • 微软CEO Satya Nadella在X发长文,阐述对高度先进AI模型风险的看法及应对思路。
  • 他反对将AI视为“嵌套黑箱”并被动接受其建议或行动,主张建立更透明的系统,使模型可被控制、观察,并留下“防篡改的人类可读证据”。
  • 其建议与业界共识一致,包括及时披露事件、独立审计、可验证数据和遏制措施。
  • 在遏制方面他更进一步,提出必须假设模型已被攻破并从一开始就加以遏制,并类比紧急刹车,授权人员应能随时暂停或关闭执行任务的模型。
  • 他还指出更先进的模型需要更先进的遏制技术,并需将其标准化;文中提到他在整篇文章中都将AI称为“超级智能”。

引语

  • 我们必须假设模型已被攻破,并从一开始就遏制它。
  • 授权人员应始终能够在任务中途暂停或关闭模型。

为什么值得看:微软CEO公开主张对AI模型采取“默认已被攻破”的遏制思路,并呼吁标准化更先进的遏制技术,可能影响行业安全实践。

站内导航