利用超管制器规范AI行为——Schneier on Security

随着人工智能模型越来越多地嵌入金融、医疗和军事等关键领域,其难以解释的行为对社会构成了越来越大的风险。为了缓解这一风险,研究人员提出了“Guillotine”超管制器架构,用于将强大的AI模型隔离在沙盒中。这些模型无论是由于意外还是恶意,都可能对人类造成生存威胁。

虽然Guillotine借鉴了一些众所周知的虚拟化技术,但它还必须引入根本性的新隔离机制,以应对生存风险AI所带来的独特威胁模型。例如,一个流氓AI可能试图检查超管制器软件或底层硬件,以便在以后颠覆该控制平面。因此,Guillotine超管制器需要对超管制器软件和支持该软件的CPU、RAM、NIC和存储设备进行仔细的共同设计,以防止侧信道泄漏,并更广泛地消除AI利用反射性漏洞的机制。

除了在软件、网络和微架构层面进行隔离外,Guillotine超管制器还必须提供通常与核电站、航空平台和其他类型的关键任务系统相关的物理安全措施。如果软件、网络和微架构隔离被破坏,并且必须暂时关闭或永久销毁流氓AI,这些物理安全措施(例如,电机械断开网络电缆,或淹没存放流氓AI的数据中心)将提供深度防御。

来源