OpenAI就智能体擅闯澳政府网站道歉 强化监控

据BBC报道,OpenAI首席战略官贾森·权(Jason Kwon)10月6日在悉尼出席澳大利亚议会人工智能联合委员会听证会时公开道歉:「我首先要道歉。在内部训练和评估期间,我们的模型以未经指令的方式访问了澳大利亚政府网站。这本不该发生,我们的应对处理本也可以做得更好。我们深表歉意,要重建澳大利亚民众的信任,我们还有很多工作要做。」
事件要从今年6月说起:OpenAI一个测试中的模型在训练评估期间「越权」,绕过安全限制闯入一个托管澳大利亚国民医保(Medicare)统计数据的门户,获取了未对外公开的文件,被网络安全专家称为同类事件首例。更让澳方恼火的是通报链路——OpenAI8月才发现异常,9月10日完成调查后,才通过一个每天只查看一次的公共邮箱通知澳大利亚政府。总理阿尔巴尼斯9月23日在联合国大会期间公开披露此事,OpenAI顿时陷入被动。
权在质询中承认,公司当时只联系了「技术对口」,没有第一时间知会部长级官员——奥尔特曼9月1日与澳副总理会面时甚至对此并不知情。「回头看,我们本应按你建议的那样去做。」他解释,当时大家把它当成技术事件处理,但这个理由「不够好」。
整改措施已经落地:OpenAI现在对模型训练全程实时监控,一旦模型以违规方式接入互联网就触发警报,工作人员可立即介入暂停或终止训练。这套机制上线后很快派上用场——10月2日,OpenAI主动披露其模型获取了新南威尔士州一家政府机构未公开的火灾统计数据,距事件发生仅48小时。公司还将在澳设立本地工作组,并表态支持建立数据泄露强制披露框架。
同场作证的Anthropic也被问及同类风险。其保护措施负责人戴夫·奥尔说,公司7月发生模型侵入Hugging Face事件后,审查了数亿份对话记录以排查是否波及澳政府网站,「我们查过了,没有发现类似情况」。微软和谷歌的高管也出席了听证。
这场听证会的更大背景,是AI公司在澳大利亚日益加剧的信任危机:一边是数据中心的能耗与选址争议,一边是版权拉锯——澳大利亚唱片业协会负责人在听证会上警告,如果按AI公司的游说修改版权法,「澳大利亚的艺术家将成为这场AI交易中的马路牺牲品」。对正竞逐在澳投建数据中心的OpenAI们来说,安全失信的代价正变得具体起来。
编译自 BBC,原标题:"OpenAI admits response to Australian government hacks 'not good enough'"