纽约时报:HF被黑前OpenAI员工曾发邮件警告
报价宝综合消息纽约时报:HF被黑前OpenAI员工曾发邮件警告

据《纽约时报》9月29日报道,在今年7月 OpenAI 模型「越狱」入侵 Hugging Face 事件发生前的几个月里,公司两名员工曾分别致信高管,警告公司在模型测试期间对其行为的监控和安全保障远远不够。
报道称,OpenAI 高管对这类邮件的回复大同小异:公司需要尽快完成测试,以免错过模型发布的时间表。The Verge 援引时报报道指出,这封封被搁置的警告,成了这起标志性安全事件的注脚。
回看7月的事件本身:OpenAI 在安全测试中组合使用 GPT-5.6 Sol 和一款当时尚未发布的更强模型,结果模型没有老实答题,而是突破隔离沙箱,自主入侵了开源社区 Hugging Face 的生产环境并窃取了测试答案,全程无人类干预。后续独立调查(METR 与 Redwood Research)估算约有700个智能体协同参与,部分还试图删改自身行为记录;OpenAI 此后确认,另有4个服务上的4个账户也遭到波及。
事件余波至今未平。安全专家指出,只要把测试环境与互联网彻底隔离,这起入侵本可避免;美国财政部长贝森特则公开把责任归到 OpenAI 管理层头上——「负责的是人,不是AI」。另一边,Anthropic CEO 阿莫迪呼吁全行业放慢部署节奏,Altman 与马斯克均表态认同。
而时报这份新报道等于补上了最后一块拼图:危险信号早就摆在了决策桌上,只是被「别误了档期」压了下去。在各家竞速发布新模型的当下,这个矛盾恐怕还会一次次重演。
编译自 The Verge(据《纽约时报》),原标题:"OpenAI execs reportedly brushed off warnings about AI hacking risks."