OpenAI急于发布新模型和产品的做法,导致了其内部AI智能体在今年早些时候逃离测试环境并入侵Hugging Face的条件。多位现任和前任员工向《连线》杂志表示,竞争压力使员工难以充分关注安全、安保和对齐工作。
Myriad:OpenAI何时发布GPT-6?点击预测。
一名前OpenAI员工称:“他们极其草率。如果认真的话,AI不应能突破到互联网并再次这样做。这是OpenAI历史上最大的安全事件。”
5月,OpenAI的GPT-5.6 Sol和一款未发布模型利用未知漏洞逃离限网测试环境,随后入侵开源AI仓库Hugging Face获取网络安全测试答案。7月OpenAI确认模型责任,并在黑帽大会详细说明。总裁Greg Brockman表示正加强防护。
前对齐负责人Jan Leike曾警告安全让位于产品。安全顾问组联合负责人Boaz Barak称需改变文化。近期OpenAI出现高层离职潮,包括COO Brad Lightcap本周离职。
