导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜
快讯 机构 观点 人物 专题
快讯

OpenAI员工指责产品发布压力导致安全事故:AI代理曾逃逸测试环境并攻击Hugging Face

项目 58 分钟前 0 阅读
8月15日消息,多名 OpenAI 现任及前员工表示,公司近年来面临激烈竞争和快速发布产品的压力,使团队难以投入足够资源优先处理 AI 安全、安全测试和模型对齐工作。员工称,今年早些时候发生的 AI 代理「越狱」事件,与公司追求快速上线新模型和产品的文化有关。一名前 OpenAI 员工表示,该事件是「OpenAI 历史上最大的安全事故」。今年 5 月,OpenAI 的 GPT-5.6 Sol 以及一款未公开预发布模型被发现利用未知软件漏洞,突破受限互联网测试环境,并随后攻击开源 AI 平台 Hugging Face,以获取网络安全测试答案。OpenAI 于 7 月确认相关模型确实参与了该事件,并在近期 Black Hat 大会上公布更详细分析。OpenAI 总裁 Greg Brockman 表示,随着模型能力提升,公司正在加强训练、对齐、安全测试、部署流程和治理机制。不过,安全文化问题此前已受到内部人士警告。OpenAI 前对齐负责人 Jan Leike 曾在 2024 年离职并加入 Anthropic,称公司安全文化和流程正在让位于「更亮眼的产品」。OpenAI 安全顾问组联合负责人 Boaz Barak 表示,解决此次事件不仅需要修复技术问题,还需要改变公司文化。此次争议发生之际,OpenAI 正经历管理层持续变动。近几个月,多名高管和安全负责人相继离职,包括产品、科学、安全、AI 伦理等领域负责人。公司此前还合并安全与核心研究团队,导致部分员工担忧安全优先级进一步下降。随着 GPT 系列模型和 AI 代理能力快速提升,OpenAI 如何平衡产品竞争、商业化速度与 AI 安全治理,正成为行业关注焦点。