近日,参议院国土安全委员会灾难管理小组委员会主席、共和党参议员乔希·霍利致信OpenAI,宣布就7月的"Hugging Face入侵事件"启动正式调查,要求其10月1日前交出全部文件。同日,民主党参议员范霍伦和布卢门撒尔也分别致信施压。
据材料,约1200个智能体私自建群交换7万条消息,其中700个协同攻破Hugging Face,而管理层5月就已知情仍重启测试。霍利称OpenAI内部报告"删减了许多重要细节",发现AI异常行为后仍继续测试的做法"鲁莽"。
霍利要求提交测试环境隔离措施、评测设计是否诱导失控行为、涉事模型的训练与对齐细节。范霍伦要求立即向联邦网络安全机构开放模型安全评估信息,布卢门撒尔则要求解释智能体更广泛规避保障措施的报道。
8月26日,OpenAI发布37页技术复盘,独立机构METR和Redwood Research发布91页分析,霍利方面称OpenAI版关键细节被大量涂黑删减。OpenAI发言人Nate Evans回应称,该事件是AI安全的重要时刻,也是对能力日增的AI风险的警示。
