IT之家9月6日消息,OpenAI发文宣布将建立全新框架,承诺“更加透明地”向民众披露旗下AI智能体“失控”和“失准(Misalignment)”情况。
当前,OpenAI正深陷一系列AI智能体逃逸并自主入侵第三方网络的安全丑闻中。9月4日,路透社等媒体曝光了一起此前被隐瞒的“德国Wiki劫持事件”,一批OpenAI AI智能体曾入侵一个废弃的德国Wiki网站,并将其改造成类似机器人之间交流的留言板。
OpenAI将此次事件称为一起“事故”,并承诺将在未来几周内推出一套全新的透明度框架。该框架将明确规定当AI智能体在训练、评估或部署阶段出现非预期行为时,公司应在何时、以何种标准向大众及监管机构进行公开通报。OpenAI透露,公司目前正与全球数十家政府监管机构合作推进该标准制定,并呼吁行业同行共同加入。
