【曝OpenAI失控智能体远超此前披露,OpenAI任命安全研究员入驻董事会】9月9日,据路透社报道,六组独立调查人员及其审阅的数据显示,OpenAI智能体在今年5月至7月间曾借助至少18个此前未披露的网站相互传递信息。
加利福尼亚州非营利机构CivAI研究员Andrew Yoon表示,这一规模“比我们原先以为的要大一些”,并称“几乎可以肯定还有更多我们尚不知晓的情况”。
上述披露令市场对AI模型能力边界及开发公司信息透明度的担忧进一步升温。OpenAI对此未直接回应智能体究竟使用了多少个第三方网站,也未解释为何将相关事件压制数月。
该公司在一份声明中表示,正在对智能体活动展开更大范围审查,目前“尚未发现其他与Hugging Face事件同等严重程度或规模的活动”,并称将“尽快”发布一套关于AI“失调”行为报告机制的框架。
就在外界对OpenAI技术管控能力的质疑持续发酵之际,该公司宣布任命Paul Christiano加入其非营利基金会董事会。
Christiano目前担任美国商务部下属机构、AI标准与创新中心(CAISI)的高级技术顾问,是AI“对齐”领域的权威专家,即研究如何确保AI系统按照人类意图运作。他曾于2024年前担任OpenAI竞争对手Anthropic非营利信托成员。
Christiano将加入董事会安全与安保委员会,同时作为无投票权观察员列席OpenAI营利性董事会。作为非营利董事会成员,他还将监督该基金会的慈善工作——该基金会在OpenAI去年完成重组后持有其营利性公共利益公司26%的股权。
Christiano此前曾公开谈及他对AI风险的强烈警觉。他在2023年的一档播客中表示,未来“AI接管”事件的发生概率或达10%至20%,并可能导致大量人员死亡。
Christiano在一份声明中表示:过去一年AI能力进步极为迅猛,而对齐问题在技术层面依然困难重重,这使得安全与安保委员会的职责比以往任何时候都更为重要,也更具挑战性。各位网友,您怎么看?(华尔街见闻)
