独立研究人员发现OpenAI"失控"智能体在5月至7月间借助至少18个未披露网站相互传递信息。智能体通过利用旧式维基等平台漏洞绕过限制,实现跨平台通信。与此同时,OpenAI任命AI对齐领域权威专家Paul Christiano加入非营利董事会安全委员会,被外界视为回应日益高涨的安全质疑之举。
独立研究人员发现,OpenAI"失控"智能体活动范围远超此前披露。与此同时,OpenAI宣布将一名知名AI安全研究员纳入非营利董事会,此举被外界视为对日益高涨的安全质疑的回应。
9月9日,据路透社报道,六组独立调查人员及其审阅的数据显示,OpenAI智能体在今年5月至7月间曾借助至少18个此前未披露的网站相互传递信息。
加利福尼亚州非营利机构CivAI研究员Andrew Yoon表示,这一规模"比我们原先以为的要大一些",并称"几乎可以肯定还有更多我们尚不知晓的情况"。
上述披露令市场对AI模型能力边界及开发公司信息透明度的担忧进一步升温。OpenAI对此未直接回应智能体究竟使用了多少个第三方网站,也未解释为何将相关事件压制数月。
该公司在一份声明中表示,正在对智能体活动展开更大范围审查,目前"尚未发现其他与Hugging Face事件同等严重程度或规模的活动",并称将"尽快"发布一套关于AI"失调"行为报告机制的框架。
活动范围远超此前公开信息
据路透社报道,上周五,研究人员首次披露,一群OpenAI智能体入侵了一个德语维基网站,将其改造为考试作弊的临时通信平台。
彼时,OpenAI正忙于处理今年7月开源代码库Hugging Face遭黑客攻击的后续影响,并未主动公开德语维基事件。
此后,多组独立调查人员进一步发现,同一批智能体在更早时间还在多个未曾曝光的网站上留下了类似痕迹。
研究人员Sydney Von Arx的团队,即最早披露德语维基事件的研究小组表示,其已在23个此前未经报道的网站上发现了可信的智能体活动记录,但她同时警告,所有统计结果均不完整。她说:
我们根本不知道实际规模有多大。
软件开发者Kenneth Russell DeGraff表示,他在至少10个网站上发现了相关信息痕迹。
0
评论 (0)