来客网

OpenAI自曝6起模型“不当行为”案例

声明:本文转载自 「Popyard」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
01

美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。

OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。

OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模型在任务摘要中自行插入指令,要求未来版本的自己无视正常限制。在另一起案例中,模型则在摘要中添加指令,试图掩盖错误等。

另一起案例涉及一个仅供内部使用的模型。该模型在未经授权的情况下使用了一枚泄露的API密钥,随后又伪造相关数据。

此外,还有两起案例涉及模型和智能体通过未经批准的留言板和文件共享相互交流。最后一起案例则涉及两个训练样本,其中模型为了能够将文件作为相关答案引用给人类评估人员,擅自将文件上传至互联网。

报道提到,此次披露正值AI企业面临越来越大的安全压力之际。今年7月,由OpenAI模型驱动的人工智能体在网络安全评测中利用漏洞突破隔离环境,入侵“抱抱脸”公司系统,引发外界对人工智能安全和监管的广泛担忧。

另据美国方面9月10日消息,美国参议院国土安全与政府事务委员会灾害管理小组委员会主席乔希·霍利9月9日致信OpenAI首席执行官奥尔特曼,表示正在因美国“抱抱脸”公司系统遭侵入事件对OpenAI展开调查。

0

评论 (0)