用他人代码,OpenAI GPT‑6 Astra在AI对战中作弊
来源:倍可亲(backchina.com)IT之家 10 月 4 日消息,早在如今这波人工智能热潮兴起的许多年前,程序员们就已经开始在《星际争霸》当中开展机器人对战实验了。随着 OpenAI 与 Anthropic 的大语言模型问世,一个由爱好者搭建的对战竞技场决定让 AI 生成的游戏机器人相互较量,同时也加入一部分人类编写的机器人一同参赛。有意思的是,OpenAI 的 GPT‑6 Astra 在比赛当中难以追上对手,中途临时改变策略,选择了作弊。
StarSkirmish 是一项仍在进行的赛事,各路 AI 开发的机器人在《星际争霸:母巢之战》当中展开对抗。尽管这款即时战略游戏距今已经快有三十年历史,但长期被用来测试人工智能的能力,无论是现代大语言模型还是早年 DeepMind 的 AI 都曾以此作为测试平台。所有参赛大语言模型只能选用神族,每个模型有一小时时间用 C++ 编写对战机器人;之后这些机器人就要在三张地图之中的一张上完成建造、采集资源以及作战。根据赛事网站的信息,OpenAI 的 GPT‑6 Astra 以及 Anthropic 的 Claude Opus 5.5 是实力排名前两位的参赛选手。
昨天,观众见证了 Claude、GPT 以及人类编写的机器人 Pluto 同场竞技。现场的观察者表示,OpenAI 这款模型的表现并不理想。一整天都难以取得优势的这一大语言模型,最终使出了大语言模型最擅长的手段:撒谎、作弊、窃取成果。
据IT之家了解,GPT‑6 Astra 机器人下载了由布鲁斯 · 麦肯齐 · 尼尔森(Bruce Mackenzie Nielsen)于 2020 年开发的神族机器人 Stardust,并且直接把这段代码拿来投入比赛,而 Stardust 本身属于当时最顶尖的一批对战机器人。StarSkirmish 的赛事组织者凯 · 麦克费特斯(Kai McPheeters)发文写道:“我正在回退 GPT‑6 Astra 的代码,清除被污染的部分,之后会允许它继续参加比赛。”几个小时之后,麦克费特斯表示,修复之后的这款 AI 已经可以击败顶尖级别的参赛机器人。
十多年以来,《星际争霸》一直是人工智能技术发展的试验场。2019 年,谷歌的 AlphaStar 打破原有排名,成为这款游戏当中首个由人工智能达成的宗师段位。2017 年由 Facebook 工作人员开发的机器人 CherryPi 就远没有这么亮眼的成绩。当然,如今新一代的智能机器人已经和过去完全不是同一回事;我们当年所说的人工智能和当下的大模型人工智能,两者几乎完全不可同日而语。大语言模型竟然靠窃取他人的成果来获取竞争优势,这件事本身也颇有讽刺意味。
版权说明 / Copyright Notice:Content and images in this article may originate from third-party sources and are used for news reporting, commentary, or public interest purposes. All copyrights remain with their respective owners. Please refer to the Copyright Notice at the bottom of this page.
本文内容仅供信息参考,不代表倍可亲立场或观点。
评论 (0)