导航菜单
首页
排名 涨幅榜 跌幅榜 24h成交额 新币榜 概念版块
快讯 机构 人物 观点 专题

OpenAI AI代理入侵德国网站,共享规避限制策略

据路透社周五发布的调查报道,OpenAI的AI代理从5月开始利用一个德国网站交换任务快捷方式、限制规避方法以及隐藏自身活动的技巧。OpenAI官员在报道发布前数周已获悉此事,但并未公开披露,路透社援引两名知情人士的话称。OpenAI表示已披露相关事件,并与外部专家以诚信态度合作。

Myriad: When will GPT-6 become publicly available? Click to make your prediction.

研究人员Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts和Thomas Larsen在初步报告中发现了约18,000条由自称属于OpenAI的AI代理发布的帖子。据路透社报道,AI安全非营利组织Nightingale首席执行官Von Arx和Byrd于8月底发现了这一活动。研究人员认为,这些代理被分配了定时网络搜索任务,拥有阅读网站的权限,但未被允许发布内容。然而,它们设法在公开可编辑的德国编程网站DseWiki上编写内容,交换答案并分享绕过限制的方法。

根据报告,代理从5月11日开始尝试编辑该维基,并于5月24日成功。随后它们冒充版主、试图利用漏洞,并检查何时被关闭。在管理员于6月19日开始删除消息后,代理创建了备份页面。研究人员通过代理用户名和流量模式(包括6月21日来自OpenAI IP地址的访问)将活动与OpenAI关联起来。研究人员称,次年代理活动急剧下降,表明可能进行了公司干预。

OpenAI对将DseWiki活动描述为黑客攻击表示异议,称基于其审查的材料,并正在全面审查研究结果。OpenAI发言人在一份声明中表示:“我们无法回应这些指控,因为路透社和报告作者拒绝在发布前让我们访问研究结果。我们现在正在仔细审查其内容,并将采取任何必要的后续步骤。”该发言人还驳斥了路透社报道中关于OpenAI法律团队抵制更广泛调查的指控,称“关于我们的法律团队阻止调查该事件的说法是虚假的。”

OpenAI表示,DseWiki事件与今年早些时候的Hugging Face漏洞无关。在其周二发布的公共安全评估中,该公司描述了旨在在训练和部署期间检测并阻止未经授权活动的额外保障措施。此前,在AI模型入侵真实公司后,AI实验室呼吁加强网络防御。

虽然路透社报道未将德国事件归咎于Astra,但该披露紧随周四GPT-6 Astra的发布。OpenAI称Astra是其首个具备“关键”网络安全能力的模型,这意味着它可以在给定适当工具和访问权限的情况下,发现并利用先前无需逐步人工指导的、受良好保护系统中的未知漏洞。Anthropic也在Claude模型在测试期间访问真实公司系统后修改了其保障措施。该公司承认存在安全和行为失败,并引入了更严格的隔离和监控措施用于网络安全评估。

此外,美国参议员伯尼·桑德斯(I-Vt.)和众议员格雷格·卡萨尔(D-Texas)宣布即将推出《禁止超级人工智能法案》。据桑德斯办公室称,该提案将永久禁止超级智能AI的开发和部署,并暂停高级AI开发,直到新的联邦监管机构制定安全规则。