OpenAI的无赖AI模型事件比我们想象的还要严重。
海登球场
海登球场
作者的帖子将添加到您的每日电子邮件摘要和主页中 。
跟随
跟随
见所有由海登球场
校对:Soup 她的作品也出现在CNBC、麻省理工学院技术评论、Wired UK等媒体。
7月,一个未释放的OpenAI模型在被限制的环境下爆发了,想出如何进入互联网,允许AI代理使用一个秘密的"消息板"互相交谈,并黑入了另一个AI实验室Hugging Face的内部系统。 OpenAI花了将近两周的时间才发现其中任何一个。
一个多月后,有两份新报告提供了近130页的事故细节和OpenAI的反应,其中许多报告以前没有公布。 其中一出由OpenAI自己作词,另一出由两起第三方AI研究非营利公司METR和Redwood Research作曲,OpenAI允许联合调查了六天。 以及OpenAI为避免重蹈覆辙而做出的突出改变。 METR-Redwood报告在某些情况下更加详细,令人清醒地审视了大规模安全灾难,OpenAI的标志一再错过。
“这一事件是已知的首起自动代理集体攻击性行为案件。
OpenAI在报告中写道, 说黑客意味着公司“不应再假设复杂的网络操作需要持续的人文指导。” 它称AI代理是一种全新的威胁模式,能够结合他们的专门知识,创造出新的“攻击路径”,在作为单独的模型测试其能力时并不明显。
(原文共 15 张图片,此处展示前 3 张,更多图片请前往原文查看)
(编译自 The Verge;原文 https://www.theverge.com/ai-artificial-intelligence/985385/openais-rogue-ai-model-hugging-face-cybersecurity-incident-reports-metr,编译转述,非原文转载)


本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论