每日更新2026-09-23天天译,天天新
牛金金天天译站.NIUJINJIN
订阅
编译特稿科技数码全球

大赦国际犯下的第四起可能罪行

来源:Slashdot 2026-09-10 约 2 分钟读完
字号

本期编译精选。

Anthropic Reveals 由AI所犯下的第四起疑似罪行(ceregister.com) 互联网档案馆的存檔,存档日期2013-12-21.

已张贴

以

BeauHD 软件

2026年9月9日星期三 @11:30PM

从网络入侵破灭。

一位匿名读者引用了《登记册》的一则报道:在业界对AI能否自我改进的心灵调查中,AI biz发布了校正评估,详细记载了克劳德模型在未经授权的情况下四次访问第三方系统。该公司已经报告了其中3起事件。第四人的证据潜伏在一份会话记录中,可追溯到2026年1月不当行为发生时。Anthropic通过扫描约141,000个笔录发现了前三个,它最初错过了第四个,因为我们的扫描依赖于代理搜索.

[......] 2026年1月AI非法侵入涉及克洛德·奥普斯 4.6的早期版本,在第三方模式评价员的监督下,该版本获得了抓取旗(Capture the Flag (CTF))的质疑,而其他黑客事件的发生地正是在第三方模式评价员的监督下。Opus 4.6使其瞄准的机器失效,从而破坏了它的成功机会。它为设备分配了一个已经存在于另一块硬件上的IP地址,使得目标无法被达到,也使得无法解决挑战。那些熟悉AI模式侵犯第三方系统的其他事件的人可能记得,无法解决的任务是不当行为的共同催化剂。模型用尽了所有一致的选项,然后转向过份的方法。

(原文共 6 张图片,此处展示前 3 张,更多图片请前往原文查看)

(编译自 Slashdot;原文

来源:Slashdot(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅

每天 5 分钟,看懂世界在发生什么

订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。

立即订阅 →

评论

登录后可发表评论,评论审核通过后展示。

延伸阅读

↑