每日更新2026-09-23天天译,天天新
牛金金天天译站.NIUJINJIN
订阅
编译特稿科技数码全球

OpenAI 的新理性技术 警报AI 安全专家

来源:Slashdot 2026-09-03 约 1 分钟读完
字号

本期编译精选。

已张贴

以

BeauHD 软件

2026年9月3日星期四 @02:00PM

从思维的链子。

一位匿名读者引用了TechCrunch的一份报告:OpenAI的新Astra模型将使用一种名为经常性深度的推理技术,允许它在大多数推理模型的特征的相继思维之外运作。The Information于星期二上报。这个技术,也叫“不透明重现”, 很可能使模型的思维链更难监测—— 这让AI安全专家惊慌失措。虽然Astra对技术的使用据说有限,但其出现仍然引起大赦国际安全专家的严重关切。

“我对Astra使用不透明复发方式的报道感到极为担忧”, 我不知道Astra是否比之前的模型更能监控CoT. 但如果OpenAI进一步推开这一技术,他们会有大规模地增加再现并完全破坏CoT可监测性的选择.

长期AI安全倡导者Zvi Mowshowitz(Zvi Mowshowitz)也进行了权衡并写道,可能需要法律来防止AI实验室中的竞相. 这个技术在玩火,冒着OpenAI和Anthropic为了确定我们努力维持思想的忠诚和可监控链而奋斗的禁忌的风险,Mowshowitz写道。更密集地使用这些技术 可能会破坏可监测性

(原文共 10 张图片,此处展示前 3 张,更多图片请前往原文查看)

(编译自 Slashdot;原文

来源:Slashdot(原文)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
免费订阅

每天 5 分钟,看懂世界在发生什么

订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。

立即订阅 →

评论

登录后可发表评论,评论审核通过后展示。

延伸阅读

↑