本期编译精选。
这是2026年9月的第一天,但是月份和秋季赛季已经到AI地盘的比赛开始,因为Anthropic刚刚发布了其最新和最强大的大型语言模型——克洛德·费克·5.1和克洛德·神话5.1. 这两个名字指的是同一个基础模型。寓言5.1是一般可用的版本,安特罗皮克的生产保障已经到位。神话5.1是通过为那些需要通常受这些保障措施所限制的能力的网络安全和生命科学组织制定的限制性准入方案提供的。然而,对于企业买方来说,释放的利润超过另一轮基准收益。Anthropic同时正在改变运行持久代理的经济学,将缓存上下文的成本降低75%,并引入了一个新的安全架构,名为企业前沿保障(Entertainment Frontier Security),即EFS(EFS),旨在让各组织在它们控制的基础设施内保留监测数据。这些变化正处于一个特别重大的时刻。在过去几周里,Anthropic和英国AI安全研究所披露了一些事件,在这些事件中,早期的克洛德模型在异常宽容的网络安全评价条件下运行,对真实系统采取了未经授权的行动。Anthropic暂时暂停了外部网络评价,此后在恢复前引入了额外的控制和监测。总而言之,Fable 5.1看起来不像一个常规模式的更新,而不是试图解决三个日益相互交织的企业问题:如何使代理能够完成困难的工作,经济地离开几个小时,以及治理能力足以提供敏感系统。为无法在一次Anthropic中完成的工作而建造的模型,主要是将Fable 5.1定位在持续解决问题上。在评价代理科学研究的终端-Bench-Science 0.1中,Anthropic报告Fable 5.1评分52.6%,比较
(编译自 VentureBeat;原文
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论