Zhipu说,新编码AI开发的高级网络技能比预期的要快。
中国AI开发商Zhipu推出了GLM-5.3,这是公司称开发出出人意料的强大网络安全能力的一种新的以编码为主的AI模式,使其在发现脆弱性方面接近全球领先模式,同时在更深层次的开发任务上仍然落后. Zhipu自己的测试将GLM-5.3稍先于Anthropic的"神话5"和OpenAI的"GPT-5.6 Sol"放在了CyberGym上,这是测试脆弱性识别和验证的基准. GLM-5.3的得分为84.5%,而神话5的得分为83.8%,而GPT-5.6 Sol的得分为83.6%. 但模型在探索奔驰上以更宽的比分追击两位竞争者,其得分54.4%,而神话5和GPT-5.6 Sol的得分分别为78%和76.5%。 “GLM-5.3是最能进行编码的开放量级模型,在我们内部的Z.ai Code Bench上比GLM-5.2改进了50%。” Zhipu在一份声明中说。 “随着我们扩大后培训,网络能力的发展比我们预期的要快。” 该公司说,GLM-5.3不再局限于查明孤立的脆弱性,而是“形成完整的开采链的一致计划”。 该公司还声称其最新型号比Zhipu之前的GLM-5.2有改进. 其"剥削奔驰"的得分从24.4%翻了一番多,而"剥削Gym"上,GLM-53在两小时内完成了105个"开发"任务,而根据说明,GLM-5.2上分别是29个和39个. Zhipu将收益归结于培训后,包括跨越日益复杂的任务环境的强化学习。 Neil Shah说,该进展反映了随着编码模型的能力增强而出现的更广泛的问题。 Shah说, “我们正在进入一个阶段, 如果我们教人工智能成为一个杰出的软件工程师, “一个AI用来测试代码和修复bug的完全相同的推理是攻击者用来找到一个弱点并突破它。” 他说。
(编译自 InfoWorld;原文 https://www.infoworld.com/article/4210495/zhipu-says-new-coding-ai-developed-advanced-cyber-skills-faster-than-expected.html,编译转述,非原文转载)
本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论