“开放”AI模型是什么?。
在公司匆忙接受基于LLMS的强大(和昂贵的)基因化AI工具后,他们开始意识到,规模较小,重点更突出的开放模式可能更适合法案。
功劳:Luke Southern / Unsplash
科技行业在2022年末,
来自OpenAI的早期前沿大语言模型(LLMs)以及Anthropic和Google等竞争者可以解释,解决问题,并用自然语言回答向他们提出的详细询问。 但没人知道LLM黑匣子里有什么东西支持服务
很快,Meta的Llama和Mistral等AI模型相继出现,打破了专有AI的垄断。 这些类型的模型可以自由下载并修改,以适应具体的应用。
2024年末,中国DeepSeek公司发布了V3, 一个开放型号, 一个推理模型R1在2025年1月被沿用,被视为对前沿模型的合法威胁。
在去年,阿里巴巴的"Quen"和"Moonshot""Kimi"等开放型号也逐渐在企业中占据了推理,代理和物理AI的地位。 “结果是一个明确的趋势:随着每一代人,开放源代码模型需要一半的时间来赶上这个时代的第一个封闭源代码模型,”本月的一份通讯解释了SemiAnalysis公司。
已解释的开放式模型变化
现在,许多版本的“开放”AI模型正在飘来飘去,包括“开放式”模型和“开源”模型。 虽然它们听起来相似,但了解它们有何不同是很重要的。
企业中最常用的“开放”模式是开放加权模式。 这使得公司能够根据自己的内部要求定制AI服务和工具。 公司领导人和信息技术决策者可以在模型内看到,审计,并将其调整到自己的具体数据。
(原文共 10 张图片,此处展示前 3 张,更多图片请前往原文查看)
(编译自 Computerworld;原文 https://www.computerworld.com/article/4213156/what-are-open-ai-models.html,编译转述,非原文转载)



本文系本站对该英文资讯的编译与转述,非全文翻译;版权归原作者所有。
每天 5 分钟,看懂世界在发生什么
订阅「牛金金天天译站」,每日精选海外科技/AI/文化资讯编译送到你邮箱。非经营性、无广告、可随时退订。
评论