目前很难确切地指出谁是世界上最好的 AI 大模型,不同的 AI 大模型在不同方面各有优势。
例如,OpenAI 的 GPT-4 是一个大型多模态模型,在各种专业和学术基准测试中表现出与人类相当的水平。Midjourney v5 模型在生成逼真的 AI 图像方面表现出色,具有极高的一致性,并支持高级功能。DALL·E 3 能轻松将想法转化为极其精准的图像。Mistral 7B 是一个具有 73 亿参数的模型,在多个基准测试上表现优秀。
在中国,阿里云的 Qwen 2 开源了模型,性能超越目前所有开源模型和国内闭源模型。同时,中国也有众多的大模型发布。
然而,对于“最好”的评判标准因应用场景和需求的不同而有所差异。在某些领域,某个模型可能表现出色,而在其他领域则可能是其他模型更具优势。
AI大模型是全球数字技术体系的竞争,这个体系包括芯片、云计算、闭源模型、开源模型、开源生态等等。中国信息化百人会执委、阿里云副总裁安筱鹏指出,全球AI大模型竞争的制高点是AI基础大模型,因为基础大模型决定了产业智能化的天花板,商业闭环的可能性,应用生态的繁荣以及产业竞争的格局。与此同时,开源生态在整个技术体系的竞争中也有着至关重要的作用。优质的开源模型,让海量的中小企业和开发者免于从头开始训练大模型,直接站在前沿技术成果的肩膀上做创新。安筱鹏以“爬珠峰”举例:“生态的价值就是开源的价值就是我派一架直升机,把你从海拔0米的地方运送到珠峰大本营5000米,剩下3000米你再爬。所以能不能建立起开源开放的生态?你要爬珠峰能不能从地面0米到5000米。美国基于开源生态已经聚集了一批这样的公司。阿里云有一个魔搭社区,也是中国最大的一个模型开源社区,就是为把整个创业创新门槛降低。”这正是阿里云“创建开放繁荣的AI生态”的目标所在。大模型应用创新的奇点还远没有到来,阿里云CTO周靖人认为,大模型还有很大一部分潜力没有真正被挖掘出来,当有越来越多的开发者、企业能结合自己的需求,来促进大模型的发展和应用,将带来翻天覆地的变化。阿里云希望以开放的心态把最先进的技术开源出来,支持所有人一起做探索。
作者|林志佳编辑|李小年本文首发于钛媒体APP2022年11月30日,美国OpenAI公司研发的一款ChatGPT的人工智能(AI)聊天机器人产品破土而出。OpenAI可能也没想到,原本ChatGPT只是向消费者展现GPT能力的产品,却能在过去200天里引发从投资人到创业者、从独角兽到大厂、从业界到学术界、从经济学家到科技部部长的广泛关注。与此同时,谷歌、微软、阿里等超30家科技大厂、创业公司、机构相继下场,一时间讨论四起,全球展开了一场AI大模型“军备赛”。《中国人工智能大模型地图研究报告》显示,截至今年5月28日,中国10亿参数规模以上的大模型已发布79个。而美国、中国占全球已发布大模型总量的80%以上。当下行业内达成的一个基本共识是,ChatGPT的出现标志着通用AI的起点和强AI的拐点,是AI领域科技创新和成果应用的一次重大突破,也是新时代数字化的“发电厂”。利用ChatGPT,以SaaS(软件即服务)服务的方式接入到干行百业,所有数字化系统和各个行业都值得用ChatGPT重做一遍。更多人未来期望ChatGPT使企业数字化业务流程更快、更高效、更智能。不过,相比OpenAI和微软公布包括摩根士丹利、Stripe等公司使用ChatGPT的商业案例,国内“百模大战”中却出现了一个怪现象:技术和产品能力似乎都很强,但一到客户手里却出现各种bug,公布对话大模型的公司都在谈自身的技术能力强、场景化方案,部分还公布合作信息,但都极少在公开场合谈商业落地案过程。
OpenAI今年为我们带来了两个最佳AI模型,并将它们打包成一个无与伦比的聊天机器人,很难被超越。不过,别只看到树木而忽略了森林。大模型在各个方面都取得了进步,为我们带来的AI能力是大多数人在一年前无法想象的。我们可以用一点文本生成整个网站、演示文稿和头像。我们可以创造出任何我们想象的图像。明年这个类别会有什么?更多的生成式AI?「大型行为模型」?生成式口语语言模型?AGI?GPT-4(免费可用)——与人类水平相当的LLM:GPT-4是OpenAI在深度学习规模扩大方面的最新里程碑。GPT-4是一个大型多模态模型(接受图像和文本输入,输出文本),在各种专业和学术基准测试中表现出与人类相当的水平。Midjourney v5(免费)——令人惊叹的逼真AI图像-以及五指手:Midjourney V5模型是最新、最先进的模型,具有极高的一致性,擅长以更高分辨率解释自然语言prompt,并支持像使用tile这样的重复图案等高级功能。DALL·E 3(免费可用)——轻松将想法转化为极其精准的图像:现代文本到图像系统往往会忽略单词或描述,迫使用户学习提示工程。DALL·E 3代表了我们生成完全符合文本的图像能力的一大飞跃。Mistral 7B(免费)——迄今为止最优秀的70亿参数模型,Apache 2.0:Mistral 7B是一个具有73亿参数的模型,它:•在所有基准测试上超越了Llama 2 13B•在许多基准测试上超越了Llama 1 34B•在代码任务上接近CodeLlama 7B的性能,同时在英语任务上表现良好