目前 AI 的发展呈现出以下特点和程度:
OpenAI在其内部会议上分享了关于通用人工智能(AGI)的五个发展等级。OpenAI自2015年成立以来,一直将AGI作为其战略目标之一,随着ChatGPT、多模态大模型和AI Agent等技术的发展,我们似乎越来越接近实现这一目标。AGI的五个等级分别为:1.聊天机器人(Chatbots):具备基本对话能力的AI,主要依赖预设脚本和关键词匹配,用于客户服务和简单查询响应。2.推理者(Reasoners):具备人类推理水平的AI,能够解决复杂问题,如ChatGPT,能够根据上下文和文件提供详细分析和意见。3.智能体(Agents):不仅具备推理能力,还能执行全自动化业务的AI。目前许多AI Agent产品在执行任务后仍需人类参与,尚未达到完全智能体的水平。4.创新者(Innovators):能够协助人类完成新发明的AI,如谷歌DeepMind的AlphaFold模型,可以预测蛋白质结构,加速科学研究和新药发现。5.组织(Organizations):最高级别的AI,能够自动执行组织的全部业务流程,如规划、执行、反馈、迭代、资源分配和管理等。
AI分为ANI和AGI,ANI得到巨大发展但是AGI还没有取得巨大进展。ANI,artificial narrow intelligence弱人工智能。这种人工智能只可做一件事,如智能音箱,网站搜索,自动驾驶,工厂与农场的应用等。AGI,artificial general intelligence,做任何人类可以做的事[heading5]机器学习[content]监督学习,从A到B,从输入到输出。为什么近期监督学习会快速发展,因为现有的数据快速增长,神经网络规模发展以及算力快速发展。[heading5]什么是数据?[content]数据集,又称为资料集、数据集合或资料集合,是一种由数据所组成的集合。Data set(或dataset)是一个数据的集合,通常以表格形式出现。每一列代表一个特定变量。每一行都对应于某一成员的数据集的问题。它列出的价值观为每一个变量,如身高和体重的一个物体或价值的随机数。每个数值被称为数据资料。对应于行数,该数据集的数据可能包括一个或多个成员。如何获取数据,一,手动标注,二,观察行为,三,网络下载。使用数据的方法,如果开始搜集数据,可以马上将数据展示或者喂给某个AI团队,因为大多数AI团队可以反馈给IT团队,说明那种类型数据需要收集,以及应该继续构建那种类型的IT基础框架。数据不一定多就有用,可以尝试聘用AI团队要协助梳理数据。有时数据中会出现,不正确,缺少的数据,这就需要有效处理数据。数据同时分为结构化数据与非结构化数据。结构化数据可以放在巨大的表格中,人们理解图片,视频,文本很简单,但是这种非结构化数据机器处理起来更难一些。
当开源大模型爆发,大模型无处不在。未来AGI竞争的关键是云端超级大模型,最近美国的巨头都在进军这个领域。大模型现在越做越小,一加推出手机,这两天斯坦福推了一个叫章鱼的大模型,可以跑在手机上。杨元庆这两天是不是在推AIPC。我们今天的重点是讲企业大模型市场崛起。因为现在通用大模型也遇到瓶颈。算力可能遇到点瓶颈,英伟达挣的盆满钵满,算力的背后是能源。但我今天还发了一个短视频,他们碰到知识不够的问题了。因为人工智能也在超越人类,之前还在跟人类学习,人类原来也没有意识把很多知识沉淀下来。所以他们现在发展到什么程度呢?像他们最近发现,百度贴吧里的“弱智吧”原来是特别好的学习知识的地方。这个“弱智吧”名字没起好,其实里边一点都不弱智,里边的问题都挺难回答的。我去看了看,好多问题我都回答不出来。比如说明明是睡觉,为什么要去酒店?明明是喝酒,为什么要去夜店?睡觉应该去夜店睡觉,喝酒才去酒店喝酒对吧?所以不要看互联网上满是数据,数据不等于信息,信息不等于知识,知识不等于智慧。所以训大模型就需要把饱含人类智慧的高含量的知识训进去。