焦李成院士:从ChatGPT到GPT4看下一代人工智能的挑战与机遇

ChatGPT聊天机器人成为全球热议的话题,而且它影响的范围这么广,又掀起的浪潮这么热,实际上也从另外一个方面让大家看到了人工智能的力量。简单的讲,聊天机器人是个程序,但是他背后的东西或者说他能够给我们带来的启示可不是这么简单。也就是说ChatGPT本身所具有的功能是怎么为我们服务的。或者说它在哪些方面跟我们互动,特别是ChatGPT为什么能够对市场有这么大的触动。而且它在短短的两个月之内就达到了一亿的用户。也成为2020年以来全球史上消费者增长最快的应用系统。

我们搜了一个“陕西的美食有什么?”搜的是中文,应该说它至少库里这些东西都有,而且还比较准。其实多位产业界的各种领袖或多或少的对这一新的变革给出了肯定性的评价。马斯克说实际上ChatGPT向人们展示出人工智能有多么的先进。而比尔·盖茨也讲,ChatGPT像互联网发明一样的重要,它也将会改变世界。黄仁勋说的是ChatGPT是人工智能的iPhone,实际上ChatGPT是从量变到质变的长期积累的工作过程。同时ChatGPT的“狂飙”也将推动产业的变革与模式的更新。

尽管ChatGPT取了一定胜利,但是要仔细的去分析它,在趋势上、在技术上、在变革上、在机会和应用上,为什么会这样。ChatGPT为人机交互注入了新的活力,也就是说我们能够做出类人的或者类脑的人工智能的应用系统。但是它的基础研究仍然需要加强。那么人工智能的创新,我们到底应该往哪里走?我们还需要去在哪方面去发力?这件事情值得我们大家去思考。我个人认为人工智能ChatGPT为什么能引起产业界市场这么大的反应,作为一个教育工作者,更应该从学术上去再思考,再认知,使得ChatGPT的发展更加健康,更加有序,而且底子更厚,基础更扎实,前行的步伐更稳。

实际上,现在的ChatGPT远远还没有达到真正类人的那种程度,还不具备创造性工作的能力,同时它也不可能代替人类的思考。金耀初院士指出,ChatGPT的出世非一日之功,但是仍然尚不具备自主的心智,ChatGPT不是万能的,但是未来的各种突破是可能的。吴飞教授指出ChatGPT是一个现象级的产品,但本质上它仍然是以深度学习为代表的人工智能技术长期发展积累的结果。距离真正模拟人类的思维还非常的遥远。张军平教授也谈到ChatGPT只是看起来具有人的心智,但并不具有人的心智。所以说ChatGPT是技术上的进步,是技术上的变革,也是技术上的推动。但是它仍然处于初级阶段,目前它只能作为工具辅助人类工作,而不能代替业务。那言下之意就是说仍然有很大的发展空间,需要我们做长期的、艰苦的、扎实的、基础性的工作。

ChatGPT作为人工智能颠覆性技术革命的一个引子和代表。王志刚部长更是讲到ChatGPT从源头看来是自然语言的理解、自然语言处理两个方向的技术,而不是人工智能的全部。它是一个大模型,对大数据和算法依赖性很强。但是对更多更复杂的场景任务,怎么样通过场景驱动技术迁移,去实现产学研的相结合,做出颠覆性的工作?

ChatGPT的本质为大语言模型,其实更重要的是表征、学习和优化,就是深度学习技术或者深度神经网络所具有的三件法宝或者三个核心。Transformer是全局的表征能力强和高度的并行性,使得它的解的质量高,同时也比较快速,而Transformer的架构和无监督学习的结合,使得GPT的系列模型不需要针对特定的任务从头开始训练网络。能够在NLP任务中有非常好的性能,它的发展也是经过了这样长长的一个过程。ChatGPT是在海量的文本数据上进行的预训练。对自然语言输入产生类似于人类的回答。回过头来,如果是图像,视频的数据会怎么样?其他的数据会怎么样?这些工作ChatGPT无法给出这样的好的答案。

ChatGPT有三个关键词,生成,预训练,Transformer。应该说这些核心的基础,从结构到一系列的微调,以及到对小样本的处理和并行的优化。特别是采用了强化学习,也就是人类反馈的强化学习,使得整个的效率有了很大的提高。

ChatGPT认为认知智能分为五个阶段,也就是知觉与感知、表示与推理、自主学习、创造性思维以及自然交互五个阶段。实际上到现在为止,ChatGPT自我评分认为达到了第三个阶段,也就是自主学习的阶段。虽然说只具有一定的自主学习的能力,但是距离真正的人还有很长的距离。对于知识的感知、表征、推理、决策等,技术本身需要完善,基础理论更待加强。自然语言处理技术只是人工智能许多方面中间的一个核心的技术。人工智能基础理论的范围是很宽阔的,是很广大的,而且它的应用要更广。从这个意义上来讲,无论是基础理论、软硬件系统、核心技术,还是它的场景应用,我们还有很长的路要走,还有许多的领域需要我们像对待ChatGPT那样去努力工作,去进行核心算法和基础理论的。深入基础理论的研究,核心算法的革新,以创造性的思维拥抱ChatGPT,那样才能有一个良好的人工智能,这样才能使我们整个科学技术和社会的发展有一个良好的伦理道德。

目前ChatGPT的数学基础、数理逻辑都有待提高。ChatGPT给我们带来的挑战是前所未有的,变革也是前所未有的。如果回到人工智能的源头,我们对数据和知识的协同学习、推理、联想记忆、情景感知怎么做?ChatGPT能有多少是我们得到满意的结果?而这些恰恰是人工智能的基础和本质所在。唐朝诗人杜牧的千古名作《清明》,实际上给我们很大的启示。这首诗它蕴含的意义ChatGPT能理解多少,这首诗的内涵和意义能理解多少。“清明时节雨纷纷,路上行人欲断魂。借问酒家何处有,牧童遥指杏花村”。这个就表现出了现在ChatGPT有多少对情感内涵的理解能力。我们对先验知识,对环境的感知能力,有多少能够去像人们要求的那样,非常舒适的去应用和理解。ChatGPT的训练数据主要是互联网上的对话文本,那这个时候对文本可能存在偏见,例如性别、种族、地理。其实所有的知识,那怎么去处理、实际应用系统中怎么样去减少、或者说弱化这些偏见的影响,如何进行数据和知识的协同学习,如何做个更好的、合理的、符合实际情景的决策,依然是人工智能本质性的问题和基础性的问题。大家知道语音识别的难题也是这个。

对视觉环境的感知,相对波士顿动力的机器人,ChatGPT是具有一定的推理能力。但是对环境的感知、认知、推理和决策还是比较缺乏的。波士顿动力同样也经过了四十年的历程,才有今天的发展。这四十年的发展是对环境的感知、认知、推理和决策的深度研究。微软公开的VisualChatGPT,它在ChatGPT的基础上集成了多种视觉的模型来实现模态交互的功能。怎么对复杂的场景,通过视觉的感知去做,或者说怎么样在视觉感知的基础之上,建立相应的VisualChatGPT,或者说它的功能更加和人类实际场景靠近,还需要许多工作去做。同时,微软也将GPT4接入Office全家桶,GPT-4在技术层面建立了预测扩展的深度学习栈,设计了正确和错误解决方案、弱推理和强推理、自相矛盾和一致的陈述,以及各种各样的意识形态和想法。

ChatGPT对教育的推动更是巨大的,也会引发教育的新的变革。他可能对学生更好的学习起到很大的帮助,也触及了教育的改革和进步,引发了教育目标、教学方式、学习的方式、学习知识等深入的思考。但并不等于能够去创新。所以说以知识传递为核心的教育的模式受到挑战的同时,尤其是创新能力的培养,又摆在了我们的面前,这是真正做创新性教育、变革性教育的基础。

工信部十七部门提出了“机器人+”的这个应用实现的方案,同样也说明了场景应用的重要性。六个部委提出的《关于加快场景创新及人工智能高水平应用的意见》也说明了这一点。教育部出台的2020到2030高等学校人工智能的创新计划,也是从创新体系和学科体系的布局,人才培养综合考虑。同时教育部出台人工智能领域研究生的指导方案,也说明国家对这是非常重视的。而且这些培养方案更要求我们对人工智能领域要有一个全面的认识。ChatGPT所涉及的自然语言处理领域也是必不可少的一部分。

经过三十余年的积累,我们团队在教育、科技等方面做了一些我们自己的工作。西电是全国三所人工智能+教育的标杆大学之一,我们希望能够在这个领域对人工智能教育做一些探索。面向国家的战略需求,在遥感领域和医疗领域,研制了类似于ChatGPT这样的应用。从感知人工智能到认知人工智能是一个重大的转变,还有很长的路要走,也涉及到各个方面。因此,关于ChatGPT给我们的启发,更需要从源头去创新,从生物机理、物化原理,数学建模、算法设计与优化、硬件设计与实现、开放的环境感知、重大的应用场景等角度,杜绝短板,去全面探索,建立我国全栈式的人工智能生态环境。谢谢大家!

嘉宾简介

焦李成,欧洲科学院外籍院士,俄罗斯自然科学院外籍院士,IEEEFellow。现任西安电子科技大学计算机科学与技术学部主任、人工智能研究院院长、智能感知与图像理解教育部重点实验室主任、教育部科技委学部委员、教育部人工智能科技创新专家组专家、首批入选国家百千万人才工程(第一二层次)、教育部创新团队负责人、“一带一路”人工智能创新联盟理事长,陕西省人工智能产业技术创新战略联盟理事长,中国人工智能学会第六-七届副理事长,IEEE/IET/CAAI/CAA/CIE/CCFFellow,连续七年入选爱思唯尔高被引学者榜单。

焦院士主要研究方向为智能感知与量子计算、图像理解与类脑计算、深度学习与进化优化。曾获国家自然科学奖二等奖、吴文俊人工智能杰出贡献奖、霍英东青年教师奖、全国模范教师称号、中国青年科技奖、及省部级一等奖以上科技奖励十余项。

THE END
1.ChatGPT行业报告:算力.pptx演讲人:日期:ChatGPT行业报告:算力目录引言ChatGPT行业概述算力技术发展算力在ChatGPT中应用算力市场需求与供给算力基础设施建设与运维算力成本效益及投资回报结论与展望01引言本报告旨在深入探讨ChatGPT行业中的算力问题,https://www.renrendoc.com/paper/362740549.html
2.如何利用CHATGPT分析数据快熟生成文案:无论是小红书、微博还是公众号, Chat GPT都能帮你快熟生成吸引眼球的文案,让你的创作更具有吸引力。自动撰写报告:无论是工作汇报还是项目 只需输入相关指令, Chat GPT就能为你生成结构清晰、内容肺腑的报告。Chat GPT使用技巧 1、准确提问 Chat GPT功能虽然非常强大, 但由于目前Chat GPT数据库http://www.hlwwhy.com/ask/6705610.html
3.ChatGPT原理和用法GPT3.5和GPT4的区别,一次给你讲明白1.语义理解限制:尽管ChatGPT能够理解上下文,但在某些情况下仍然存在理解限制,特别是当问题含糊不清或需要深入推理时。 2.偏差和错误:由于ChatGPT是通过大规模训练数据学习而来,它可能会反映出数据中的偏差和错误。这可能导致模型生成不准确或有偏的回答。 https://blog.csdn.net/2301_79635820/article/details/132855837
4.国产版ChatGPT大盘点:百度京东阿里腾讯那在类ChatGPT赛道上,哪些中国版的ChatGPT能快速顶上?都各有哪些困境需要突破呢?本文给诸位带来各个玩家的最新进展。 1、百度:文心一言 3月16日,百度正式推出国内首款生成式AI产品“文心一言”,可支持文学创作、文案创作、数理推算、多模态生成等功能。 https://www.shangyexinzhi.com/article/7656581.html
5.十分钟理解ChatGPT的技术逻辑及演进(前世今生)如果说 可以并行、速度更快都是技术特征,让行外人士、普罗大众还不够直观,那么从 当前ChatGPT的震憾效果就可以窥知一二。 **Transformer从根本上解决了两个关键障碍,其推出是变革性的、革命性的**。 3.5.1、摆脱了人工标注数据集(大幅降低人工数量 ) https://www.51cto.com/article/743197.html
6.五分钟带你了解ChatGPT的基本原理五分钟带你了解ChatGPT的基本原理 简介: What is LLM? LLM是大型语言模型Large Language Model的缩写,跟LLM相关的另外一个概念是NLP(Natural Language Processing自然语言处理技术的一种 )。 Nautual Language: 指的是自然形成的语言,诸如Chinese, English, etchttps://developer.aliyun.com/article/1191601
7.一天现六个国产ChatGPT大模型,“百模大战”全面开打钛媒体焦点钉钉宣布正式接入阿里巴巴“通义千问”大模型;字节跳动旗下火山引擎发布自研DPU(数据处理单元)芯片,以及发布大模型训练云平台等;金山办公宣布将推出 WPS AI,类似于基于ChatGPT技术的微软Copilot产品,金山办公CEO章庆元透露这一技术由国内企业MiniMax提供;APUS在北京推出1000亿个参数、自研多模态的天燕大模型AiLMe,以及基https://static.nfapp.southcn.com/content/202304/20/c7589252.html
8.ChatGPT介绍及国内人工智能产品介绍PPT.pptx发展历程-ChatGPT介绍ChatGPT是美国人工智能研究实验室OpenAI新推出的一种人工智能技术驱动的自然语言处理工具,使用了Transformer神经网络架构,也是GPT-3.5架构,这是一种用于处理序列数据的模型,拥有语言理解和文本生成能力,尤其是它会通过连接大量的语料库来训练模型,这些语料库包含了真实世界中的对话,使得ChatGPT具备上知https://max.book118.com/html/2024/0509/8056100031006066.shtm
9.我们向百度文心一言和ChatGPT问了几个同样的问题,结果很意外ChatGPT: 作为人工智能模型,ChatGPT 和百度的文心一言都使用了深度学习算法和自然语言处理技术,可以进行自然语言的理解、生成和对话交互。它们都可以处理大量的信息和语言数据,并具备一定的智能和灵活性。然而,它们的算法和训练数据不同,所以可能有所不同。 https://www.saikr.com/a/507317
10.ChatGPT访问量下降?真相可能是它据SimilarWeb数据显示,前期ChatGPT的访问量增长率惊人,1月份的环比增长率为131.6%,2月份为62.5%,3月份为55.8%,而从4月份开始明显放缓,环比增长率为12.6%,到了5月,这个数字已经变为了2.8%。 截至6月20日,访问量比5月少了38%左右,粗略推算,到6月30日如果没有特别新的刺激,6月的环比或将下降。 https://wallstreetcn.com/articles/3691940
11.ChatGPT的背后:人工智能领域那些巧妙的算法逻辑和数学–数治网ChatGPT是最近的大热门,很多人会很好奇这背后的技术。这个领域的东西,随便聊聊都会涉及普通人比较难理解的数学、算法和逻辑,所以很多科普内容门槛太高了。 但是,也有写得特别好的。之前看过一本书叫做《你一定爱读的人工智能简史》,是由日本的人工智能先驱者,将棋AI“PONANZA”的开发者之一山本一成创作的,他以非常https://dtzed.com/?p=4226
12.通过ChatGPT实现数据整理与分析推荐使用国际直连GPT,立即访问:www.chatgp1.com 通过ChatGPT实现数据整理与分析,可以充分利用其强大的自然语言处理能力和数据生成能力,辅助用户进行数据处理和洞察提取。以下是通过ChatGPT实现数据整理与分析的步骤和方法: 一、数据收集与预处理 数据收集: https://www.729.cn/news/706.html
13.基于ChatGPT的数据权益保护问题研究科技与法OpenAI在公司官网对ChatGPT产生方法进行介绍时说,该模型是使用人类反馈强化学习训练而来,方法与InstructGPT(OpenAI开发的一种“指令生成预训练”语言模型)一致,但在数据收集设置上略有不同。我们通过监督微调的方法训练出一个初始模型:人类人工智能训练师分别扮演用户与AI助手的角色。我们允许AI训练师为模型编写建议,帮助http://www.mzyfz.com/html/1022/2023-07-06/content-1596601.html