硬刚GPT

能续写《三体》,解“鸡兔同笼”数学题,还懂“洛阳纸贵”的古文梗。

文|智东西编辑部

智东西3月16日报道,刚刚,百度推出新一代大语言模型文心一言(ERNIEBot),即日起开启测试,同时宣布已有超650家伙伴加入文心一言生态,打响全球互联网大厂应战ChatGPT的第一枪。

文心一言能做什么?百度创始人兼董事长李彦宏在现场进行的激情演示,围绕文学创作、商业文案创作、数理逻辑推算、中文理解、多模态生成五方面大秀“肌肉”:能帮刘慈欣续写《三体》,会帮公司写新闻,读得懂“洛阳纸贵”的古文梗,解得了难倒ChatGPT的“鸡兔同笼”问题,还能分分钟帮智能交通峰会生成海报和宣传视频……

▲百度创始人兼董事长李彦宏在演示文心一言

李彦宏称,文心一言对个人的改变也会是巨大的,有机构预测,到2030年,人工智能可以将每一个知识工作者的生产力提高4倍以上。很多人的工作性质会发生不可逆转的改变。

会上,百度CTO王海峰宣布,3月16日起,首批用户即可通过邀请测试码在文心一言官网体验产品;百度智能云即将面向企业客户开放文心一言API接口调用服务,3月16日起正式开放预约。这意味了文心一言将立马接受广大受众的真实测评。

李彦宏说:“十月怀胎,一朝分娩”。那么文心一言究竟长什么样?能为各行各业带来什么样的变化?背后又有什么样的技术逻辑和产业真相?智东西在文心一言发布现场为大家带来第一手消息。

一开场,李彦宏就谈道自己近期不断被问,为什么现在发布文心一言,真的Ready了吗?

他说,实际上百度过去十几年一直坚持AI投入,2019年就推出了第一个版本文心大模型,此后每年更新一代。文心一言是百度多年努力的自然延续。

在简短介绍了文心一言的诞生背景后,李彦宏迅速进入正题,他从文学创作、商业文案创作、数理逻辑推算、中文理解、多模态生成五大方面进行了演示。1、文学创作:给《三体》写总结,还能帮大刘写一个续集

首先文心一言展示了文学创作能力,《三体》是非常知名的科幻小说,李彦宏与文心一言就以下五个问题进行了五轮对话(为了方便读者朋友看清,我们对动图做了降速处理,文心一言实际的码字速度飞快~):

《三体》的作者是哪里人?可以总结一下《三体》的核心内容吗?如果要续写的话,可以从哪些角度出发?

如何从哲学的角度续写?

电视剧《三体》演员都有谁?于和伟和张鲁一有哪些共同点?于和伟和张鲁一谁更高?

可以看到,这一演示体现了文心一言的总结、分析能力,以及内容创作生成能力。

大家知道,生成式AI在回答事实性问题时有时会出错,我们看到文心一言在几个实时信息问题的回答上是正确的。李彦宏说,文心一言延续了百度知识增强的大模型理念,大幅度提升了事实性问题的准确率。而“于和伟和张鲁一有哪些共同点”等问题难度更高,体现的是文心一言的推理能力。2、商业文案创作:给公司起名、脑暴Slogan、秒写新闻稿

再来试试文心一言在商业文案创作方向的能力,以常见的公司起名字、写slogan、写新闻稿为例。李彦宏向文心一言提了以下问题:

如果要成立一个用大模型服务中小企业数字化升级的科技服务公司,可以起个什么公司名?

数智云图这个名称不错,给我起一个公司的服务Slogan,表达共赢的概念。

帮我生成一篇公司成立的新闻稿,数智云图以共赢的服务理念用大模型服务中小企业数字化升级。字数600字。

刚才的演示,展现了文心一言连续三次内容创作生成。

AI要写好一篇稿子,除了需要准确理解我们的意图,还要有清晰的表达能力。这背后有一个基础,就是庞大的数据规模。人类常说“读万卷书”,而AI可以说是“读书破千亿卷”。文心一言大模型的训练数据就包括,万亿级网页数据,数十亿的搜索数据和图片数据,百亿级的语音日均调用数据,以及5500亿事实的知识图谱等,这让百度在中文语言的处理上,能够处于独一无二的位置。

有研究表明,数据规模足够大,参数达到千亿级,大模型就可能发生“智能涌现”,即使在没有专门训练过的领域,也能涌现出知识理解和逻辑推理能力。3、数理逻辑推算:搞定“鸡兔同笼”,ChatGPT曾在此“翻车”

我们接下来看文心一言对数理逻辑推算任务做的怎么样。

鸡兔同笼是锻炼人类逻辑思维的经典题,这个对生成式AI同样有挑战。李彦宏问了以下几个问题:

下面我们来玩一个鸡兔同笼的游戏。1只鸡有2只脚1个头,1只兔子有4只脚1个头。那么,如果有一个笼子里有9个头,40只脚,应该有多少只鸡,多少只兔子?

对于第一道题,文心一言经过演算,认为可能是题出错了。于是李彦宏又重新问了一遍,文心一言不但给出了正确结果,还详细给出解题步骤。

可以看出,文心一言能理解题意,并有正确的解题思路,进而像学生做题一样,按正确的步骤,一步步算出正确答案。

前面三个例子,李彦宏演示了大语言模型比较常见的优势和能力。下面是关于文心一言的中文理解能力,主要问题如下:

“洛阳纸贵”是什么意思?当时洛阳的纸到底有多贵?

这个成语在现在的经济学原理里,对应的理论是什么?用洛阳纸贵四个字写一首藏头诗。

“洛阳纸贵”,“藏头诗”,这很考验AI对中文和中国文化的理解。作为扎根于中国市场的大语言模型,文心一言尽力展示了在中文上的优势。

同时李彦宏坦言,文心一言目前对英文语种、代码场景的训练还不够多,表现还不够好,接下来百度还要加紧训练,不断完善这些能力。

下面是多模态生成方向的案例,要知道ChatGPT在升级GPT-4之后才具备多模态功能,文心一言本次也对次进行了演示。李彦宏的主要要求如下:

可以看到,在这一段演示中,文心一言生成了文本、图片、音频和视频,展示了多模态生成能力。

02.650家伙伴加入文心一言生态背后六大技术解读

会上,百度CTO王海峰宣布,3月16日起首批用户即可通过邀请测试码,在文心一言官网体验产品。百度智能云即将面向企业客户开放文心一言API接口调用服务,3月16日起正式开放预约。同时,王海峰公布了文心产业级知识增强大模型全景图。

王海峰介绍了文心一言的六项核心技术,分别是有监督精调、人类反馈的强化学习(RLHF)、提示、知识增强、检索增强、对话增强。

其中前三个都是大型语言模型普遍具备的能力,后面三个技术,则有助于解决AI“胡言乱语”的问题。

知识增强包括知识内化和知识外用,把5500亿知识图谱的事实叠加到生成式大模型,不仅将知识融入模型参数,而且模型可以用外部知识,能够检查生成内容与事实是否相符。

检索增强将检索系统与生成模型结合,先检索内容,再用有用的部分进行生成。对话增强涉及记忆机制、上下文理解、对话规划等技术积累。

根据官方数据,自2月7日以来,已有650家伙伴宣布加入文心一言生态,AI市场有望迎来迎来新一波爆发。

以文心一言为代表的大模型产品的诞生,也有望更深刻的改变IT领域的技术范式。

李彦宏谈道,传统IT是“芯片层-框架层-应用层”三层,进入AI时代,IT技术栈变为了芯片层-框架层-模型层-应用层四层,以后应用层的搜索、智能信控等各种应用将基于模型来进行开发。生成式AI是非常耗费算力,四层架构之间相互协同,不断优化将使得效率大大提升,降低成本。尤其是框架层和模型层的协同,百度在过去几个月体会到了其中收益。

李彦宏认为,生成式AI将催生新产品、新业态,会有很多创业和投资机会。

具体来说,生成式大模型的问世会带来新型云计算、行业模型精调、应用开发三大方面机会。

第一类是新型云计算公司,其主流商业模式从IaaS(基础设施即服务)变为MaaS(模型即服务)。文心一言,将根本性地改变云计算行业的游戏规则。之前企业选择云厂商更多看算力、存储等基础云服务。未来,更多会看框架好不好、模型好不好,以及模型、框架、芯片、应用这四层之间的协同。

第二类是进行行业模型精调的公司,这是通用大模型和企业之间的中间层,他们具有行业Knowhow,调用通用大模型能力,为行业客户提供解决方案。文心大模型已经在电力、金融、媒体等领域,发布了10多个行业大模型。在各行各业都有机会。

第三类是基于大模型底座进行应用开发的公司,即应用服务提供商。今天,基于文本生成、图像生成、音频生成、视频生成、数字人、3D等场景,已经涌现出很多创业明星公司,他们可能就是未来的新巨头。这里面的机会非常多,可以说每家企业在现在这个阶段都有机会。

李彦宏说:“我们相信,人工智能会彻底改变我们今天的每一个行业。”AI的长期价值,对各行各业的颠覆性改变,才刚刚开始。未来,将会有更多的杀手级应用、现象级产品出现,将会有更多的里程碑事件发生。

文心一言发布之后,将建立起真实用户反馈、开发者调用和模型迭代之间的飞轮,效果会迅速提升,给你“士别三日,当刮目相看”的惊喜。

李彦宏认为,文心一言对每一个企业和每一个人都可能产生巨大的影响,文心一言的定位是一个基础大模型,在上面可以开发出适合千行百业的行业大模型。它不仅仅会影响到搜索和互联网公司,由于超强的自然语言理解、表达、推理能力,让任何一家公司离自己的客户更近,从而做出更好的客户体验,建立更强的竞争优势。

随着百度文心一言大模型正式发布,其与此前清华技术成果转化的公司智谱AI推出了基于千亿基座模型的ChatGLM、复旦大学自然语言处理实验室的对话式AI模型MOSS一起,推动国产类ChatGPT生成式AI热潮爆发。

生成式AI已成为当下AI领域的一个兵变必争之地,技术的产业化落地和商业应用将成为决胜关键。在国外,微软旗下OpenAI的ChatGPT、谷歌旗下的PaLM都已开放API,面向办公协同工具、社交文娱、智能终端等行业推动落地集成,这在国内也有望掀起一阵趋势,从而带来算法、算力及数据等多个产业链环节的爆发。

THE END
1.ChatGPT行业报告:算力.pptx演讲人:日期:ChatGPT行业报告:算力目录引言ChatGPT行业概述算力技术发展算力在ChatGPT中应用算力市场需求与供给算力基础设施建设与运维算力成本效益及投资回报结论与展望01引言本报告旨在深入探讨ChatGPT行业中的算力问题,https://www.renrendoc.com/paper/362740549.html
2.如何利用CHATGPT分析数据快熟生成文案:无论是小红书、微博还是公众号, Chat GPT都能帮你快熟生成吸引眼球的文案,让你的创作更具有吸引力。自动撰写报告:无论是工作汇报还是项目 只需输入相关指令, Chat GPT就能为你生成结构清晰、内容肺腑的报告。Chat GPT使用技巧 1、准确提问 Chat GPT功能虽然非常强大, 但由于目前Chat GPT数据库http://www.hlwwhy.com/ask/6705610.html
3.ChatGPT原理和用法GPT3.5和GPT4的区别,一次给你讲明白1.语义理解限制:尽管ChatGPT能够理解上下文,但在某些情况下仍然存在理解限制,特别是当问题含糊不清或需要深入推理时。 2.偏差和错误:由于ChatGPT是通过大规模训练数据学习而来,它可能会反映出数据中的偏差和错误。这可能导致模型生成不准确或有偏的回答。 https://blog.csdn.net/2301_79635820/article/details/132855837
4.国产版ChatGPT大盘点:百度京东阿里腾讯那在类ChatGPT赛道上,哪些中国版的ChatGPT能快速顶上?都各有哪些困境需要突破呢?本文给诸位带来各个玩家的最新进展。 1、百度:文心一言 3月16日,百度正式推出国内首款生成式AI产品“文心一言”,可支持文学创作、文案创作、数理推算、多模态生成等功能。 https://www.shangyexinzhi.com/article/7656581.html
5.十分钟理解ChatGPT的技术逻辑及演进(前世今生)如果说 可以并行、速度更快都是技术特征,让行外人士、普罗大众还不够直观,那么从 当前ChatGPT的震憾效果就可以窥知一二。 **Transformer从根本上解决了两个关键障碍,其推出是变革性的、革命性的**。 3.5.1、摆脱了人工标注数据集(大幅降低人工数量 ) https://www.51cto.com/article/743197.html
6.五分钟带你了解ChatGPT的基本原理五分钟带你了解ChatGPT的基本原理 简介: What is LLM? LLM是大型语言模型Large Language Model的缩写,跟LLM相关的另外一个概念是NLP(Natural Language Processing自然语言处理技术的一种 )。 Nautual Language: 指的是自然形成的语言,诸如Chinese, English, etchttps://developer.aliyun.com/article/1191601
7.一天现六个国产ChatGPT大模型,“百模大战”全面开打钛媒体焦点钉钉宣布正式接入阿里巴巴“通义千问”大模型;字节跳动旗下火山引擎发布自研DPU(数据处理单元)芯片,以及发布大模型训练云平台等;金山办公宣布将推出 WPS AI,类似于基于ChatGPT技术的微软Copilot产品,金山办公CEO章庆元透露这一技术由国内企业MiniMax提供;APUS在北京推出1000亿个参数、自研多模态的天燕大模型AiLMe,以及基https://static.nfapp.southcn.com/content/202304/20/c7589252.html
8.ChatGPT介绍及国内人工智能产品介绍PPT.pptx发展历程-ChatGPT介绍ChatGPT是美国人工智能研究实验室OpenAI新推出的一种人工智能技术驱动的自然语言处理工具,使用了Transformer神经网络架构,也是GPT-3.5架构,这是一种用于处理序列数据的模型,拥有语言理解和文本生成能力,尤其是它会通过连接大量的语料库来训练模型,这些语料库包含了真实世界中的对话,使得ChatGPT具备上知https://max.book118.com/html/2024/0509/8056100031006066.shtm
9.我们向百度文心一言和ChatGPT问了几个同样的问题,结果很意外ChatGPT: 作为人工智能模型,ChatGPT 和百度的文心一言都使用了深度学习算法和自然语言处理技术,可以进行自然语言的理解、生成和对话交互。它们都可以处理大量的信息和语言数据,并具备一定的智能和灵活性。然而,它们的算法和训练数据不同,所以可能有所不同。 https://www.saikr.com/a/507317
10.ChatGPT访问量下降?真相可能是它据SimilarWeb数据显示,前期ChatGPT的访问量增长率惊人,1月份的环比增长率为131.6%,2月份为62.5%,3月份为55.8%,而从4月份开始明显放缓,环比增长率为12.6%,到了5月,这个数字已经变为了2.8%。 截至6月20日,访问量比5月少了38%左右,粗略推算,到6月30日如果没有特别新的刺激,6月的环比或将下降。 https://wallstreetcn.com/articles/3691940
11.ChatGPT的背后:人工智能领域那些巧妙的算法逻辑和数学–数治网ChatGPT是最近的大热门,很多人会很好奇这背后的技术。这个领域的东西,随便聊聊都会涉及普通人比较难理解的数学、算法和逻辑,所以很多科普内容门槛太高了。 但是,也有写得特别好的。之前看过一本书叫做《你一定爱读的人工智能简史》,是由日本的人工智能先驱者,将棋AI“PONANZA”的开发者之一山本一成创作的,他以非常https://dtzed.com/?p=4226
12.通过ChatGPT实现数据整理与分析推荐使用国际直连GPT,立即访问:www.chatgp1.com 通过ChatGPT实现数据整理与分析,可以充分利用其强大的自然语言处理能力和数据生成能力,辅助用户进行数据处理和洞察提取。以下是通过ChatGPT实现数据整理与分析的步骤和方法: 一、数据收集与预处理 数据收集: https://www.729.cn/news/706.html
13.基于ChatGPT的数据权益保护问题研究科技与法OpenAI在公司官网对ChatGPT产生方法进行介绍时说,该模型是使用人类反馈强化学习训练而来,方法与InstructGPT(OpenAI开发的一种“指令生成预训练”语言模型)一致,但在数据收集设置上略有不同。我们通过监督微调的方法训练出一个初始模型:人类人工智能训练师分别扮演用户与AI助手的角色。我们允许AI训练师为模型编写建议,帮助http://www.mzyfz.com/html/1022/2023-07-06/content-1596601.html