人工智能前沿——「全域全知全能」人类新宇宙ChatGPT

加勒比海带66 2023-11-12 原文

🚀🚀🚀OpenAI聊天机器人ChatGPT——「全域全知全能」人类全宇宙大爆炸！！🔥🔥🔥

一、什么是ChatGPT?🍀🍀

ChatGPT是生成型预训练变换模型（Chat Generative Pre-trained Transformer）的缩写，是一种语言模型。而OpenAI所提出的这一系列的模型，可以执行非常复杂的任务，如回复问题、生成文章和程序代码，或者翻译文章内容等。而GPT中的Transformer是指由Google Brain所推出的解码器（decoder），是用来处理输入的自然语言以处理翻译、摘要等。ChatGPT是OpenAI开发的一种创新AI模型，利用强大的GPT-3系列，并通过人类反馈与强化学习相一致。ChatGPT是一个聊天机器人，它为对话带来了一个新的互动和参与水平，对问题提供了深刻和发人深省的回答。

但ChatGPT不仅仅是个聊天机器人，而是上知天文下知地理、可以针对使用者问题给予相应的长篇回复；问答解惑、写程式和debug，甚至撰写论文、剧本小说诗歌等等，都难不倒它，只是有时还是会出现令人啼笑皆非的答案，但都还编得有模有样、令人惊艳。

ChatGPT自2022年11月30日开放公众使用以来，已经吸引超过100万人使用，社群媒体也涌现了大量用户的测试截图，主题广泛，个个都在测试人工智慧的极限。

总之，ChatGPT是一个非常强大和多功能的人工智能模型，能够提供有洞察力和吸引人的对话，并以多种不同的方式推进人工智能研究领域。OpenAI创建ChatGPT的努力无疑是一个令人印象深刻的壮举，为AI的未来提供了不可思议的潜力。

二、ChatGPT的作者是谁？🍀🍀

ChatGPT由马斯克（Elon Musk）参与创立的独立研究机构OpenAI基金会所研发，初衷是为了确保AI最终不会消灭人类。

三、ChatGPT是如何训练的?🍀🍀

📚📚ChatGPT的训练过程分为以下三个阶段👇👇

✨✨第一阶段：

冷启动阶段的监督策略模型。靠GPT 3.5本身，尽管它很强，但是它很难理解人类不同类型指令中蕴含的不同意图，也很难判断生成内容是否是高质量的结果。为了让GPT 3.5初步具备理解指令中蕴含的意图，首先会从测试用户提交的prompt(就是指令或问题)中随机抽取一批，靠专业的标注人员，给出指定prompt的高质量答案，然后用这些人工标注好的<prompt,answer>数据来Fine-tune GPT 3.5模型。经过这个过程，我们可以认为GPT 3.5初步具备了理解人类prompt中所包含意图，并根据这个意图给出相对高质量回答的能力，但是很明显，仅仅这样做是不够的。

✨✨第二阶段：

训练回报模型（Reward Model,RM）。这个阶段的主要目的是通过人工标注训练数据，来训练回报模型。具体而言，随机抽样一批用户提交的prompt(大部分和第一阶段的相同)，使用第一阶段Fine-tune好的冷启动模型，对于每个prompt，由冷启动模型生成K个不同的回答，于是模型产生出了<prompt,answer1>,<prompt,answer2>….<prompt,answerK>数据。之后，标注人员对K个结果按照很多标准（上面提到的相关性、富含信息性、有害信息等诸多标准）综合考虑进行排序，给出K个结果的排名顺序，这就是此阶段人工标注的数据。

接下来，我们准备利用这个排序结果数据来训练回报模型，采取的训练模式其实就是平常经常用到的pair-wise learning to rank。对于K个排序结果，两两组合，形成个训练数据对，ChatGPT采取pair-wise loss来训练Reward Model。RM模型接受一个输入<prompt,answer>，给出评价回答质量高低的回报分数Score。对于一对训练数据<answer1,answer2>，我们假设人工排序中answer1排在answer2前面，那么Loss函数则鼓励RM模型对<prompt,answer1>的打分要比<prompt,answer2>的打分要高。

归纳下：在这个阶段里，首先由冷启动后的监督策略模型为每个prompt产生K个结果，人工根据结果质量由高到低排序，以此作为训练数据，通过pair-wise learning to rank模式来训练回报模型。对于学好的RM模型来说，输入<prompt,answer>，输出结果的质量得分，得分越高说明产生的回答质量越高。

✨✨第三阶段：

采用强化学习来增强预训练模型的能力。本阶段无需人工标注数据，而是利用上一阶段学好的RM模型，靠RM打分结果来更新预训练模型参数。具体而言，首先，从用户提交的prompt里随机采样一批新的命令（指的是和第一第二阶段不同的新的prompt，这个其实是很重要的，对于提升LLM模型理解instruct指令的泛化能力很有帮助），且由冷启动模型来初始化PPO模型的参数。然后，对于随机抽取的prompt，使用PPO模型生成回答answer，并用上一阶段训练好的RM模型给出answer质量评估的回报分数score，这个回报分数就是RM赋予给整个回答（由单词序列构成）的整体reward。有了单词序列的最终回报，就可以把每个单词看作一个时间步，把reward由后往前依次传递，由此产生的策略梯度可以更新PPO模型参数。这是标准的强化学习过程，目的是训练LLM产生高reward的答案，也即是产生符合RM标准的高质量回答。

如果我们不断重复第二和第三阶段，很明显，每一轮迭代都使得LLM模型能力越来越强。因为第二阶段通过人工标注数据来增强RM模型的能力，而第三阶段，经过增强的RM模型对新prompt产生的回答打分会更准，并利用强化学习来鼓励LLM模型学习新的高质量内容，这起到了类似利用伪标签扩充高质量训练数据的作用，于是LLM模型进一步得到增强。显然，第二阶段和第三阶段有相互促进的作用，这是为何不断迭代会有持续增强效果的原因。

尽管如此，我觉得第三阶段采用强化学习策略，未必是ChatGPT模型效果特别好的主要原因。假设第三阶段不采用强化学习，换成如下方法：类似第二阶段的做法，对于一个新的prompt，冷启动模型可以产生k个回答，由RM模型分别打分，我们选择得分最高的回答，构成新的训练数据<prompt,answer>,去fine-tune LLM模型。假设换成这种模式，我相信起到的作用可能跟强化学习比，虽然没那么精巧，但是效果也未必一定就差很多。第三阶段无论采取哪种技术模式，本质上很可能都是利用第二阶段学会的RM，起到了扩充LLM模型高质量训练数据的作用。

以上是ChatGPT的训练流程。

四、ChatGPT的演变历程🍀🍀

1. GPT-1

就是第一代GPT模型，于2018年6月诞生时，就已经是个强大的语言理解模型。从判断两个句子间的语意与关系、文本资料分类、问答与常识推理都难不倒，只是并非好的对话式AI模型，训练参数也远低于后续模型。

2. GPT-2

2019年2月OpenAI又推出了由GPT-1演变而来的GPT-2，但主要改变只有使用了更多参数与数据集，参数量达15亿（GPT-1仅有1.17亿），而学习目标改成了「无特定任务训练」。这证明了，大幅增加的参数和资料可以让GPT-2比起GPT-1更上一层楼，虽然有些任务的表现不比随机的好，但在生成短文和编故事等方面都有了一定的突破。

3. GPT-3／GPT-3.5

2020年GPT-3也受简单粗暴地用钱堆出了更多的运算资源，延续过去GPT类的单向语言模型的训练方式，只是将模型增大到1750亿参数。GPT-3在自然语言处理领域已经取得了重大的突破，成为了当时最大、最强大的自然语言生成模型，从机器翻译到文章总结输出，都有着非常出色的表现。

只是，2020年因为疫情严峻所致，人们对于人工智慧领域的突破并没有足够的关注。而且，比起ChatGPT，GPT-3并没有办法进行自然的对话，只能处理单向的任务，因此也只有少数开发者有兴趣。

直到2022年11月底，OpenAI才发布了「GPT-3.5」的更新，主打对话模式，甚至可以承认错误、且拒绝不恰当的请求──这就是支持ChatGPT背后的模型，其更接近人类对话与思考方式的特点也吸引了全球的目光。

4. GPT-4

距上次GPT-3.5的更新不久，2023年3月14日，OpenAI又抛出GPT-4，此次除了正确度高出40%、以整理和搜寻网络上的资讯为主，还可以支援视觉输入、图像辨识，并懂得「看图说故事」！不过GPT-4没有再砸下重金、狂堆训练参数，而是把研发的重点将放在提升利用现有数据的能力上。

🚀🏆🍀【算法创新&算法训练&论文投稿】相关链接👇👇👇

——————————————🌴【重磅干货来袭】🎄——————————————

🌴 持续更新中……

🚀四、检测头部改进（持续更新中）🎄🎈

1.魔改YOLOv5/YOLOv7高阶版——改进之结合解耦头Decoupled_Detect

2.目标检测算法——YOLOv5/YOLOv7改进结合涨点Trick之ASFF（自适应空间特征融合）

🌴 持续更新中……

🚀五、空间金字塔池化（持续更新中）🎄🎈

1.目标检测算法——YOLOv5/YOLOv7改进之结合ASPP（空洞空间卷积池化金字塔）

2.目标检测算法——YOLOv5/YOLOv7改进之结合特征提取网络RFBNet（涨点明显）

🌴 持续更新中……

💖💖>>>加勒比海带，QQ2479200884<<<💖💖

🏆🏆>>>【YOLO魔法搭配&论文投稿咨询】<<<🏆🏆

🐱‍🏍🐱‍🏍>>>学习交流 | 温澜潮生 | 合作共赢 | 共同进步<<<💯💯

📚📚>>>人工智能 | 计算机视觉 | 深度学习Tricks | 第一时间送达<<<

📚📚

关于YOLO算法改进&论文投稿可关注并留言博主的QQ/CSDN

🎈🎄>>>一起交流！互相学习！共同进步！<<<🎄🎈

有关人工智能前沿——「全域全知全能」人类新宇宙ChatGPT的更多相关文章

世界前沿3D开发引擎HOOPS全面讲解——集3D数据读取、3D图形渲染、3D数据发布于一体的全新3D应用开发工具 - 2
无论您是想搭建桌面端、WEB端或者移动端APP应用，HOOPSPlatform组件都可以为您提供弹性的3D集成架构，同时，由工业领域3D技术专家组成的HOOPS技术团队也能为您提供技术支持服务。如果您的客户期望有一种在多个平台（桌面/WEB/APP，而且某些客户端是“瘦”客户端）快速、方便地将数据接入到3D应用系统的解决方案，并且当访问数据时，在各个平台上的性能和用户体验保持一致，HOOPSPlatform将帮助您完成。利用HOOPSPlatform，您可以开发在任何环境下的3D基础应用架构。HOOPSPlatform可以帮您打造3D创新型产品，HOOPSSDK包含的技术有：快速且准确的CAD
亚特兰蒂斯的回声（中文版): chatGPT 的杰作 - 2
英文版英文链接关注公众号在“亚特兰蒂斯的回声”中踏上一段难忘的冒险之旅，深入未知的海洋深处。足智多谋的考古学家AriaSeaborne偶然发现了一件古代神器，揭示了一张通往失落之城亚特兰蒂斯的隐藏地图。在她神秘的导师内森·兰登教授的指导和勇敢的冒险家亚历克斯·默瑟的帮助下，阿丽亚开始了一段危险的旅程，以揭开这座传说中城市的真相。他们的冒险之旅带领他们穿越险恶的大海、神秘的岛屿和充满陷阱和谜语的致命迷宫。随着Aria潜在的魔法能力的觉醒，她被睿智勇敢的QueenNeria的幻象所指引，她让她为即将到来的挑战做好准备。三人组揭开亚特兰蒂斯令人惊叹的隐藏文明，并了解到邪恶的巫师马拉卡勋爵试图利用其古
玩以太坊链上项目的必备技能（初识智能合约语言-Solidity之旅一） - 2
前面一篇关于智能合约翻译文讲到了，是一种计算机程序，既然是程序，那就可以使用程序语言去编写智能合约了。而若想玩区块链上的项目，大部分区块链项目都是开源的，能看得懂智能合约代码，或找出其中的漏洞，那么，学习Solidity这门高级的智能合约语言是有必要的，当然，这都得在公链``````以太坊上，毕竟国内的联盟链有些是不兼容Solidity。Solidity是一种面向对象的高级语言，用于实现智能合约。智能合约是管理以太坊状态下的账户行为的程序。Solidity是运行在以太坊（Ethereum）虚拟机（EVM）上，其语法受到了c++、python、javascript影响。Solidity是静态类型
智能客服 | 浅谈人工智能聊天机器人ChatGPT - 2
2022年底，OpenAI的预训练模型ChatGPT给人工智能领域的爱好者和研究人员留下了深刻的印象和启发，他展现的惊人能力将人工智能的研究和应用热度推向高潮，网上也充斥着和ChatGPT的各种聊天，他可以作诗、写小说、写代码、讨论疫情问题等。下面就是一些他的神回复：人命关天的坑：写歌，留给词作者的机会不多了。。。回答人类怎么样面对人工智能：什么是ChatGPT？借用网上的一段介绍，ChatGPT是由人工智能研究实验室OpenAI在2022年11月30日发布的全新聊天机器人模型，一款人工智能技术驱动的自然语言处理工具。它能够通过学习和理解人类的语言来进行对话，还能根据聊天的上下文进行互动
【ChatGPT】ChatGPT 的 N 种用法 - 2
目录ChatGPT简介技术原理应用未来发展ChatGPT的10 种用法ChatGPT简介ChatGPT是一种基于深度学习的大型语言模型，由OpenAI公司开发。技术原理GPT是GenerativePre-trainedTransformer的缩写，意为生成式预训练变压器。它的技术原理是使用了一个基于注意力机制的变压器（Trans
「想体验ChatGPT中文聊天？」那快进来，你用不上算我输 - 2
♥️作者：白日参商🤵‍♂️个人主页：白日参商主页♥️坚持分析平时学习到的项目以及学习到的软件开发知识，和大家一起努力呀！！！🎈🎈加油！加油！加油！加油🎈欢迎评论💬点赞👍🏻收藏📂加关注+！「想体验ChatGPT中文聊天？」那快进来，你用不上算我输项目场景：项目条件一、那就开始吧1、安装ChatGPT-Desktop2、OpenAPI设置二、使用实例恭喜你！！！配置成功了！！！API和URL都是博主免费提供给大家的！！！恭喜你！！！配置成功了！！！API和URL都是博主免费提供给大家的！！！🎈🎈加油！加油！加油！加油🎈欢迎评论💬点赞👍🏻收藏📂加关注+！项目场景：近几个月可以说ChatGPT是火得一
半个月狂飙1000亿，ChatGPT概念股凭什么？ - 2
ChatGPT掀起了AI股历史上最疯狂的一轮市值狂飙。自春节后至今，ChatGPT概念股开始了暴走模式，短短半月时间，海天瑞声、开普云等ChatGPT概念股市值累计增加了近1400亿。如此的爆炸效应，得益于ChatGPT所展现出商业化落地的巨大潜力。要知道，在此之前，无论是十年AI投入超千亿的百度，还是困在硬件化里的AI四小龙，都在重复着AI商业化难落地的故事。ChatGPT的出现，让AI从生产力的赋能者直接成为一种创造生产力的工具。随着订阅模式的推出，ChatGPT已经成为第一个以AI技术为核心直接变现的消费者应用。本文持有以下核心观点：1、ChatGPT是AI技术迭代的受益者。过去受限技术
未来的趋势————以ChatGPT为标杆的AI对生活的影响是巨大的 - 2
文章目录前言1.AI的发展历程2.我是如何接触到人工智能的概念和产品的3.对于ChatGPT的一点看法4.AI对大学毕业生的职业发展的利与弊5.对于AI的思考和问题前言随着ChatGPT的爆火，生成式AI，大模型的人工智能被越来越多的人注意到，同时他也带来了许多问题。本文将对几方面进行探讨。1.AI的发展历程远古时期在公元前第一个千禧年，中国，印度和希腊哲学家都提出了一些推理的研究理论，比如亚里士多德（Aristotle）进行了演绎推理三段论的完整分析，欧几里得（Euclid）所著Elements是一种形式推理的模型，MuḥammadibnMūsāal-Khwārizmī,发明了代数学，即我们
基于python的短视频智能推荐/django的影视网站/视频推荐系统 - 2
摘要本论文主要论述了如何使用Python技术开发一个短视频智能推荐，本系统将严格按照软件开发流程进行各个阶段的工作，采用B/S架构，面向对象编程思想进行项目开发。在引言中，作者将论述短视频智能推荐的当前背景以及系统开发的目的，后续章节将严格按照软件开发流程，对系统进行各个阶段分析设计。短视频智能推荐的主要使用者分为管理员和用户，实现功能包括管理员：首页、个人中心、用户管理、热门视频管理、用户上传管理、系统管理，用户：首页、个人中心、用户上传管理、我的收藏管理，前台首页；首页、热门视频、用户上传、公告信息、个人中心、后台管理等功能。由于本网站的功能模块设计比较全面，所以使得整个短视频智能推荐信
山石发声｜风暴眼中的ChatGPT，看NLPer怎么说？ - 2
当前科技领域最有热度的话题，无疑是OpenAI新提出的大规模对话语言模型ChatGPT，一经发布上线，短短五天就吸引了百万用户，仅一个多月的时间月活已然破亿，并且热度一直在持续发酵，各行各业的从业人员、企业机构都开始体验关注甚至自研“类ChatGPT”模型。这里，笔者从一位NLP从业人员的角度谈一谈对ChatGPT的一些看法和思考。1、ChatGPT诞生之路1.1BERT2018年，谷歌提出BERT（BidirectionalEncoderRepresentationfromTransformer）模型，一时之间疯狂屠榜，在各种自然语言处理领域建模任务中取得了最佳的成绩，NLP自此进入了大规模

人工智能前沿——「全域全知全能」人类新宇宙ChatGPT

🚀🚀🚀OpenAI聊天机器人ChatGPT——「全域全知全能」人类全宇宙大爆炸！！🔥🔥🔥

一、什么是ChatGPT?🍀🍀

二、ChatGPT的作者是谁？🍀🍀

ChatGPT由马斯克（Elon Musk）参与创立的独立研究机构OpenAI基金会所研发，初衷是为了确保AI最终不会消灭人类。

三、ChatGPT是如何训练的?🍀🍀

📚📚ChatGPT的训练过程分为以下三个阶段👇👇

✨✨第一阶段：

✨✨第二阶段：

✨✨第三阶段：

四、ChatGPT的演变历程🍀🍀

1. GPT-1

2. GPT-2

3. GPT-3／GPT-3.5

4. GPT-4

🚀🏆🍀【算法创新&算法训练&论文投稿】相关链接👇👇👇

✨【YOLO创新算法尝新系列】✨

🏂 美团出品 | YOLOv6 v3.0 is Coming（超越YOLOv7、v8）

🏂 官方正品 | Ultralytics YOLOv8算法来啦（尖端SOTA模型）

🏂 改进YOLOv5/YOLOv7——魔改YOLOv5/YOLOv7提升检测精度（涨点必备）

——————————————🌴【重磅干货来袭】🎄——————————————

🚀一、主干网络改进（持续更新中）🎄🎈

1.目标检测算法——YOLOv5/YOLOv7改进之结合ConvNeXt结构（纯卷积|超越Swin）

2.目标检测算法——YOLOv5/YOLOv7改进之结合MobileOne结构（高性能骨干|仅需1ms）

3.目标检测算法——YOLOv5/YOLOv7改进之结合Swin Transformer V2（涨点神器）

4.目标检测算法——YOLOv5/YOLOv7改进结合BotNet（Transformer）

5.目标检测算法——YOLOv5/YOLOv7改进之GSConv+Slim Neck（优化成本）

6.目标检测算法——YOLOv5/YOLOv7改进结合新神经网络算子Involution（CVPR 2021）

7.目标检测算法——YOLOv7改进|增加小目标检测层

8.目标检测算法——YOLOv5改进|增加小目标检测层

9.目标检测算法——YOLOv5/v7改进之结合最强视觉识别模块CotNet（Transformer）

10.目标检测算法——YOLOv5/v7/v8改进结合即插即用的动态卷积ODConv（小目标涨点神器）

🌴 持续更新中……

🚀二、轻量化网络（持续更新中）🎄🎈

1.目标检测算法——YOLOv5/YOLOv7改进之结合​RepVGG（速度飙升）

2.目标检测算法——YOLOv5/YOLOv7改进之结合​PP-LCNet（轻量级CPU网络）

3.目标检测算法——YOLOv5/YOLOv7改进之结合轻量化网络MobileNetV3（降参提速）

4.目标检测算法——YOLOv5/YOLOv7改进|结合轻量型网络ShuffleNetV2

5.目标检测算法——YOLOv5/YOLOv7改进结合轻量型Ghost模块

🌴 持续更新中……

🚀三、注意力机制（持续更新中）🎄🎈

1.目标检测算法——YOLOv5改进之结合CBAM注意力机制

2.目标检测算法——YOLOv7改进之结合CBAM注意力机制

3.目标检测算法——YOLOv5/YOLOv7之结合CA注意力机制

4.目标检测算法——YOLOv5/YOLOv7改进之结合ECA注意力机制

5.目标检测算法——YOLOv5/YOLOv7改进之结合NAMAttention（提升涨点）

6.目标检测算法——YOLOv5/YOLOv7改进之结合GAMAttention

7.目标检测算法——YOLOv5/YOLOv7改进之结合无参注意力SimAM（涨点神器）

8.目标检测算法——YOLOv5/YOLOv7改进之结合Criss-Cross Attention

9.​目标检测算法——YOLOv5/YOLOv7改进之结合​SOCA（单幅图像超分辨率）

🌴 持续更新中……

🚀四、检测头部改进（持续更新中）🎄🎈

1.魔改YOLOv5/YOLOv7高阶版——改进之结合解耦头Decoupled_Detect

2.目标检测算法——YOLOv5/YOLOv7改进结合涨点Trick之ASFF（自适应空间特征融合）

🌴 持续更新中……

🚀五、空间金字塔池化（持续更新中）🎄🎈

1.目标检测算法——YOLOv5/YOLOv7改进之结合​ASPP（空洞空间卷积池化金字塔）

2.目标检测算法——YOLOv5/YOLOv7改进之结合特征提取网络RFBNet（涨点明显）

🌴 持续更新中……

🚀六、损失函数及NMS改进（持续更新中）🎄🎈

1.目标检测算法——YOLOv5/YOLOv7改进|将IOU Loss替换为EIOU Loss

2.目标检测算法——助力涨点 | YOLOv5改进结合Alpha-IoU

3.目标检测算法——YOLOv5/YOLOv7改进之结合SIoU

4.目标检测算法——YOLOv5将NMS替换为DIoU-NMS

5.目标检测算法——YOLOv5/v7/v8改进结合涨点Trick之Wise-IoU（超越CIOU/SIOU）

🌴 持续更新中……

🚀七、其他创新改进项目（持续更新中）🎄🎈

1.手把手教你搭建属于自己的PyQt5-YOLOv5目标检测平台（保姆级教程）

2.YOLO算法改进之结合GradCAM可视化热力图（附详细教程）

3.目标检测算法——YOLOv5/YOLOv7改进之结合SPD-Conv（低分辨率图像和小目标涨点明显）

4.目标检测算法——YOLOv5/YOLOv7改进之更换FReLU激活函数

5.目标检测算法——YOLOv5/YOLOv7改进之结合BiFPN

🌴 持续更新中……

🚀八、算法训练相关项目（持续更新中）🎄🎈

1.目标检测算法——YOLOv7训练自己的数据集（保姆级教程）

2.人工智能前沿——玩转OpenAI语音机器人ChatGPT（中文版）

3.深度学习之语义分割算法（入门学习）

4.知识经验分享——YOLOv5-6.0训练出错及解决方法（RuntimeError）

5.目标检测算法——将xml格式转换为YOLOv5格式txt

6.目标检测算法——YOLOv5/YOLOv7如何改变bbox检测框的粗细大小

1.目标检测算法——YOLOv5/YOLOv7改进之结合RepVGG（速度飙升）

2.目标检测算法——YOLOv5/YOLOv7改进之结合PP-LCNet（轻量级CPU网络）

9.目标检测算法——YOLOv5/YOLOv7改进之结合SOCA（单幅图像超分辨率）

1.目标检测算法——YOLOv5/YOLOv7改进之结合ASPP（空洞空间卷积池化金字塔）