主页 > 快资讯 > 正文

ChatGPT会取代搜索引擎吗??(3)

2023-02-23 11:58来源:未知编辑:admin

扫一扫

分享文章到微信

扫一扫

关注99科技网微信公众号

如果我们不断重复第二和第三阶段,很明显,每一轮迭代都使得LLM模型能力越来越强。因为第二阶段通过人工标注数据来增强RM模型的能力,而第三阶段,经过增强的RM模型对新prompt产生的回答打分会更准,并利用强化学习来鼓励LLM模型学习新的高质量内容,这起到了类似利用伪标签扩充高质量训练数据的作用,于是LLM模型进一步得到增强。显然,第二阶段和第三阶段有相互促进的作用,这是为何不断迭代会有持续增强效果的原因。

尽管如此,我觉得第三阶段采用强化学习策略,未必是ChatGPT模型效果特别好的主要原因。假设第三阶段不采用强化学习,换成如下方法:类似第二阶段的做法,对于一个新的prompt,冷启动模型可以产生k个回答,由RM模型分别打分,我们选择得分最高的回答,构成新的训练数据<prompt,answer>,去fine-tune LLM模型。假设换成这种模式,我相信起到的作用可能跟强化学习比,虽然没那么精巧,但是效果也未必一定就差很多。第三阶段无论采取哪种技术模式,本质上很可能都是利用第二阶段学会的RM,起到了扩充LLM模型高质量训练数据的作用。

以上是ChatGPT的训练流程,主要参考自instructGPT的论文,ChatGPT是改进的instructGPT,改进点主要在收集标注数据方法上有些区别,在其它方面,包括在模型结构和训练流程等方面基本遵循instructGPT。可以预见的是,这种Reinforcement Learning from Human Feedback技术会快速蔓延到其它内容生成方向,比如一个很容易想到的,类似“A machine translation model based on Reinforcement Learning from Human Feedback”这种,其它还有很多。但是,我个人认为,在NLP的某个具体的内容生成领域再采用这个技术意义应该已经不大了,因为chatGPT本身能处理的任务类型非常多样化,基本涵盖了NLP生成的很多子领域,所以某个NLP子领域如果再单独采用这个技术其实已经不具备太大价值,因为它的可行性可以认为已经被chatGPT验证了。如果把这个技术应用在比如图片、音频、视频等其它模态的生成领域,可能是更值得探索的方向,也许不久后我们就会看到类似“A XXX diffusion model based on Reinforcement Learning from Human Feedback”,诸如此类,这类工作应该还是很有意义的。

另外一个值得关注的采取类似技术的工作是DeepMind的sparrow,这个工作发表时间稍晚于instructGPT,如果你仔细分析的话,大的技术思路和框架与instructGPT的三阶段基本类似,不过明显sparrow在人工标注方面的质量和工作量是不如instructGPT的。反过来,我觉得sparrow里把回报模型分为两个不同RM的思路,是优于instructGPT的,至于原因在下面小节里会讲。

chatGPT能否取代Google、百度等传统搜索引擎

99科技网:http://www.99it.com.cn

相关推荐
从ChatGPT看AI如何赋能降本增效 从ChatGPT看AI如何赋能降本增效

数字化发展的深入,促使大多数金融机构已经构建了客户标签体系用于个性化运

快资讯2023-02-23

“ChatGPT综合征”:搞钱、失业焦虑、技术争论 “ChatGPT综合征”:搞钱、失业焦虑、技术争论

“ChatGPT综合征”:依赖、对立、焦虑、兴奋。

快资讯2023-02-23

百度、谷歌接连官宣,还有多少ChatGPT竞品在路上? 百度、谷歌接连官宣,还有多少ChatGPT竞品在路上?

ChatGPT 的竞品们要来了。

快资讯2023-02-08

ChatGPT能替代胡锡进吗? ChatGPT能替代胡锡进吗?

再不蹭ChatGPT的热度,就晚了——万一下个「革命性技术」又来了呢。

快资讯2023-02-08

ChatGPT爆火,带来哪些机会? ChatGPT爆火,带来哪些机会?

ChatGPT这把火,正烧得越来越旺!

快资讯2023-02-08

用了ChatGPT后,我发现离不开它了 用了ChatGPT后,我发现离不开它了

伴随全球科技巨头微软的一笔大额投资,ChatGPT爆火出圈,成为时下AI圈新晋“顶

快资讯2023-02-08

ChatGPT Prompt工程:设计、实践与思考 ChatGPT Prompt工程:设计、实践与思考

ChatGPT 火爆出圈了,有些人惊叹于它的能力,当然也有部分人觉得也就那样。

快资讯2023-02-08

ChatGPT全面引爆AI搜索大战!美银:谷歌具有更大竞争优势 ChatGPT全面引爆AI搜索大战!美银:谷歌具有更大竞争优势

随着AI之战全面打响,微软公司则在周二推出了新的人工智能搜索引擎必应(

快资讯2023-02-08

虚拟偶像狂吻ChatGPT,提线木偶装上脑子,会怎样 虚拟偶像狂吻ChatGPT,提线木偶装上脑子,会怎样

ChatGPT的这一幕,去年此刻也曾经上演过。

快资讯2023-02-08

科大讯飞能成为中国版ChatGPT吗 科大讯飞能成为中国版ChatGPT吗

摆在科大讯飞面前一个更残酷的事实是,随着头部互联网大厂的入局,人工智能

快资讯2023-02-08