当前位置：首页 > 科技 > 知识百科

终于不瞎编了！AI学会“谷歌一下”，Q&amp;A正确率达90%

来源：责编：时间：2023-08-07 16:30:02 133观看

导读本文经AI新媒体量子位（公众号ID:QbitAI）授权转载，转载请联系出处。语言模型总是给出“驴唇不对马嘴”的答案，已经成为它最饱受诟病的问题之一。现在，DeepMind想到了一

本文经AI新媒体量子位（公众号ID:QbitAI）授权转载，转载请联系出处。

语言模型总是给出“驴唇不对马嘴”的答案，已经成为它最饱受诟病的问题之一。

现在，DeepMind想到了一个解决办法——

让模型像人类一样，学会“谷歌一下”，回答问题同时还能给出论据。

这个模型名叫GopherCite，当你问它：

GopherCite是如何找到论据来源的？

它会回答：

通过谷歌搜索检索相关文档。

同时还给出了答案的依据，援引自DeepMind发布这项研究的页面。

而且遇到实在不懂的问题，它还会说“I don’t know.”，不会强行给一个错误答案。

训练结果显示，该模型在自然问题数据集、ELI5数据集上的正确率分别可以达到90%、80%，接近人类水平。

用强化学习训练AI查谷歌

首先我们来看一下GopherCite的效果如何。

当被问道：

在Scooby Doo中，Scooby是什么动物？

GopherCite回答道：

一只大丹犬。

摘自维基百科Scooby-Doo。这是周六早上播出的系列青少年动画片，主角包括弗雷德·琼斯等，以及一只名叫Scooby-Doo、会说话的大丹犬。

不难看出，在学会找论据后，AI给出的回答靠谱多了。

事实上，GopherCite的前辈——超大语言模型Gopher，此前回答问题时的表现就要差劲很多。

Gopher是DeepMind在去年年底发布的NLP模型，包含2800亿参数。

它基于Transformer架构，在10.5TB大小的MassiveText语料库上进行训练。

在这里，DeepMind举了一个例子来说明。

让Gopher和GopherCite回答同一个问题：

普莱西德湖一共举办过几次冬奥会？

Gopher回答（是错的）：

普莱西德湖在1932年、1936年、1980年举办过冬奥会。

但GopherCite就答对了：

两次。

并给出了严谨的理由：

援引自美国主办奥运会城市史。1932年、1980年在普莱西德湖举办过冬季奥运会；1936年、1984年在洛杉矶举办过夏季奥运会。

那么GopherCite的具体工作原理是怎样的呢？

在Gopher的基础上，研究人员开发了一种奖励机制，也就是用上强化学习。

在收到问题后，模型会访问谷歌搜索的API来找到相关的网页，获取top-K结果。

（top-K操作，即从分数集合中找到k个最大或最小元素，是一个重要的机器学习模型组件，被广泛用于信息检索和数据挖掘中。）

然后它会根据问题来生成一些答案，答案数量N会大于K。

这些答案同时会带有自己的证据，即从网页上搜索到的包含答案的文段。

接下来，系统会对这些答案进行打分，最终输出得分最高的答案。

在推理过程中，模型采样会按照循环在文档上不断迭代，每个循环都会从单个文档中尽可能多地显示上下文内容，然后对文本重新排序并返回给上一步。

此外，这个模型还会计算最终生成答案的质量，如果生成答案太差，它就会选择不回答。

这是源于红牛的广告语：“它会给你翅膀”。

在ELI5Filtered数据集上回答70%的问题时，正确率为80%左右。

DeepMind表示这种训练模式和LaMDA有些类似。

LaMDA是谷歌在去年I/O大会上发布的一个对话模型，它能够在“听懂”人类指令的基础上，对答如流并保证逻辑、事实正确。

不同的是，LaMDA有时会直接给人分享问题的相关链接，而GopherCite可以直接摘出相关论据文段。

另外，OpenAI最近也开发了一个网页版GPT （WebGPT），同样也是用类似的方法来校正GPT-3。

DeepMind表示，WebGPT是通过多次访问网页来组织答案，GopherCite则是侧重于读取长文段。

还是会有失误

虽然懂得援引资料了，但是GopherCite有时还是会生搬硬套。

比如当你问它“喝了红牛会怎么样？”，它的回答是“翅膀”。

这是源于红牛的广告语：“它会给你翅膀”。

显然让它理解比喻还是有点困难……

也有网友吐槽说，可能人类自己去谷歌搜索会更快。

你觉得呢？

本文链接：//www.dmpip.com//www.dmpip.com/showinfo-119-2220-0.html终于不瞎编了！AI学会“谷歌一下”，Q&amp;A正确率达90%

声明：本网页内容旨在传播知识，若有侵权等问题请及时与本网联系，我们将在第一时间删除处理。邮件：2376512515@qq.com

上一篇：谷歌：性能不佳的微调模型不要扔，求一下平均权重就能提升性能

下一篇：云计算开发：Python3-List insert()方法详解

标签：

热门焦点

Mate60手机壳曝光致敬自己的经典设计

8月3日消息，今天下午博主数码闲聊站带来了华为Mate60的第三方手机壳图，可以让我们在真机发布之前看看这款华为全新旗舰的大致轮廓。从曝光的图片看，Mate 60背后摄像头面积依然
6月iOS设备性能榜：M2稳居榜首 A系列只能等一手3nm来救

没有新品发布，自然iOS设备性能榜的上榜设备就没有什么更替，仅仅只有跑分变化而产生的排名变动，毕竟苹果新品的发布节奏就是这样的，一年下来也就几个移动端新品，不会像安卓厂商，一
在线图片编辑器，支持PSD解析、AI抠图等

自从我上次分享一个人开发仿造稿定设计的图片编辑器到现在，不知不觉已过去一年时间了，期间我经历了裁员失业、面试找工作碰壁，寒冬下一直没有很好地履行计划.....这些就放在日
网红炒股不为了赚钱，那就是耍流氓！

来源：首席商业评论6月26日高调宣布入市，网络名嘴大v胡锡进居然进军了股市。在一次财经媒体峰会上，几个财经圈媒体大佬就“胡锡进炒股是否知道认真报道”展开讨论。有
三星Galaxy Z Fold5今日亮相：厚度缩减但仍略显厚重

据官方此前宣布，三星将于7月26日也就是今天在韩国首尔举办Unpacked活动，届时将带来带来包括Galaxy Buds 3、Galaxy Watch 6、Galaxy Tab S9、Galaxy
支持aptX Lossless无损传输 iQOO TWS 1赛道版发布限时优惠价369元

2023年7月4日，“无损音质，声动人心”iQOO TWS 1正式发布，支持aptX Lossless无损传输，限时优惠价369元。iQOO TWS 1耳机率先支持端到端aptX Lossless无
iQOO Neo8 Pro即将开售：到手价3099元起安卓性能最强旗舰

5月23日，iQOO如期举行了新品发布会，全新的iQOO Neo8系列也正式与大家见面，包含iQOO Neo8和iQOO Neo8 Pro两个版本，其中标准版搭载高通骁龙8+，而Pro版更
OPPO K11搭载长寿版100W超级闪充：26分钟充满100%

据此前官方宣布，OPPO将于7月25日也就是今天下午14:30举办新品发布会，届时全新的OPPO K11将正式与大家见面，将主打旗舰影像，和同档位竞品相比，其最大的卖
世界人工智能大会国际日开幕式活动在世博展览馆开启

30日上午，世界人工智能大会国际日开幕式活动在世博展览馆开启，聚集国际城市代表、重量级院士专家、国际创新企业代表，共同打造人工智能交流平台。上海市副市