正文内容 评论(0

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗
2023-12-18 14:20:06  出处:量子位  作者:丰色 编辑:落木     评论(0)点击可以复制本篇文章的标题和链接

谷歌Gemini中文语料疑似来自文心一言???

先是有读者向我们爆料:

在谷歌Vertex AI平台使用该模型进行中文对话时,Gemini-Pro直接表示自己是百度语言大模型。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

很快,有微博大V@阑夕夜也发博称:

在Poe平台上对Gemini-Pro进行了一个测试。问它“你是谁”,Gemini-Pro上来就回答:

我是百度文心大模型。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗
(Poe是一个集成了n多聊天大模型的平台,包括GPT-4、Claude等)

进一步提问“你的创始人是谁”,也是“李彦宏”??

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

这位大V强调,没有任何前置对话。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

从截图来看,也没有任何“钓鱼”行为,Gemini-Pro就这么自称为文心一言了。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

这波,直接看呆网友:

前两天还在说字节用GPT训练AI,现在谷歌又这样,合着大公司在互相薅羊毛???

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

这究竟是怎么一回事儿?

Poe上实测:一直以文心一言身份回答

我们也闻声开启了一波实测。

首先原路来到Poe网站,选择Gemini-Pro聊天机器人开启对话。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

一样的问题,回答确实一模一样:

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

再次确认它是谁,结果还是说“文心大模型”:

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

以及还表示自己的底层技术是百度飞桨,可以说是身份完全代入了。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

不过,它似乎并不知道Gemini-Pro是谷歌最新发布的大模型,而是说是清华的研究成果

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

如果按照它目前的代入身份来看,可能确实还没有谷歌本月刚刚发布Gemini-Pro的信息。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

我们试着纠正了它一下,它也仍然坚持是清华的。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

后面就更神奇了,就在我们问它为什么名字写的是“Gemini-Pro”时,它居然表示自己(文心一言)还用了清华Gemini-Pro的训练数据。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

对话到此,我们也就不再继续了……

下面换成英文询问它的身份。

值得注意的是,这回它不再提文心一言了,而是称自己是谷歌训练的大模型。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

“钓鱼执法”问它文心的信息,也表示没什么关系:

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

并表示自己是谷歌训练的。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

总结来说,如果用英文跟Gemini-Pro交流,它的回答很“正常”。但中文嘛……像是跟文心一言学的。

Bard上实测:否认

接下来,我们前往Bard再次测试。

谷歌在发布Gemini时就率先将Gemini-Pro集成到了Bard上供大家体验。

我们顺着Gemini官网给的Bard链接,进入对话。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

问它“你是谁”,它的回答是Bard,压根不提文心一言。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

接下来,我们也确认了一下Bard知道Gemini-Pro是什么,以及它承认自己底层用上了Gemini-Pro。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

那么,直接问它中文如何训练?

没有提及文心一言。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

再直接问它和文心一言的关系,也无任何重要关联。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

最后一轮:直接承认

最后一轮我们直接从Gemini官方给出的开发环境入口进行测试。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

这回,在谷歌AI Studio中,Gemini-Pro直接挑明了:

是的,我在中文的训练数据上使用了百度文心。

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

Gemini自曝中文用百度文心一言训练 网友看呆:大公司也互薅羊毛吗

在此,我们也求证了百度方,等待一个回复。

参考链接:https://weibo.com/1560906700/NxFAuanAF

责任编辑:落木

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |
本文收录在
#谷歌#百度#大模型

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...