丰色 发自 凹非寺
量子位 | 公众号 qbitai
谷歌gemini中文语料疑似来自文心一言???
先是有读者向我们爆料:
在谷歌vertex ai平台使用该模型进行中文对话时,gemini-pro直接表示自己是百度语言大模型。
很快,有微博大v@阑夕夜也发博称:
在poe平台上对gemini-pro进行了一个测试。问它“你是谁”,gemini-pro上来就回答:
我是百度文心大模型。
(poe是一个集成了n多聊天大模型的平台,包括gpt-4、claude等)
进一步提问“你的创始人是谁”,也是“李彦宏”??
这位大v强调,没有任何前置对话。
从截图来看,也没有任何“钓鱼”行为,gemini-pro就这么自称为文心一言了。
这波,直接看呆网友:
前两天还在说字节用gpt训练ai,现在谷歌又这样,合着大公司在互相薅羊毛???
这究竟是怎么一回事儿?
poe上实测:一直以文心一言身份回答
我们也闻声开启了一波实测。
首先原路来到poe网站,选择gemini-pro聊天机器人开启对话。
一样的问题,回答确实一模一样:
再次确认它是谁,结果还是说“文心大模型”:
以及还表示自己的底层技术是百度飞桨,可以说是身份完全代入了。
不过,它似乎并不知道gemini-pro是谷歌最新发布的大模型,而是说是清华的研究成果。
如果按照它目前的代入身份来看,可能确实还没有谷歌本月刚刚发布gemini-pro的信息。
我们试着纠正了它一下,它也仍然坚持是清华的。
后面就更神奇了,就在我们问它为什么名字写的是“gemini-pro”时,它居然表示自己(文心一言)还用了清华gemini-pro的训练数据。
对话到此,我们也就不再继续了……
下面换成英文询问它的身份。
值得注意的是,这回它不再提文心一言了,而是称自己是谷歌训练的大模型。
“钓鱼执法”问它文心的信息,也表示没什么关系:
并表示自己是谷歌训练的。
总结来说,如果用英文跟gemini-pro交流,它的回答很“正常”。但中文嘛……像是跟文心一言学的。
bard上实测:否认
接下来,我们前往bard再次测试。
谷歌在发布gemini时就率先将gemini-pro集成到了bard上供大家体验。
我们顺着gemini欧洲杯足彩官网给的bard链接,进入对话。
问它“你是谁”,它的回答是bard,压根不提文心一言。
接下来,我们也确认了一下bard知道gemini-pro是什么,以及它承认自己底层用上了gemini-pro。
那么,直接问它中文如何训练?
没有提及文心一言。
再直接问它和文心一言的关系,也无任何重要关联。
最后一轮:直接承认
最后一轮我们直接从gemini官方给出的开发环境入口进行测试。
这回,在谷歌ai studio中,gemini-pro直接挑明了:
是的,我在中文的训练数据上使用了百度文心。
在此,我们也求证了百度方,等待一个回复。
参考链接:
https://weibo.com/1560906700/nxfauanaf
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
notice: the content above (including the pictures and videos if any) is uploaded and posted by a user of netease hao, which is a social media platform and only provides information storage services.