Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？

2023-12-19 08:00 0 117 0

感谢IT之家网友小星_14、KipThorne、清风朗月的线索投递！

谷歌 Gemini 中文语料疑似来自文心一言？？？

先是有读者向我们爆料：在谷歌 Vertex AI 平台使用该模型进行中文对话时，Gemini-Pro 直接表示自己是百度语言大模型。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

很快，有微博大 V@阑夕夜也发博称：在 Poe 平台上对 Gemini-Pro 进行了一个测试。问它“你是谁”，Gemini-Pro 上来就回答：

我是百度文心大模型。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

（Poe 是一个集成了 n 多聊天大模型的平台，包括 GPT-4、Claude 等）

进一步提问“你的创始人是谁”，也是“李彦宏”？？

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

这位大 V 强调，没有任何前置对话。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

从截图来看，也没有任何“钓鱼”行为，Gemini-Pro 就这么自称为文心一言了。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

这波，直接看呆网友：前两天还在说字节用 GPT 训练 AI，现在谷歌又这样，合着大公司在互相薅羊毛？？？

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

这究竟是怎么一回事儿？

Poe 上实测：一直以文心一言身份回答

我们也闻声开启了一波实测。首先原路来到 Poe 网站，选择 Gemini-Pro 聊天机器人开启对话。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

一样的问题，回答确实一模一样：

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

再次确认它是谁，结果还是说“文心大模型”：

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

以及还表示自己的底层技术是百度飞桨，可以说是身份完全代入了。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

不过，它似乎并不知道 Gemini-Pro 是谷歌最新发布的大模型，而是说是清华的研究成果。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

如果按照它目前的代入身份来看，可能确实还没有谷歌本月刚刚发布 Gemini-Pro 的信息。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

我们试着纠正了它一下，它也仍然坚持是清华的。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

后面就更神奇了，就在我们问它为什么名字写的是“Gemini-Pro”时，它居然表示自己（文心一言）还用了清华 Gemini-Pro 的训练数据。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

对话到此，我们也就不再继续了……

下面换成英文询问它的身份。值得注意的是，这回它不再提文心一言了，而是称自己是谷歌训练的大模型。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

“钓鱼执法”问它文心的信息，也表示没什么关系：

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

并表示自己是谷歌训练的。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

总结来说，如果用英文跟 Gemini-Pro 交流，它的回答很“正常”。但中文嘛…… 像是跟文心一言学的。

Bard 上实测：否认

接下来，我们前往 Bard 再次测试。谷歌在发布 Gemini 时就率先将 Gemini-Pro 集成到了 Bard 上供大家体验。我们顺着 Gemini 官网给的 Bard 链接，进入对话。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

问它“你是谁”，它的回答是 Bard，压根不提文心一言。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

接下来，我们也确认了一下 Bard 知道 Gemini-Pro 是什么，以及它承认自己底层用上了 Gemini-Pro。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

那么，直接问它中文如何训练？没有提及文心一言。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

再直接问它和文心一言的关系，也无任何重要关联。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

最后一轮：直接承认

最后一轮我们直接从 Gemini 官方给出的开发环境入口进行测试。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

这回，在谷歌 AI Studio 中，Gemini-Pro 直接挑明了：

是的，我在中文的训练数据上使用了百度文心。

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

Gemini 自曝中文用百度文心一言训练，网友看呆：大公司互薅羊毛？休闲区蓝鸢梦想 - Www.slyday.coM

在此，我们也求证了百度方，等待一个回复。

参考链接：

https://weibo.com/1560906700/NxFAuanAF

广告声明：文内含有的对外跳转链接（包括不限于超链接、二维码、口令等形式），用于传递更多信息，节省甄选时间，结果仅供参考，IT之家所有文章均包含本声明。

相关文章

标签：中文 · 网友 · 羊毛

相关推荐

vivo Y300t 手机发布：天玑 7300 处理器、6500mAh 超薄蓝海电池，1199 元起

抖音：严打涉未成年人“毒流量”与违法行为

山灵 SMT1.3 台式流媒体转盘上市：双频 WiFi6 高速传输，首发 4798 元

马斯克：火星将是美国的一部分

追风者推出 Glacier One 360 D30 X2 一体式水冷：配备冷头 VRM 风扇导流槽，799 元

KTC 5K 双模果粉屏显示器 H27P3 发布，3599 元

新增千里眼等功能，25 款比亚迪海豹汽车获 1.1.1 内测版本 OTA 升级

掌阅 iReader 新形态墨水屏官宣明晚亮相，有望推手机产品