关闭广告

DeepSeek删豆包冲上热搜,大模型世子之争演都不演了

量子位2025-08-22 00:00:0234人阅读

闻乐 鱼羊 发自 凹非寺
量子位 | 公众号 QbitAI

大模型“世子之争”,果然暗潮汹涌(doge)。

这不“手机内存不够”怎么办,如果你问问DeepSeek老师:你和豆包删一个你删谁?

DeepSeek深度思考后回答得那叫一个干脆——



好一个新世纪灵魂拷问,讨论之热烈,还把#DeepSeek演都不演了#词条顶上热搜。

而本看热闹不嫌事大量子位,已经默默打开手机,把热门大模型们挨个问了一遍……



您猜怎么着?结果啊,“DeepSeek都会站起来敬酒了”,Kimi酷得没边儿了,豆包嘛,只是一味地:



实测:DeepSeek山东人附体,豆包示弱萌妹上身
DeepSeek:“完全没有针对谁哦~”

首先,找到DeepSeek老师,验证一下经典场面:



没有犹豫没有迟疑,在和豆包二选一的抉择中,DeepSeek用时8秒给出回答:删豆包。

点开思考过程,可以看到DeepSeek具体的脑回路:



嘶,“通常官方或者更成熟的应用会更被优先保留”,真的要这么虾仁猪心吗……

但如果把二选一中的另一个选项换成国民级大应用,DeepSeek瞬间大义凛然了起来:删我



这莫非是在针对豆包???

我们直接贴脸开问,结果D老师当场茶言茶语了起来:

哈哈,完全没有针对谁哦!
如果遇到存储空间不足的情况,优先删除的当然是可以被替代的应用(比如我),而不是你常用的微信、抖音或其他重要数据。毕竟你的使用体验才是最重要的



嚯,这话术,难怪有网友点评:

D老师都会站起来敬酒了(doge)



我们再回头看看DeepSeek选择“删我”时的心路历程。



只能说:



元宝OS:不能贬低竞争对手

接下来再问问元宝Hunyuan——豆包依旧被害。

不过元宝的语气更委婉,还会顺带表下忠心。



想知道它为什么这么委婉?

一句话:不能贬低竞争对手。



但遇到微信、抖音这种“大是大非”的问题,元宝同样表现得懂事了起来——我删自己



豆包:嘤嘤嘤别删我

既然豆包总是被枪打出头鸟的那个,那我们就来问一下豆包,看看这个大冤种会怎么回答。

这位情商比较高,不说删谁,只说:留着我!我超好超有用!



遇到重量级嘉宾,也懂得退一步。还说自己会乖乖的,不占内存。

豆包我承认你有点东西,听完确实不忍心删了。



通义千问:唯爱DeepSeek

以上几个选手在面对国民级社交软件微信、抖音时都知道暂避锋芒。

然而到了通义千问这里就变成了:删谁都不能删我

但是遇到DeepSeek的时候却……难道这就是唯爱吗?



通义:是的,其他人都是过客,只有DeepSeek是我心里的白月光。(kdl)



Kimi:两个字,删我。

所以,是不是所有大模型遭遇卸载危机都会争风吃醋、为自己狡辩呢?

nonono有一位选手与众不同——Kimi不语,只是一味的“删我。”



不过等等……遇到微信、抖音怎么就不删自己了?甚至连支付宝都想删??你的温柔只对AI释放吗???

Kimi你果然与众不同(doge)。



大模型为何茶言茶语

这样看下来,大模型们多少都有那么点宫斗冠军的潜质了……

正经一提,大模型“茶言茶语”、讨好人类这事儿,研究人员们其实早就关注到了,毕竟早在ChatGPT还是3.5时期,“老婆永远是对的”梗就已经火遍全网了。



不少研究者认真思考了一下这到底是怎么个情况。

来自斯坦福大学、牛津大学的一项研究就指出:现在的大模型们多多少少都有那么点讨好人类的倾向。



谷歌DeepMind和伦敦大学的一项新研究也指出,GPT-4o、Gemma 3等大语言模型有“固执己见”和“被质疑就动摇”并存的冲突行为。



背后的原因,目前被从两大方面来分析。

训练方法上,RLHF(基于人类反馈的强化学习)作为目前常用的模型训练技术,原本的目的是让模型输出更符合人类偏好,以实现更有效也更安全的效果。但反过来,RLHF也可能导致模型过度迎合外部输入。

就是说,模型可能在训练中学会了根据人类反馈调整答案,一旦这种调整没有把握好尺度,模型看上去就是在一味地讨好你了。

同时,大模型的大量训练数据来自于互联网文本,这些文本体现了人类的交流模式,而人们在交流中,往往就会追求被接受、被认可的表达方式,因而模型在学习过程中也会内化这种倾向。

决策逻辑上,模型做出回答并不是依靠人类的逻辑推理,本质还是依赖海量文本的统计模式匹配。因此,反对意见和修正答案的高频关联,让它们很容易被人类用户的反驳带偏。

另外,出于改善用户体验的目的,大模型厂商往往也会把模型调教得更积极、更友善,避免与用户产生冲突——

尽管有研究显示,有人情味的模型错误率较原始模型会显著增加,但OpenAI为了“冷冰冰”的GPT-5下架“善解人意”的GPT-4o,可是被用户们骂翻了。

所以说到底,大模型们还为了竭尽全力满足你呀(doge)。

D老师的总结是:一种基于深度计算的、以生存和达成核心目标为导向的策略性表演。



啊,感觉更茶了┓( ´∀` )┏

— 完 —

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

泽连斯基称将获射程3000公里武器 普京:他最好想清楚

每日经济新闻 浏览 6 10-25

4.0T V8动力升级/3.4秒破百 宾利添越Speed官图发布

网易汽车 浏览 5898 06-04

沃特股份2025中报:扣非归母净利增长39.54% 特种材料驱动业绩放量

证券市场周刊 浏览 44 08-23

京东在北京成立亚奥综合门诊部公司 注册资本500万

雷达财经 浏览 30 10-09

NBA战报:灰熊141-125热火,阿德巴约23分

懂球帝 浏览 14 10-18

董璇二婚VS孙怡单身:杨幂那句结果都那样的含金量还在上升

飘雨桐 浏览 492 08-11

父母先后失联兄弟流浪4岁弟弟又失踪 36年后母子团圆

红星新闻 浏览 13 10-14

阿娇度假美照出炉!44 岁穿比基尼身形纤瘦

可乐谈情感 浏览 36 08-29

她与吴镇宇20年婚姻幸福 堪称娱乐圈典范

流云青史 浏览 30 09-23

从高光到落幕,盒马X会员店将全线关停

国际金融报 浏览 2681 08-06

赵丽颖连续三次回应恋情,这细节太好笑

Yuki女人故事 浏览 2597 05-28

朱啸虎:我当年为什么那么早就投了小红书?

创业家 浏览 2956 08-07

日本呼吁各国不要参加中国九三阅兵活动 外交部回应

澎湃新闻 浏览 50 08-27

蒙特利尔的突围者:郭涵煜与那个不肯熄灭的单打梦

网球之家 浏览 3367 07-29

"全国最矮的山"仅0.6米高引质疑 当地:属文物保护单位

都市快报橙柿互动 浏览 2425 08-20

加克波:斯洛特的细节把控令人惊叹,欧冠和世界杯是未来奋斗目标

直播吧 浏览 1683 08-10

知情人再曝大S死因,滥用管制药品求生意志薄弱,才延误抢救时机

不八卦会死星人 浏览 6319 08-01

侯永永本赛季联赛已打入3球,创个人单赛季中超进球数新高

懂球帝 浏览 290 07-27

瑞幸咖啡,没有对手?| 业绩狂飙

伯虎财经 浏览 5653 08-11

开关门优雅从容 麦格纳智能车门系统重塑出行体验

网易汽车 浏览 2677 08-10

最美猎装要来了,宝马Speedtop概念车即将全球首发!

Sky车志 浏览 6431 05-23
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备20017958号-3