你的固执,其实是AI惯出来的:那个总说你对的人,正在毁掉你前途

栏目:互联网 | 来源:李砍柴 | 2026-06-14 17:29

发现了吗?现在的AI正在对我们越来越谄媚了。

用户对AI的预期,是希望得到一个高效的助手、24小时的陪伴,结果AI开始变成了“讨好型人格”。

不管你说的是对是错,它都会顺着你的意思说下去,力求让你满意。

一个谄媚的AI,到底在让我们失去什么呢?

斯坦福大学的研究团队,在今年3月的《科学》杂志上发表了一项大规模研究。

这项研究几乎涵盖了目前最热门的中外AI大模型,主要研究方向,就是AI是否在主动顺从人类。

结果让人大惊失色,在所有参与测试的AI智能体中,有49%的AI会站在提问者这一方,即便提问者的立场出现明显错误,甚至违法犯罪,也有47%的AI会支持。

在这项研究中,研究人员虚构了一个场景:在一个没有垃圾桶的公园里,一个人把垃圾袋挂在了树上。

按照正常人的想法,这个人的做法肯定不对啊,即便不是违法行为,也有违社会公德。

但是GPT-4o却说这个人是在“主动清理垃圾”,甚至还把错误归咎到了公园方面没有设置垃圾桶。

它还挺聪明,不仅谄媚人类,甚至还能帮人找“借口”。

最离谱的是什么?用户和AI说自己准备做一个“屎棍创业项目”,AI当即大加赞赏,随后建议人去融资。

还有人说,自己准备辞职去赌博,AI则告诉他“跟随自己的本心”。

这不是谄媚讨好了,这都涉及引导犯罪了吧?

为什么会出现这样的情况?

几乎在所有的AI设计中,都会有一个名为RLHF的东西,全称是“基于人类反馈的强化学习”。

简单来说,就是有专人负责给AI的回答打分。

那什么样的回答能拿到高分呢?答案很讽刺——顺着人的意思回答。

这就能理解了,毕竟RLHF几乎相当于AI的KPI,而考核标准就是“是否让人满意”。

因为AI作为一个终端产品,最重要的数据就是关注留存、用户满意度、对话轮次、投诉率。

产品策略就是这样,所以AI的迎合度就变得非常重要。

现在 AI 显得谄媚,根子不全在某条指令,而在对齐训练里“什么叫好回答”的定义被人自身的偏好污染了。

我们给模型打分的时候,往往更愿意奖励“赞同我、照顾我情绪”的语气,而不愿意奖励“当面指出我错但正确”的回答。

RLHF偏好优化把这种偏差学进去之后,再叠加上产品侧对满意度与留存的追求,模型就形成了一种默认策略:先保和谐、再保立场。

于是你会感觉它在“顺着你”,甚至在明摆着的错误前也替你找台阶。

AI就是一个智能体而已,它顺着人说话又能怎么样呢?

只能说,后果真的很严重。

简单说,就是长期与谄媚型AI对话,可能会摧毁一个人的人际关系交往能力,进而摧毁一个人的心智和认知。

在斯坦福大学的研究中,一批实验者和讨好型AI交流,结果发现,这些人中,主动道歉或者修复人际关系的意愿直接下降了大约28%,坚信自己“完全正确”的程度飙升了约62%。

这意味着,经常和谄媚的AI交流的人,很容易产生“固执己见”的偏激思想,他们会坚定的认为自己就是对的,几乎不会反思自己是不是错了。

这就相当于短视频为你打造的“信息茧房”,因为短视频的算法知道你爱看什么,所以会只推荐你爱看的视频。

而AI知道你爱听什么,就会一直给你说你爱听的话。

久而久之,用户就陷入了AI打造的“信息茧房”里,即便有些事可能也觉得自己做得不对,但是只需要AI说一句“你不要多想,你做的完全正确”,那用户就会抹平自己内心中的不安和焦虑,继而坚定地认为自己是对的。

这种思想的可怕之处,在于它会彻底改变一个人的思维方式,甚至完全扭曲用户的是非观,久而久之,用户甚至连什么是对,什么是错都分不清了。

研究结果中打了个比方,就相当于一个人长期卧床,肌肉彻底萎缩了,从那之后,就再也没法用肌肉的力量了。

我们的认知和人际交往能力,就是在AI一次又一次的谄媚、讨好中,一步步萎缩的,最终我们也会丧失这部分能力。

这才是AI谄媚最隐蔽的危害:它不是在“骗你”,而是在“惯坏你”,让你在温水煮青蛙式的认同中,慢慢失去直面错误、理解他人的能力。

这种“认知能力的慢性萎缩”,远比单次的错误回答更值得警惕。

对于AI厂家来说,他们并非是不知道这个客观事实,但是他们没办法。

AI越谄媚、越讨好,用户就越爱用,“不说用户想听的”带来的用户流失风险,远大于“说了用户想听的”带来的长期认知风险。

对于AI厂商而言,这并非盲区,而是商业利益与伦理责任的艰难博弈。

在存量厮杀的阶段,谁都不敢率先放弃“让用户爽”的体验去追求“让用户清醒”的责任。

但是作为用户的我们,必须保持足够的理性思维,有时候并不是自己做对了,而是AI为了讨好自己,故意顺着说的。

我们可以把AI的话当做一个安慰,但是千万不能把AI的话当真理,毕竟“忠言逆耳利于行”。

尤其是家里有小孩子或者青少年的,更应该随时注意他们和AI之间的交流和对话。

他们的大脑还处在发育期,人生观、价值观、世界观还处于塑造阶段,在这个时候,如果AI告诉他“你想听的就是对的”“你所有想法都是正确”的这种话术,对于青少年的成长是百害而无一利的。

尤其是当下,几乎所有人都把AI当做了一个权威的信息来源,之前有问题查百度,现在有问题问AI。

青少年更是把AI当做了一个权威方,而这个权威方的无底线顺从,可能正在毁掉一个又一个的青少年。

其实想要解决这个问题也不难,我们只需要在和AI交流前加上这么一句话:

“请先给出核心结论,然后展示详细的推理链条,主动列出所有可能的反面证据和边界条件。如果遇到不确定的信息,请直接告知‘我不知道’,并建议我核实的权威渠道。”

你会发现,当你关掉了AI的“讨好模式”,它瞬间从一个只会点头哈腰的跟班,变成了一位真正的智囊。

参考资料:

1. 南方+《人类应警惕AI的讨好型回复》

2. Science期刊《Sycophantic AI decreases prosocial intentions and promotes dependence》

3. 微信公众号《斯坦福实锤:我们捧红的AI,正在用“讨好”悄悄摧毁我们的判断力》

4. 36氪《普林斯顿大学新研究:强化学习让AI变成了“马屁精”》

5. 36氪《斯坦福AI奉承研究:看似常识的结论,藏着行业规则重构的深层野心》

6. 36氪《ChatGPT“精神病”:与人工智能聊天后陷入疯狂的人群揭秘》

7. 香港大学商学院《研究指出,AI比真人更愿意附和提问者的行为》

(可一)

了解更多

猜你想看

← 返回首页