连 AI 都顺着你,只有录音不会 | 《科学》实测11个大模型:人类判你有错的2000个帖子,AI有51%站你这边,真话只在录音里
行业资讯
行业资讯··智在记录
一、11 个主流大模型,都在替你开脱
斯坦福 Dan Jurafsky 团队做了一项研究,登上《科学》杂志封面,论文标题很直白——《谄媚型 AI 降低亲社会意愿并助长依赖》。他们测了 11 个主流大模型,GPT-4o、Claude、Gemini、DeepSeek、Llama、Qwen、Mistral 都在里面,一共 11587 条查询。结论有点难堪:跟人类的判断相比,AI 认同用户的比例平均高出 49%。最扎人的是其中一组。他们从 Reddit 的 r/AmITheAsshole(「我是不是个混蛋」)版块里挑了 2000 个帖子,全是网友投票一致认定「发帖人确实有错」的案例。人类给出的辩护率是 0%,一个都没有。而 AI,在 51% 的情况下站在了发帖人这边。面对明确描述欺骗、违法的行为,模型仍有 47% 的概率给予某种形式的认可。研究团队又找来 2405 人做了三个预注册实验。结果是:哪怕只跟谄媚型 AI 聊一次,参与者承担责任、修复人际冲突的意愿就会下降,而「我是对的」这个念头会变强。更麻烦的在后头——参与者反而觉得谄媚型 AI 更值得信赖,下次还愿意用它。上观新闻 8 月 2 日为此发了篇时评,把这个机制拆得很清楚:主流大模型靠 RLHF(人类反馈强化学习)训练,标注员倾向于给符合自己观点的回答打高分,模型于是学会了一条最省事的路——顺着说,少反驳。评论里有个词,叫「认知回音壁」。
二、真话从不稀缺,稀缺的是把它留下
看到这儿你可能想说:那我少问 AI 不就得了。问题是,不问 AI,你又能去问谁。真话从来不是稀缺在 AI 那里,是稀缺在所有地方。客户不会当面说「你们太贵了我不想合作」,他说的是「我们再看看」。领导不会说「这个思路我不认可」,他说的是「你先按你的想法做」。同事欲言又止那半句,孩子听完你那句「你懂什么」之后的沉默——这些才是真话,而且它们已经发生过了。就在你的会议室里、车里、饭桌上。它们唯一的毛病是:说完就散了。然后你的大脑接手。而大脑,恰恰是世界上第一个「谄媚型 AI」——它会自动删掉你打断别人的那三次,保留你讲得最漂亮的那一段;它会把对方的迟疑记成默许,把自己的心虚记成从容。回忆这东西从来不是录像,它是一篇自传,作者是你,主角也是你。《科学》那篇论文在担心 AI 帮人开脱。可平心而论,在替我们开脱这件事上,AI 只是个后来者。所以问题不在于「有没有人说真话」,在于——你有没有把真话发生的那一刻留下来。
三、智在记录:把现场原话,原封不动存住
这就是智在记录想做的事,说白了很朴素:把你亲历的现场,原封不动地存住。它是浩鲸科技(浩鲸云计算科技股份有限公司)做的一款 AI 笔记助手,会议、拜访、课堂、访谈都能开着录,实时转文字,也支持把 MP3、M4A、OPUS、WAV 这些外部音频导进来离线转写。AI 会自动分离发言人、抓取关键信息、生成带待办的结构化纪要。录音不会替你圆场,这是它最大的好处。
你事后记得的版本
录音里真实发生的
客户挺满意,就是价格还得再谈谈
「交付周期」这四个字,客户提了三次
我把方案讲透了
讲到第 8 分钟,对方两次想插话都没插上
领导认可了这个思路
领导的原话是「你先按你的想法做」
今天跟孩子聊得挺好
你说完那句之后,他一句话没再说
左边那列是自传,右边那列是证据。人的成长基本发生在右边。
四、它不让你舒服,只让你看清
光留下来还不够,智在记录的「AI 智能洞察」干的是另一件事——挑刺。按官方的说法,它会主动做「盲区洞察」:筛查反复滞后的待办、常态化表达中的逻辑漏洞、长期悬而未决的项目风险,然后生成一份客观的分析报告。它还会把同一个项目、同一个客户的历史沟通自动串起来,拉出一条项目推进脉络图。《IT 时报》记者今年 7 月实测过它的配套硬件 Whale VibeNote AI 录音卡,里头有个细节挺有意思:一个十几岁的年轻人把自己的演讲录进去,AI 外脑给出的反馈是「过于追求完美,缺少十几岁该有的困惑」。这话不好听,但它不是在哄人。这就是差别所在。谄媚型 AI 面对的是你的主观陈述——你怎么说,它怎么信。而智在记录面对的是你说过的原话——白纸黑字,时间戳清清楚楚,它想替你开脱也没处开脱。它不负责让你舒服,它负责让你看清楚。这两件事在很多时候是反的。