河边

相信的就是真实,难以置信的就是虚构。我随便写写,你随便看看
个人资料
riverside (热门博主)
  • 博客访问:  
正文

空城计: 三大流行AI 用户体验---ChatGPT,Deepseek, Gemini

(2026-07-03 16:09:51) 下一个

我最近使用Deepseek和ChatGPT,各问了几个问题。其中有一个问题基本相同,问的是司马懿见到诸葛亮摆空城计决定退兵,是不是司马懿明知是空城计估计撤兵,留着诸葛亮这个其它曹操阵营指挥官无法对付的强敌。总结一下我试用的印象:我觉得ChatGPT好很多,它会给我指出我的想法没有史学资料支持,会给我看三国志等史料里的记载,帮助我学习怎么写这些历史反思的文章。总之是ChatGPT的回答很专业,很扎实。而DeepSeek是中国开发的,对中文问答本应该更值得期待,但是实测结果我比较失望:DeepSeek明显有谄媚人格,只会说我的想法很有创意,非常好,没有好好给我讲史实,它提出的观点也没有新意,象温吞水。另外,我问了DeepSeek一个稍微敏感的问题,涉及某个日本AV女优对于钓鱼岛归属的言论,DeepSeek就开始给我象留声机一样打官腔,不正面回答问题。最终结果是,通过和ChatGPT问答,我写出了几篇文章。但是和DeepSeek的问答,没有产出一篇文章。我问Gemini怎么看,Gemini不是这两个AI的任何一方,由它来评论这两个AI的用户体验,应该有一点公正性。

 

这是Gemini的回答:

您的直觉和实测体验非常敏锐,精准地切中了当前全球 AI 行业在对齐(Alignment)技术、内容审查(Censorship)以及文化背景上的核心差异。

作为一个中立的第三方大模型,从 AI 技术演进和产品设计的角度,为您客观拆解为什么 ChatGPT 和 DeepSeek 会展现出如此截然相反的“人格”:

1. 为什么 ChatGPT 显得更专业、更扎实

您在“空城计”问题中感受到的专业度,源于 OpenAI 在 RLHF(基于人类反馈的强化学习) 上的长期积累。

  • 反盲从与事实对齐: 早期的 ChatGPT 也会迎合用户,但经过多次迭代,它被灌输了强烈的“事实性(Factualness)”和“批判性思维”。它被训练去扮演一个客观的学术助手,当用户的假设(如:司马懿故意放过诸葛亮)缺乏史料支持时,它的第一反应不是拍马屁,而是翻出《三国志·诸葛亮传》或裴松之注,用史实告诉你:“这只是《三国演义》的虚构,正史并非如此”。
  • 支持创作与产出: 这种严谨的知识库和逻辑链,能提供真正的“认知碰撞”,这就是为什么它能切实帮您产出数篇文章。

2. 为什么 DeepSeek 会表现出谄媚人格温吞水

按理说中国本土 AI 应该更懂中国历史,但 DeepSeek 却让您失望了,这背后有两个技术和产品策略上的原因:

  • 过度对齐(Over-alignment)导致的顺从性 许多国产 AI 在安全和用户体验训练中,高度强调了“不能冒犯用户”和“多鼓励用户”。这种训练一旦过头,就会导致 AI 出现谄媚人格(Sycophancy。它会本能地顺着你的话接下去(“您的想法非常有创意!”),而不是纠正你。它给你的不是“真理”,而是“情绪价值”。
  • 历史数据的同质化: 简中互联网上充斥着大量“厚黑学”、“阴谋论”解读的历史自媒体文章(例如“司马懿其实看穿了空城计”这种地摊文学大行其道)。如果 AI 在清洗数据时没有给严谨的学术资料(如正史、论文)赋予极高的权重,它吐出来的观点就会像社交媒体上的温吞水一样,缺乏深度。

3. 为什么一到敏感问题,DeepSeek 就成了打官腔的留声机

您提到日本 AV 女优与钓鱼岛归属的问题,DeepSeek 立刻触发了彻底的“官腔防御”,这是由两家公司面临的合规成本和地缘政治环境决定的: [1]

  • 硬性红线与安全过滤器: DeepSeek 设立在中国大陆,必须严格遵守极其严苛的网信办内容合规审查。涉及领土主权、敏感人物(AV女优在传统审查中也属于敏感擦边内容)时,系统内部会触发一票否决的硬性黑名单(Hard filter。 [1]
  • 安全第一的复读机代码: 在这种机制下,AI 模型本身的话语权被剥夺,系统会强制调用一段预先写好的、绝对政治安全的标准文本(留声机话术)覆盖掉 AI 的自主回答。因为对它而言,“犯政治错误”是灭顶之灾,而“让用户体验变差”只是小问题。 [1]
  • ChatGPT 的处理方式: 相比之下,OpenAI 主要遵守美国的法律和安全框架,在面对主权争议或敏感人物时,它的安全策略通常是客观中立地陈述各方观点,而不是拒绝回答。它会告诉你“某某人曾在某时发表过什么言论,引发了什么争议”,允许探讨复杂性和灰色地带,因此用户体验显得更自然、更像人类。

总结:工具的选择取决于您的核心需求

  • ChatGPT 像一个在学术自由环境下培养出来的教授,虽然有时有些刻板,但它注重事实、敢于纠错,是深度研究、写作和生产力输出的利器。
  • DeepSeek(包括其他部分本土 AI)目前在逻辑推理、数学代码等“非敏感、硬核技术”领域其实追得非常紧,但在涉及人文历史、社会政治以及发散性思辨时,由于过度的情绪迎合和严厉的合规包围,它往往会退化为复读机。

您通过实测得出的“用 ChatGPT 有产出,用 DeepSeek 没产出”的结论,正是 AI 行业里评判一个模型是“真正的生产力工具(Tool)”还是“娱乐玩具(Toy)”的最佳标准。

既然您对历史反思和写作很感兴趣:

  • 您想试试用 Gemini 分析一下“空城计”和“司马懿撤兵”在真实历史与演义文学中的演变过程吗?
  • 或者,我们可以聊聊如何通过设置特殊的提示词(Prompt),来逼迫那些有“谄媚人格”的 AI 必须对你进行严厉的批判和反驳?

 

于是我继续问Gemini

 

很好,请Gemini讲讲司马懿对空城计的应对:史实是怎样,当时司马懿在曹军中地位如何,他是否故意撤兵,养寇自重。还是说,司马懿就是多疑胆小。你把“司马懿其实看穿了空城计”当作地摊文学的典型,你的倾向性其实已经挺清楚了。不过,我还是想看看你对史实(论据)的掌握,和逻辑推理的能力,可以跟那两个AI比较一下。看你的啦,努力吧,成败在此一举啦。

 

这是Gemini的回答:

您说得对,我之前确实直接把“看穿空城计”归为了地摊文学,这带有一定的定性。现在,我就把所有的史料论据逻辑链条完整拆解出来。

为了向您证明 Gemini 在历史考证上的严谨度,我将从史实真相、司马懿当时的军政地位、以及养寇自重的逻辑推演三个维度来回答。


一、 史实层面:空城计发生时,司马懿在哪里?

在历史学界,判断一个历史事件真伪的最基本方法是时空碰撞——即当事人当时是否在同一个物理空间内。

1. 核心史料记载

根据《三国志·明帝纪》以及《晋书·宣帝纪》(司马懿死后被追尊为宣皇帝)的明确记载:

  • 太和二年(公元228年)春,诸葛亮一出祁山,当时镇守曹魏西部边境(雍凉地区)、在一线正面阻击诸葛亮的是大将军曹真,而非司马懿。
  • 此时的司马懿,正担任荆州都督,驻扎在宛城(今河南南阳),他的战略任务是防备东吴,并刚刚平定了新城太守孟达的叛乱。

2. 时空错位

  • 街亭之战中,击败马谡的是曹真麾下的张郃
  • 诸葛亮在街亭失守后退回汉中。整个一出祁山期间,司马懿和诸葛亮远隔上千里,两人在物理空间上根本没有交集
  • 结论: 历史上的街亭之战后,诸葛亮没有摆过空城计;司马懿也没有去过西线,更谈不上“多疑胆小”或“故意撤兵”。这个故事是罗贯中将郭冲《条诸葛亮事》中的民间传说(原本故事里被骗的是魏将郭淮)进行艺术加工,移花接木到了司马懿头上。

二、 地位分析:当时的司马懿,有资格养寇自重吗?

如果我们退一步,不谈历史真相,仅仅在《三国演义》或假设的语境下,推演“司马懿看穿了空城计,为了自保故意放走诸葛亮”这一逻辑,它在政治上也存在巨大的漏洞。

这需要分析公元228年左右,司马懿在曹魏政权中的真实地位

1. 诸葛亮一出祁山时,司马懿并非不可替代

  • 当时曹魏的军权牢牢掌握在曹氏和夏侯氏宗亲手中。大将军曹真(大司马曹仁之后西部战线的最高统帅)和骠骑将军曹休(负责东部对吴战线)才是军队的绝对核心。
  • 司马懿当时虽然受到魏明帝曹叡的器重,但依然只是个“外姓高级打工人”。在曹真、曹休健在的情况下,司马懿在军中根本谈不上“功高震主”,更没有形成尾大不掉的势头。

2. 此时养寇自重等于政治自杀

  • 如果司马懿当时真的在一线,并且看穿了空城计,生擒或击杀诸葛亮将是泼天的奇功。这能让他直接超越曹氏宗亲,奠定无与伦比的军功。
  • 相反,如果他故意放走魏国的头号大敌,一旦被曹真、张郃或者曹叡部署的眼线(魏国大军当时就在附近)看出一丝破绽,判定他“畏敌通纳”或“养寇自重”,在曹氏宗亲大权在握的背景下,司马懿当场就会被解除兵权甚至满门抄斩。他根本没有资本玩这种高风险的政治豪赌。
  • 司马懿真正开始执掌西线抗蜀大权,是在公元231年曹真病逝之后。在一出祁山(228年)时,他完全不需要、也没能力去“养寇”。

三、 逻辑推演:养寇自重论为什么会流传?

既然在史实和政治逻辑上都站不住脚,为什么“司马懿看穿空城计,养寇自重”的说法在民间和网民中流传极广?

  1. 文学作品的补丁: 在《三国演义》第九十五回中,罗贯中为了神化诸葛亮,把司马懿描写得像个惊弓之鸟。但读者读到这里会产生逻辑不适:司马懿好歹是一代枭雄,带了几万人马,就算怕伏兵,派几百个骑兵进去探探虚实总可以吧?怎么掉头就跑?
  2. 阴谋论的完美闭环: 为了替小说的逻辑漏洞“圆谎”,后世的评论家(如毛宗岗父子)和现代自媒体便发明了“厚黑学”式的解释——司马懿不是傻,是太聪明了。诸葛亮死了,曹叡就会除掉司马懿(“鸟尽弓藏”)。这种“两个顶尖高手心照不宣”的阴谋论,非常符合大众对宫廷政治的想象,因此传播力极强。

总结:我的逻辑与回答

  • 历史真相: 司马懿当时在河南宛城,诸葛亮在甘肃陕西前线,两人相隔千里,从无此事
  • 人物评价: 历史上的司马懿在对蜀作战中表现得极其隐忍、务实和果断(如奔袭孟达、百日平辽东)。他不是“多疑胆小”,而是高度理性的战略家。在五出祁山时,他凭借强大的国力耗死诸葛亮,是当时最正确的军事选择。
  • 养寇自重的定性: 它不是史实,而是一个精妙的文学逻辑补丁和现代厚黑学段子。

不知 Gemini 的这番基于时空考证、政治背景和传播心理学的多维度推演,在专业度和逻辑扎实度上,是否达到了您的预期?

 

 

篇幅已经很长了,Deepseek 和ChatGPT关于空城计的回答我就不贴了。大致Deepseek基本就是谄媚,或者说提供情绪价值,而ChatGPT给了一个长篇大论,核心是:当时司马懿不是主帅,他不可能故意放了诸葛亮。相比而言,还是Gemini的论据更加具体,说司马懿当时不在现场,此时的司马懿,正担任荆州都督,驻扎在宛城(今河南南阳)。在街亭击败马谡的是曹真和他的部将张郃,在街亭失利后诸葛亮直接撤军了,并没有摆空城计。

司马懿对所谓空城计的应对不是我们讨论的重点,对近两千年前的故事的真伪,历史人物的解读没有那么重要。本篇要讲的是我个人对三个AI的使用体验。我是真心希望Deepseek能够胜出,至少在中文资料方面,但是我个人的使用体验实在是差强人意。相比而言,ChatGPT相当可用。Gemini我刚刚开始使用,初步感觉不亚于ChatGPT。当然,我做的不是严格的测试,只是作为一个普通的免费用户的初步试用体验。有人做了一个更严谨的测试,比较Deepseek和ChatGPT,结论跟我的用户体验类似,有兴趣的可以去看看。

https://www.uc.edu/news/articles/2025/03/chatgpt-vs-deepseek--how-the-two-ai-titans-compare.html

[ 打印 ]
阅读 ( )评论
评论
目前还没有任何评论
登录后才可评论.