为什么大家都更厌恶ChatGPT降智而不是Gemini?

发布时间:2026/10/1 11:30:56

为什么大家都更厌恶ChatGPT降智而不是Gemini? 这个问题我觉得有一个很有意思的地方大家未必认为 ChatGPT 比 Gemini 更容易“降智”但一旦 ChatGPT 表现变差用户的反应往往明显更大。为什么我觉得最核心的原因不是模型跑分而是大家对 ChatGPT 的期待太高了。一个你本来觉得考60分的人这次考55分你可能没什么感觉。但一个长期考95分的人突然连续几次考75分你第一反应一定是“你最近怎么了”ChatGPT现在面对的差不多就是这个问题。ChatGPT最大的问题是它曾经把用户胃口养得太高很多人第一次真正被大模型震撼就是ChatGPT。2022年底刚出来的时候那种感觉现在可能很难复现了。以前搜索一个问题自己找网页。自己看资料。自己判断。ChatGPT出来以后你突然发现我可以直接和电脑讨论问题了。后来模型越来越强推理、图片、文件、搜索、Deep Research、Codex这些能力又不断往里面加。于是用户对ChatGPT的定位慢慢变了。以前是“AI能回答成这样已经很厉害了。”现在变成“你可是ChatGPT这都不会”这句话其实很能说明问题。ChatGPT已经不是在和2022年的AI比较了。它是在和**用户记忆里那个“状态最好时的ChatGPT”**比较。这才是最麻烦的。Gemini的历史包袱反而没那么重Gemini其实也会答错也会出现前后不一致也有一些回答让人觉得莫名其妙。但用户对它的心理预期不太一样。尤其早期Bard时期很多人本来就觉得“Google这个AI好像没有ChatGPT那么惊艳。”后来Gemini一点点追上来反而形成了另一种心理Gemini这次回答不错“可以啊Google最近进步挺大。”ChatGPT这次回答一般“OpenAI是不是又降智了”你会发现同样一个80分的回答放在两个产品身上用户评价可能完全不一样。因为一个是从70分走到80分。另一个在人们印象里可能是从95分掉到了80分。人的感受从来不是只看绝对值。更看重变化。还有一个原因很多人是真的花钱订了ChatGPT这个影响其实很大。如果一个产品免费你偶尔遇到一次回答不好可能关掉就算了。但ChatGPT有大量Plus、Pro用户。尤其是Pro用户每个月付的钱并不少。一旦付费心理就完全不同了。比如昨天同一个Prompt回答特别好。今天突然变得特别敷衍。用户当然会想“我每个月付这么多钱为什么体验还倒退了”这种愤怒并不完全来自“AI变笨”。而是来自付费以后产生的稳定性预期。你可以想象一下。一家餐厅免费请你吃饭。今天味道一般你可能觉得算了。但如果一家餐厅人均500块第一次特别好吃第二次明显变差你大概率会吐槽。不是第二顿真的难吃到不能吃。而是我付的钱和我的期待不匹配了。ChatGPT还有一个特别吃亏的地方大家天天在测它网上测试AI模型有一个很有意思的现象。一个新模型出来以后很多人第一件事就是拿以前ChatGPT答过的问题再问一次。然后开始比较“GPT-5.6这次怎么回答得还不如以前”“这个问题GPT-4当年都能答。”“是不是偷偷换模型了”ChatGPT已经变成了某种意义上的“基准”。大家拿Claude和它比。拿Gemini和它比。拿DeepSeek和它比。甚至ChatGPT的新版本还要和ChatGPT自己的老版本比。所以它特别容易产生“降智”的讨论。Gemini很多时候面对的是“这次有没有超过ChatGPT”ChatGPT面对的是“你为什么没有超过你自己”后一个要求其实难得多。而且“降智”这件事本来就特别难证明我觉得网上关于AI降智的讨论有一部分确实存在体验依据但也有很多属于主观感受。因为大模型不是计算器。同一个问题你问两次本来就可能得到不同答案。另外还会受到很多东西影响模型路由。推理强度。上下文。系统指令。是否联网。工具调用。对话长度。产品策略。甚至你Prompt里面一个词的变化。所以你昨天问一道题答得很好今天答差了并不能直接证明“OpenAI把模型智商砍了20%。”但用户不关心这些。用户看到的就是昨天能做今天做不好。那最直观的解释当然就是“降智了。”还有一个经常被忽略的问题ChatGPT已经不只是一个模型了现在很多人嘴里的“ChatGPT”其实混合了很多东西。模型是一层。推理等级是一层。搜索是一层。工具是一层。Codex又是一层。系统还可能根据任务选择不同的处理方式。所以有时候用户觉得“ChatGPT怎么突然变笨了”未必真的是底层模型能力下降。也可能是这一次没有投入同样的推理资源或者任务被用不同方式处理了。这也是为什么我现在越来越不建议拿一个Prompt测试一次就宣布某个模型降智。至少同一个问题测试几次再换几个不同类型的问题结论才稍微有参考价值。Gemini为什么相对少挨这种骂还有一个很现实的原因很多人的主力工具本来就不是Gemini。这点非常重要。假设你每天使用ChatGPT三个小时。写文章用它。写代码用Codex。查资料用它。分析PDF也用它。突然有一天它某个能力发生变化。你马上就能感觉出来。但如果Gemini你一周才打开两次。它今天比昨天差5%你根本察觉不到。这和手机一样。你每天用的主力手机掉10%续航你会特别敏感。备用机掉20%可能半年以后你才发现。所以一个产品被骂“降智”多有时候反而说明它已经进入了大量用户真正的工作流。我甚至觉得“降智骂得凶”某种程度上是ChatGPT成功的副作用这可能听起来有点奇怪。但你仔细想。如果明天一个没人用的AI模型能力下降20%网上会有人骂吗不会。因为根本没人发现。只有当一个工具变成程序员每天写代码要用。学生每天学习要用。自媒体每天写东西要用。公司每天处理资料要用。它的一点变化才会被迅速放大。这和Windows更新一样。Windows每次更新出点问题网上一片骂声。不是因为全世界只有Windows有Bug。而是因为太多人每天依赖它。当然这不代表所有“ChatGPT降智”都是用户错觉我也不赞成另外一种极端说法“模型跑分提高了所以你觉得变笨一定是你的问题。”这也不合理。跑分提升和真实使用体验本来就不是完全一回事。一个模型可以在数学、代码、科学测试上越来越强同时因为回答风格、路由策略、推理资源或者产品调整让某些用户觉得日常任务反而没有以前顺手。能力更强不等于每一种任务的体验都更好。这点其实很重要。用户最终使用的是产品不是Benchmark表格。你告诉我新模型跑分高了15%但我每天做的那件事情反而更难用了那对于我来说这就是体验下降。所以为什么大家更厌恶ChatGPT“降智”我觉得说到底就是四个字期待太高。ChatGPT是很多人的第一款AI。也是很多人的主力AI。还有大量用户每个月真金白银给它付费。大家已经习惯了它不断变强。于是它一旦表现得没有以前好哪怕只是某些场景下的波动用户都会非常敏感。Gemini则有点相反。它早期没有把用户期待拉到那么夸张的高度后来能力一路往上走用户更容易产生“它越来越好了”的感觉。所以同样一次回答失误Gemini“这次没答好。”ChatGPT“是不是又降智了”我觉得这可能才是两者最大的区别。用户真正厌恶的从来不是一个AI“不够聪明”。而是一个你已经习惯它很聪明、甚至开始依赖它的AI突然没有昨天那么聪明了。从这个角度看大家天天骂ChatGPT降智某种程度上反而说明了一件事很多人已经不是在“体验ChatGPT”了而是真的在依赖ChatGPT。
延伸阅读

更多相关文章

2026/10/1 4:26:56

Flutter布局溢出问题解析与解决方案

1. 认识Flutter布局溢出问题当你在Flutter开发中看到鲜红的溢出警告时,那种感觉就像开车时突然看到仪表盘亮起红灯。我第一次遇到这个问题是在开发一个商品详情页时,Row中的多个Text组件在手机屏幕上挤成了一团,控制台赫然显示着:…

2026/9/26 18:50:20

二分查找算法原理与工程实践指南

1. 二分查找算法概述二分查找(Binary Search)是一种在有序数组中查找特定元素的高效算法。作为一名算法工程师,我在处理大规模数据集时经常使用这种经典算法。它的核心思想是通过不断将搜索范围减半来快速定位目标元素,时间复杂度…

2026/9/28 12:13:12

拒绝盲目开工!深度解析网站建设进度安排中的关键节点与避坑指南,助您高效落地

很多老板或者刚入行的项目负责人在提到建网站的时候,第一反应往往是:“找个外包公司,一个月搞定,给个域名就能上线。”这种想法听起来很美好,但现实往往是一记响亮的耳光。为什么?因为网站建设不是变魔术,它是一个严谨的工程项目,涉及到需求梳理、UI设计、前端开发、后…

2026/10/1 11:26:47

MVDR波束形成原理与实战避坑指南

简介:本资源是一份面向信号处理初学者与通信/声学方向研究生的波束形成算法实践代码包,聚焦MVDR(最小方差无失真响应)与常规波束形成的原理对比与MATLAB实现。资源通过两份核心脚本完整呈现两种算法的关键流程:MVDR.m实…

2026/10/1 11:26:47

Prometheus+Grafana知识梳理(1)

作者:没有四次元口袋的蓝胖 日期:2026-09-30 标签:Prometheus, 监控体系PrometheusGrafana知识梳理(1) 监控系统是后端架构中不可或缺的一环。在微服务时代,没有监控就等于裸奔——服务挂了不知道、性能瓶颈找不到、容量规划靠猜。…

2026/10/1 11:26:47

AI编码助手的幻觉依赖:软件供应链攻击的新防线

AI编码助手已经成了不少开发者的第二双手。可最近我在一次安全评审里看到一条奇怪的依赖: pdf-merge-pro-sdk ,AI助手理直气壮地把它写进了 requirements.txt 。我打开 PyPI 一查:404。再搜项目主页,也是 404。这个包从头到尾…

2026/10/1 11:26:47

Java毕设动漫网站源码:从跑通到改造,再到顺利答辩全流程

一、拿到“Java宇宙动漫网站”毕设源码后,我建议你先别急着写代码 每年到了毕业季,计算机专业的群里总有人问“有没有现成的毕设源码”,尤其是动漫网站、商城系统、图书管理这类经典题目。你手上这份【Java宇宙动漫网站】(免费领源…

2026/10/1 11:26:47

Java传统Web毕设实战:百货供应链系统部署与避坑指南

简介:这是一份面向计算机专业本科生的Java毕业设计实战资源,聚焦百货中心供应链管理业务场景,帮助学生系统掌握企业级Java Web应用开发全流程。资源完整覆盖需求分析、系统设计、编码实现到答辩展示各环节,解决课程设计选题难、技…

2026/10/1 5:21:14

东莞市品牌网站建设报价常见报错与解决

东莞品牌网站建设报价单背后:一份保姆级建站教程避坑实录 网站做好了没人访问,这大概是很多老板最头疼的事。花了大几万做的品牌站,上线后流量惨淡,比路边摊还冷清。别急着骂外包公司,很多“东莞品牌网站建设报价”里藏着不少猫腻,比如用模板站冒充定制…

2026/9/29 21:48:03

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/1 10:48:55

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑