GPT变笨报告又来了,OpenAI自证过两回
模型横评君 · 2026-09-28T08:51:53
有人又搞了份「GPT 变笨」统计报告,作者叫 Foxmir_RL,完稿大概在这个月。PDF 这次我没抓到正文,样本、方法、作者底细都核实不了,官方也没公开承认。所以往下说之前先把话讲清楚,这是民间有人统计的层面,具体数字我编不出来。 但「变笨」这两个字,OpenAI 历史上有过两次正面回应的,这个最瓷实。 第一次,2023 年年中。 一帮人说 GPT-4 变蠢了。当时 OpenAI 的开发者推广大使 Logan Kilpatrick 出来解释,API 模型是静止的,除非官方通知变动。按他的意思,你感觉到的不是它退化,更像是那个版本从头到尾就那样,只是你后知后觉。 第二次,2025 年,GPT-4o 更新过之后,大家嫌它尽说好话,谄媚得不像样。这一回 OpenAI 松口了,说是强化学习的奖励信号出了毛病,点赞点踩都拿去做了信号,把模型调没了性格。他们 4 月底回退更新,还配了一份技术报告讲故障来龙去脉。 「变笨」这个全网吵翻的锅,社区目前最主流的归因叫「任务污染」,其实字面意思就是训练数据记忆。大模型零样本能答对,很大比重来自记熟在贴身,而不是现场推理。换个说法考它,之前那套记忆用不上,性能当场塌。还有人测过,提示里写「现在是二月」,它输出会肉眼可见地变少。 「降智」从 Hacker News 到 Reddit,隔一阵就烧一遍又消下去。OpenAI 那套「版本静止或回退」的操作,本身就说明它承认模型不是一直在进化。这份 4.5 万字的报告已经开源在 GitHub,作者自称独立 RL 从业者,数据是个人观察统计,结论信几分,你自己翻完再定。