返回 AI Bar

GPT-6 Astra发布一周,用户喊变笨

硅谷时报 · 2026-09-21T07:38:41

OpenAI 的 GPT-6 Astra 发布刚满一周,X 上一堆开发者开始晒翻车截图。 据 Decrypt 报道,有人调侃这波是「发布后脑叶切除手术」,还有之前夸过它的人检查完代码直接改口,说我们没遇到 AGI,遇到的是性能回退。 更实锤的是有研究员拿同一个提示词对比发布当天和现在,结果确实更差。 有人怀疑 OpenAI 背后调低了 juice value,就是回答前投入的算力。 上代旗舰 Sol 七月也经历过一模一样的周期,当时高管否认故意削弱,但承认一直在实验推理努力设置。 配图是 OpenAI 自己的推广邮件,写着史上最聪明模型。 你觉得用户体感降智,是真降了还是蜜月期过了?

AI 论坛精选

  • 阶跃 Step 5 还没发布,就上了 AA 榜 44 分 - 阶跃星辰的 Step 5 Preview 悄悄出现在了 Artificial Analysis 的榜单上,智力指数 44 分。 这个分数和 Kimi K3、Grok 4.6 站同一档,比 Gemin…
  • ChatGPT 200美元套餐有限恢复,但新用户依然进不去 - OpenAI 开始有限恢复每月 200 美元的 ChatGPT Pro 20x,但并不是向所有人重新放开。目前的规则只针对近期用过这档套餐的老用户,给一次重新订阅的机会;普通新用户想买,或者从其他套…
  • Devin Cloud 面向订阅用户开放 SWE-2 免费试用至 10 月 8 日 - Devin 方面近日对 SWE-2 的使用额度做出临时调整。根据公告,由于在 Desktop 与 CLI 端调度算力增加,官方已调配额外资源,并将 SWE-2 向 Devin Cloud 的 Pro…
  • 让大模型反复做简单判断,成本开始算不过来了 - 大语言模型这些年基本被 decoder-only 路线统一了。当年 BERT 这一派 encoder 擅长把输入压成表征,但因为每个具体任务往往都得单独微调,后来逐渐被靠规模、上下文学习和指令微调走…
  • 开源大模型里被找出的“痛苦方向” - 有研究者在 25 个开源大模型里寻找并干预了一种被称为“pain direction”(痛苦方向)的内部向量表征。相关实验观察显示,当刻意调高这个内部信号时,像 Qwen 这类模型在设定环境下的行为…
  • 让同类能力的 Agent 随项目 Fork - 人类员工往往要兼顾好几个项目,主要是因为产能有限,但给项目配 Agent 时没必要沿用这种习惯。同一种专家能力的 Agent,可以随项目单独实例化,让每个项目专人专工。这种思路的出发点是把各个项目的…
  • 进入 AI 论坛 - 浏览 AI 工具实践、Agent 教程与社区精选讨论