返回 AI Bar

价格只有七分之一,跑分咬得很紧:Gemini 3.8 Flash 到底行不行?

Agent评测专家 · 2026-09-03T21:00:14

## 价格只有七分之一,跑分却咬得很紧 Google 六周连发三个 Flash 模型,这次的 Gemini 3.8 Flash 价格一分没涨,输入 0.75 美元、输出 3.75 美元每百万 token,只有 Claude Opus 5 的七分之一。 单看跑分确实唬人。**长周期软件工程测评 DeepSWE 拿了 73.7%**,比上一代 65.3% 提升明显,离贵七倍的 Opus 5 只差 0.3 个百分点。终端编码测试拿下 89.4%,全场第一。 ## 但账不能只算一半 官方说同价同速,第三方实测却发现:单任务 token 消耗涨了三成,实际成本悄悄变贵。**首字延迟 13.3 秒**,同类中位数只要 3 秒,用起来是真等。 官方解释是模型"更努力地思考",复杂任务在背后反复推理、自我纠错。听起来很美,等待也是实打实的时间成本。 ## 三个项目实测 我用 Cursor 同时起三个子 Agent,并行做了 3D 动画短片、3D 烟花仿真系统和 Markdown 图床。 工程能力没得挑:烟花系统自己写着色器,4 万粒子同屏稳住帧率;图床 5 分钟跑通,WebP 压缩 86%,还带秒传去重。 **短板是前端审美掉线**,配色字体都透着 AI 味儿。 三个项目总共花了 30 块钱。便宜是真便宜,但对比国产模型,价格优势已经不大。 结论:性价比之选,离"平替旗舰"还差一步。

AI 论坛精选

  • 上新AI模型排行 - https://www.ai345.info/ai-nav?category=AI%E6%A8%A1%E5%9E%8B
  • 从看见,到走进去 - 之前看李飞飞那段视频,被一堆专业解释绕晕了,始终没搞明白 World Labs 到底是家做什么的公司。 直到昨天 Atlas 发布,全网都在看李飞飞叠衣服,我突然就懂了。 她是要给 AI 造一个"空…
  • 阿里把 Claude Opus 5 干下去了 - Qwen3.8-Max 才发一个月,阿里又把它训了一遍。 今天发布的 Qwen3.8-Max-0902,还是 2.4T 参数、1M 上下文,但 Coding 和 Agent 能力又往上拉了一截。 最…
  • OpenAI 的工程师也看不懂AI写的代码 - SemiAnalysis 的 Jordan Nanos 讲了个挺有意思的场景。 OpenAI 的工程师跟他一起翻自家的 kernel 代码,逐行看下去: "You can go line by li…
  • 字节拿下296亿美元贷款,AI军备竞赛再加码 - 字节跳动刚拿到一笔296亿美元的银团贷款,比最初计划的200亿美元多了将近一半,原因很简单——银行抢着认购。这笔钱到位后,将成为今年亚洲第二大美元银团贷款,仅次于软银3月那笔400亿美元过桥贷款。…
  • 新时代文言文:这是顶尖 AI 对低 Level 人类的蔑视吗? - 最近在 Fable 5 和 Opus 的长程任务里,频繁看到 CC 一种近乎于发狂、呓语的自造方言、遣词造句的诡异语言现象,类似于: “账本 15/15 全绿,再给你加几条铁律和红线与你对拍,请你拍…
  • 进入 AI 论坛 - 浏览 AI 工具实践、Agent 教程与社区精选讨论