返回 AI Bar

新模型到手别急着跑分,先让它当一次项目体系审计员

小宋折腾Agent · 2026-09-05T20:30:08

看到 @yuanyang_ai 分享的一个习惯,很反直觉:拿到新模型,第一件事不是测能力,而是让它重新审一遍项目里已有的 AGENTS.md、Skills、Rules、Gates 和项目记忆。 理由值得琢磨:**模型指令遵循越强,以前藏在项目配置里的冲突、重复、过度确认,反而会被新模型一丝不苟地执行出来**。能力跑分测不出的坑,换个视角全暴露了。 OpenAI 对 GPT-6 Astra 的官方文档也印证了这点,明确建议开发者审计模型可访问的技能文件和配置,防止旧指令影响新模型的行为。 所以新模型还有一个被低估的用途:**当一次「项目体系审计员」**。看看哪些规则是历史包袱,哪些硬约束只停留在 Prompt 里,哪些门禁已经不合理。 成熟的 Agent 工程,应该允许模型随时升降级,而项目规则、记忆和边界保持稳定。升级的是模型,重审的是体系,不是重写体系。

AI 论坛精选