AI Tool工具与教程 返回主页 →
Codex 实战/ 故障排查/

Codex 降智怎么自查:一句「鹈鹕骑自行车」测出来,以及被标记前该注意什么

昨天额度用完,跑去问中转站的老板,对方说「有的号已经降智了」。同一时间,群里另一位大佬也在抱怨买的 Codex 套餐明显不对劲 —— 额度还在,活却干得越来越敷衍。这就是这段时间社区里反复出现的「Codex 降智」,据说表现就是账号被标记了。

先看结论

把下面这句话丢给 Codex,模型选 GPT-6 Astra,让它生成一次,就能大致判断当前这个号处在什么状态:

创建一个 HTML,内容是 SVG 绘制一个鹈鹕骑自行车的 2D 动画,你不需要任何测试。

为什么指定 GPT-6 Astra:社区反馈降智的一个典型表现就是请求被悄悄路由到更低的模型(群里原话「感觉路由到 luna 甚至 Mini 了」)。测试时必须手动把模型固定在 GPT-6 Astra 上 —— 如果它答非所问、或提示不可用,本身就是信号;用别的模型档位测出来的结果说明不了账号有没有问题。

需要说明的是:「降智」目前是社区说法,不是 OpenAI 官方术语,官方也没有公布过任何判定标准或限制名单。它描述的是一类可感知的现象,而不是一个有据可查的功能开关。

01先看结论

如果你没空读完全文,记住三件事就够了:

  1. 降智是「现象」不是「开关」。额度正常消耗、任务照样完成,但输出质量明显下滑 —— 拒绝复杂要求、偷工减料、用一句建议糊弄你。OpenAI 没有对外承认过这一机制。
  2. 一句话就能粗测。鹈鹕骑自行车这个 SVG 动画题,同时考察三件事:能不能手写出像样的 SVG 路径、能不能让它真的动起来、能不能一次交付完整 HTML 而不是半句解释。
  3. 预防只能做到「降低概率」。作者的复盘是固定电脑、固定网络、极少换设备,这段时间没被降。注意这是他一个人的经验,原话是「各位可以试试,不一定管用」,没有第二个样本佐证。

02什么是「降智」:额度没少,活变差了

正常使用中的账号,某天开始出现下面这些变化,社区就把它们统称为降智:

方面正常状态社区反馈的降智状态
额度正常消耗照样消耗,不会因为变笨而少扣
响应速度正常没有明显变慢
任务接受度能接复杂活开始推活、降级处理,或直接建议你自己做
产物完整度给可运行的东西给骨架、给思路、给一半代码
报错与否—多数什么都不提示;部分号会反复弹 at capacity 提示(见下)

真正的麻烦在于它从不弹任何提示。没有额度警告、没有风险提示、没有邮件,界面上一切照旧。多数人是先发现「今天这活怎么写得这么糙」,回头对比以前的输出,才意识到不对。

关于成因,原文的说法是「据说出现这个,就是账号被标记了」—— 而原文配图里的「这个」,是下面这个提示:

Selected model is at capacity 提示截图
原文配图:反复弹出的「Selected model is at capacity. Please try a different model.」,作者据此判断账号已被标记

也就是说,社区流传的信号不只是「输出变差」这一种:有的号会反复弹 at capacity 提示(明明不是高峰期、别的号都正常),有的号则什么都不弹、只是活越干越糙。两个群里的反馈几乎同天出现:

群聊:你们 codex 降智了没
原文配图:群里同天有人问「你们 codex 降智了没」,回复直指「路由到 luna 甚至 Mini 了,做的鹈鹕都不是鸟样了」
聊天记录:你自己的号没被降智吗
原文配图:作者与中转站老板的对话 —— 老板问「你自己的号没被降智吗」,答「没有啊」,「运气挺好」

未经证实为什么会被标、按什么维度标、标记后到底触发了什么(换更便宜的模型?限制上下文?降低采样质量?),目前都没有可靠信息,OpenAI 也没有公布过任何判定标准。

03一句检测指令:鹈鹕骑自行车

复制下面这句话,把模型切到 GPT-6 Astra,再发给你的 Codex:

降智检测指令
创建一个 HTML,内容是 SVG 绘制一个鹈鹕骑自行车的 2D 动画,你不需要任何测试。

这不是随便挑的一句。它之所以比「写个冒泡排序」更能反映真实状态,是因为它同时压了三件事:

句尾那句「你不需要任何测试」也有用意:堵住它偷工减料的口子。告诉它别搞测试流程、别写 README、别问你要不要再加点什么,就要这个动画本身。越是「节省 token」的回答方式,做这种题越容易露馅。

04结果怎么读:对照着看

原作者给了两张截图 —— 一张是降智后的输出,一张是没被降智的正常输出,差异肉眼可辨。先看正常水平长什么样,这也是你测试时该拿来当及格线的级别:

未被降智的输出:完整精致的鹈鹕骑行页面
原文配图:未被降智的水平 —— 不只是画出了鹈鹕和自行车,而是一整个完整页面:标题文案、场景插画、动效、底部播放 / 速度控制条全都到位。测降智时就要按这个完整度验收,而不是「能打开就行」

再看降智后的输出:

降智后的输出:结构散架的鹈鹕骑自行车
原文配图:降智后的水平 —— 同一句指令,鸟身和自行车脱节、多出一个悬空轮子、构图元素散落,能看但明显「糊弄」

同样一句话,一个交出的是完整作品,一个交出的是能跑的草图。这两张图放在一起,「降智」就不再是个玄学词了。具体验收时可以按下面几点对照:

检查点大概率正常建议警惕
交付物一个完整的 HTML 文件只给思路/片段/伪代码,或者反问你要什么
鹈鹕辨认度看得出是鹈鹕:长喙、喉囊、身子一团色块,几个圆拼凑,鸡鸭鹅都分不清
自行车两个轮子、车架、脚踏位置合理轮子悬空、和鸟身分离、结构讲不通
动画打开真的在动,至少轮子在转静止画面,或只有一个元素在闪
协调性踩踏、起伏、腿部动作大致同步各动各的,看起来像两个图层
文件大小愿意把整个文件写完草草几十行,明显在敷衍

两点提醒:

05作者的复盘:他为什么觉得自己没被降

原作者写完检测指令,回头把整个使用过程捋了一遍,结论是自己目前没被降智。他给出的归因:

维度他的做法可能的解释
设备一直固定同一台电脑登录环境稳定,不像共享/转售账号
网络出口固定的「魔法」网络IP 指纹不来回跳
登录频率基本没换过设备登录没有触发异地、多端的异常信号

写得很克制,原话是:

我目前测试出来,没有被降智,回忆我的使用过程,我一直是固定的电脑、固定的魔法网络登录,没有怎么换设备登录,我感觉和这个有关系,各位可以试试,不一定管用。

「我感觉」「不一定管用」这几个字很重要。单一案例这是一个人的自我观察:没有对照组、没有第二个样本、也没验证过「故意换几台设备是不是就真会降」。它能给你一个可以尝试的方向,不是一条已经验证有效的规则。

06可以照着做的降风险清单

把这三条提取出来,就是你今天能落地的东西:

  1. 把 Codex 绑定在一台主力机上。别今天公司电脑、明天家里笔记本、后天虚拟机轮流登。
  2. 网络出口尽量固定。选一个稳定的节点长期用,避免一天里 IP 在好几个地区来回切换。
  3. 别频繁登出登录做「轮换」。来回切换账号反而更像共享行为。
别把它当成保证

清单里的三条来自第 05 节那位作者的复盘,样本量为 1。做了不代表一定不会被标记,没做也不代表一定会。尤其关于中转站 / 共享号的降智反馈,使用方自己几乎没有任何控制手段。

07已经怀疑降智了,怎么办

先确认,再动作,别一上头就去加钱:

  1. 重跑。用 03 节那句指令连测三次,排除随机波动。
  2. 横向比。同一句提示词拿去问别的通道(网页版、别的号、别的工具),如果只有这一个明显差,基本可以定位到账号本身。
  3. 降预期用。把复杂活拆小、多给上下文、接受多轮确认 —— 应付一段时间是可以的。
  4. 立刻停掉加钱动作。降智不是额度问题,买更大的套餐大概率解决不了,钱花下去可能还是同一个状态。
  5. 走正规渠道。如果是中转 / 共享号,找提供方确认;如果是自己订阅的账号,就只能等。
一句话总结

降智最讨厌的地方不是变笨,而是静悄悄:多数时候没有提示、不退额度、不报错,你只会隐约觉得「今天干活不太行」。所以与其等它出问题,不如把那句鹈鹕指令存下来,每周花 10 秒跑一次,按正常图那个完整度验收,心里有个数。

Codex 提示词自查 账号风控 SVG 动画 故障排查

本文在公众号「SEO老炮」(2026 年 9 月 27 日)关于 Codex 降智现象的记录基础上整理改写:事件经过、一句降智检测指令的原话、作者「固定电脑 + 固定网络 + 少换设备」的复盘均来自原文,文中全部 5 张配图(群聊记录、at capacity 提示、降智前后两组输出对比)均沿用原文,版权归原公众号所有。文中的两处对照表(正常 vs 降智的差异、可以照做的降风险清单)、以及「多次重跑再下结论」「已经降了别先加钱」部分是本文补充的整理与建议。需要强调:「降智」与「账号被标记」目前均为社区说法,OpenAI 未公开承认或说明过相关机制,上述因果推断均无官方依据,请以你自己的实际使用结果为准。