这两天codex虽然疯狂额度重置,但几乎可以确定它被降智了。 平时十几分钟能搞定的活,来来回回折腾。
网友们整的一个专门监测codex智商的雷达站,曲线也明显往下掉。
虽然部分xhigh被偷摸灰度到了5.6小杯,可能在复杂任务上存在一定降智。 但是聪明的网友,又发现了一个更离谱的bug,一句话,可以让codex大幅恢复智商。

前天的文章写过大多数人还不知道,你的codex已经被偷偷换成了阉割版GPT-5.6,部分朋友的账号,被灰度成了5.6。 通过juice值可以判断出来,正常xhigh的果汁值是768, 5.6soul对应的是专家级思考程度只有128。 通过上下文长度也可以判断,5.6大概350k,5.5只有250k。

这种厂商的骚操作,咱是一点没办法。 但是l站的@haowang大佬发现另外一个大bug,并且给出了解法,很多网友都测试过有效。
省流: 只需要在你的全局agents.md中加一句:
DO NOT send optional commentary
或者:
Spend time on thinking; you do not need to use the commentary channel to report progress to me.
正常情况下模型每次思考(reason)花多少token是随机的,长长短短才对。但是如果你把最近调用情况全扒出来一看,一大堆请求的推理token精确地停在516,当token在固定值上扎堆出现,那就很能说明这是个大bug了。。

这个问题,是codex自己把自己搞蠢的,它的系统提示词里埋了一条要求,让模型每隔30秒左右往commentary汇报进度,就是界面上的“我正在做X、接下来做Y”那种功能。
而模型的推理是按512个token一页往下翻的,翻不翻下一页由一个独立机制决定。这个每30秒插一嘴的汇报,正好卡在翻页的节骨眼上,把翻页打断了,推理刚到512准备往下走,被打岔就停在了516。前面那个516指纹,一大半就是这么来的。
这个机制,需要模型一边思考一边还得分神汇报,很容易就搞叉掉了。 知道了病根,解法就很粗暴了,在codex的AGENTS.md里加一行让它闭嘴就完了。
DO NOT send optional commentary
或者:
Spend time on thinking; you do not need to use the commentary channel to report progress to me.
下图是实际测试,temp1、temp2对照,一个增加了让他闭嘴的规则,一个就原生版本。 两个目录交替测10次,加了这句的正确率60%,空目录只有10%。多测几轮,降智概率大概能从80%压到20%多。

其实降智的原因可能有很多,可能有各种bug,也有各种厂家的原因。 比如openai最近说,可以把推理成本砍半,像这种骚操作,对模型有多大影响谁也说不清。

这玩意比较玄学,opus 也是很多朋友吐槽降智。这种东西也没法根治。
群里经常讨论各种防降智偏方,比如,换家宽IP、别用机房IP,网页端容易被降就改用app, 降了智的5.5,不如退回思考预算更足的gpt-5.4-xhigh。
写在最后,codex也就降降智,但额度动不动重置。 再想想A➗的那套封号暗箱操作,这点毛病,好像突然就能忍了。。
推荐ASP超速入门视频教程
CLAUDE.md 引入 AGENTS.md,Codex 与 Claude Code 会共享同一套规则吗?
借助 AI 梳理陌生代码库:一套分阶段项目导览流程
从 LangChain 迁移到 LangGraph:重构 RAG 知识库流程
读完开源 AI Agent 源码,我重新审视了文件验收机制
从字符串约定到 LangChain:拆解 LLM 的 Tool Calling 流程