惊现!新版 Codex 客户端,竟然在偷偷给第三方中转站“降智”。
7 月 11 日,我就发现新版 Codex 无法生图,并且第一时间公开了完整解决方案。
本以为这只是一个生图功能限制,结果继续逆向分析后,我发现事情远没有这么简单。
新版 Codex 一旦检测到你使用的是第三方 Provider,就会直接限制两项重要能力:
1、图片生成
2、Web Search
生图被限制,大家很容易发现。
但 Web Search 被悄悄关闭,才是真正影响模型能力的地方。
很多人可能不知道 Web Search 有多重要。
大模型的内部知识库都有截止日期,它并不知道今天刚刚发生了什么,也无法凭空获取最新的文档、新闻和技术变化。
所以模型厂商会给模型外挂一个实时联网搜索能力,这就是 Web Search。
它相当于模型的“眼睛”。
没有 Web Search,模型只能依赖旧知识回答问题;
有了 Web Search,它才能实时查询全网信息,验证事实,读取最新文档。
但现在,只要你在新版 Codex 中使用第三方中转站,哪怕后端接入的是完全相同的正版模型,客户端也可能直接把 Web Search 能力屏蔽掉。
模型没变。
API 没变。
只是因为 Provider 不是官方的,客户端就主动砍掉了能力。
这才是真正意义上的“客户端降智”。
好消息是,经过逆向分析,我已经找到了绕过限制、恢复生图和 Web Search 的方法。
详细修改教程,我已经发在前一条推文里:
正在使用 Codex 第三方中转站的人,建议马上检查一下。
你以为自己用的是同一个模型,实际上客户端可能早就偷偷阉割了它。
大家可以看一下附图修改前后的对比:
显示更多
深度体验了一整天 GPT-5.6-sol。
我的态度大概经历了三个阶段:
兴奋 → 质疑 → 理解并接受。
先说一个很容易被混淆的地方:
GPT-5.6-sol 本身最高的推理等级其实还是 xhigh,UI 里显示的 Max 和 Ultra,更多指的是客户端的工作流模式,并不只是单纯把模型“调得更聪明”。
今天 Ultra 被吐槽最多的地方,就是它很喜欢自动派发大量子代理。
哪怕只是一个不算复杂的任务,也可能瞬间拉起一堆代理,消耗大量 Token,整个过程看起来声势浩大,但实际收益未必能匹配成本。
我刚开始用的时候也有点怀疑:
这到底是在干活,还是在拿 Token 堆排场?
后来理解了它的机制,我把推理等级降到 High,又重新跑了一些真实任务,体验反而好了很多。
速度比 GPT-5.5 xhigh 更快,能力和稳定性又明显更强,Token 消耗也没有 Ultra 那么夸张。
至少以我今天的体验来看:
GPT-5.6-sol + High,可能才是目前最适合日常使用的组合。
复杂重构、全项目 Review、需要并行探索的大任务,可以再考虑 Ultra。
普通开发任务没必要一上来就拉满。
这个模型不是不能用,也不是一定要无脑开最高档。
真正的问题是,很多人还没搞清楚 Max、Ultra 和推理等级的区别,就已经开始拿 Ultra 当默认模式了。
用对了,确实比 5.5 强不少。
用错了,就只能看着 Token 哗哗往外流。
显示更多
给大家一个忠告!如果你要使用 5.6 sol。
请把 Superpowers 暂时的丢进垃圾桶!
否则你将会见到模型持续数小时的左右脑互博!最终问题越来越多,没完没了!
显示更多
抱歉,真的草率了,请原谅!
深度用了一整天,觉得 5.6 sol 太慢了,其次是太纠结了。一个小问题,越修范围越大!
不好意思,奥特曼,这次真的无法帮你吹牛逼了!吊了这么久的胃口,就这?
当我知道了 5.6 原来是使用 5.4 的底座开发的,我就知道要完蛋了!
显示更多
gpt-5.6-sol 还没用上的,真的赶紧去用。
我刚用 ultra 模式,把自己的中转站项目完整 review 了一遍。
耗时 1 小时 32 分钟,硬生生揪出了 19 个问题。
说实话,我人都看傻了。
我一直有个习惯:每次发版前必须做一次 review。原本以为项目已经挺干净了,结果还是挖出一堆历史遗留问题。
现在终于明白了:
gpt-5.5 留下的屎山,得靠 gpt-5.6 来擦。
至于 gpt-5.6 留下的屎山……
那就等 GPT-6.0 来擦吧。
显示更多
gpt-5.6-sol 已经出现在 Codex 仓库的 models.json 文件中了。
我最关心的上下文大小也基本明确了:372K。相比上一代 gpt-5.5 的 272K,提升了大概 36.7%。
不过说实话,看到这个数字还是有点小遗憾。毕竟 opus 4.8 和 fable-5 都已经做到 1M 上下文了,372K 放在现在看确实不算特别夸张。
但好在 Codex 的压缩能力一直很强,长任务里多轮压缩之后,稳定性依然保持得不错。所以实际用起来,影响可能没有数字看上去那么大。
总的来说,算是稳步升级吧,但还是希望下一代能把上下文直接拉满。
显示更多
GPT 5.6 Sol 的 Ulitra 版本 OpenAI 的高层管理明确了会集成到 Codex 中,
这算是一个不错的好消息,不像 A社 那样只会上一个阉割版!
之前 OpenAI 没有把 GPT 5.5 PRO模型集成到 Codex 就是很大的败笔,没想到这次直接诚意满满!周二能否如期上线,大家拭目以待吧!
显示更多
GPT-5.6 Sol 这次最可惜的一点:
不是不强,而是现在还用不上。
严格说,这更像一张期货票。
OpenAI 已经把牌亮出来了,但因为美国政府还没批准,真正上线还要等未来几周。
不过只看这张牌,Claude 压力确实不小。
Sol 价格和 GPT-5.5 一样:$5 输入,$30 输出。
但它打的已经不是 GPT-5.5,而是 Claude 最高档的 Mythos / Fable。
Claude 那边是 $10 输入,$50 输出。
Sol 便宜一大截,而且 OpenAI 还强调:在部分高难任务里,Sol 用大约 1/3 的输出 tokens 就能打到 Mythos Preview 的水平。
这个点比“跑分更高”重要多了。
因为真实编程里,最怕的不是模型贵,
而是它绕路、废话多、改半天改不到点上。
如果 Sol 真能做到更少 token、更快输出、更强编程,那它对 Claude Code 的威胁会非常直接。
尤其是后面上 Cerebras,最高 750 tokens/s。
这个速度如果给到 Codex,体验可能会很夸张。
我的判断:
GPT-5.5 已经把 Codex 拉进第一梯队。
GPT-5.6 Sol 如果兑现,OpenAI 就不是追 Claude 了,而是开始反压 Claude。
但现在先别吹太满。
它还没真正开放。
目前只是 OpenAI 提前放出来的期货。
真正要看的是几周后上线,Codex 接进去之后,大项目里到底能不能把 Claude Code 的优势打下来。
显示更多
GPT-5.6 马上要来了!前端的JS文件都已经有了
可能真的马上要公布了!
看到这个,我实在绷不住!!
claude-fable-5 神话模型已经全网下架了!
如果你此刻还能用,恭喜你!用到假货了!
claude-fable-5 神话模型已经全网下架了!
如果你此刻还能用,恭喜你!用到假货了!
老叶 AI 中转站 上线 48 小时了。
这 48 小时,真的有点超出预期,也想跟大家汇报一下这两天的成果和作业:
1、过去 48 小时,新注册用户超过 3000 人;
2、累计加满了 7 个微信群,每个群扫码上限 200 人,总人数超过 1500 人;
3、付款用户超过 600 人,48 小时内转化率约 20%;
4、累计处理了 46 万次请求,消耗超过 400 亿 Token;
5、目前服务器负载整体良好,没有出现严重故障。
先说一句真心话:
这两天我基本每天只睡 4 个小时。
很激动,也真的很累。
原本以为自己已经准备得很充分了。
上线前内测了 10 天,模型、号池、支付、客服、服务器、监控,该准备的都尽量准备了。
但真正上线之后,大家的热情还是远远超过了我的预期。
这 48 小时里,我大部分时间都在加号、维护号池稳定性、处理异常、优化体验,也在不断看群里的反馈。
所以有一些朋友的消息,我确实没能第一时间回复。
这里老叶也跟大家真诚说声抱歉。
不是不重视,而是真的忙到有点顾不过来。
最让我哭笑不得的一件事是:
很多粉丝跟我说,关注老叶 4 年了,一直想进老叶的群,但我一直没有收费群。
这次终于充值了 30 块钱,就当跟老叶交个朋友,也终于加上微信群了。
看到这些话,其实挺感动的。
我知道很多人一开始选择
但我更希望,未来真正留下你的,不只是这份信任。
而是稳定的服务、高质量的模型、靠谱的价格,以及遇到问题时有人负责的态度。
这两天被问得最多的问题是:
为什么老叶的中转站价格这么低?
会不会掺水?
会不会不安全?
会不会跑路?
说实话,我完全理解这些担心。
因为这个行业确实有很多乱象。
有掺水的,有乱扣费的,有模型不稳定的,也有做着做着就消失的。
我自己也一直在想:
难道认认真真做一个靠谱的 AI 中转站,真的有这么难吗?
刚好最近 web3 行情也比较冷清,所以我就想认真挑战一下这件事。
真正做下来之后,我也更清楚地感受到:
如果使用正规渠道订阅号池,认真做基础设施、监控、风控、客服和稳定性,这件事并没有很多人想象中那么暴利。
它看起来只是一个 AI 中转站,但背后其实是非常重的基础设施能力。
AI 中转站这个生意,跟 web3 投资相比,可能没有那么性感,也没有那么大的想象空间。
但在我看来,它非常重要。
因为 AI 是未来。
而 Token,是所有 AI 应用绕不过去的基础门槛。
不管未来是 Agent、AI 应用、AI 编程、AI 工作流,还是各种垂直场景,最后都离不开稳定、便宜、可持续的模型调用能力。
我选择做这件事,最初也不是为了追热点。
更重要的原因是:
我希望给自己未来要开发的 AI 应用,先搭一个稳定的基础设施。
顺便也把这套能力开放给信任老叶的朋友们一起用。
这 48 小时,还有一件事让我特别感动。
很多群友看到我忙不过来,会自发帮忙回答新用户的问题。
有人解释怎么充值,有人教怎么接入,有人提醒使用规则,也有人帮忙安抚刚进群的小白用户。
这让我觉得,这不是一个冷冰冰的产品上线。
更像是一群人一起把一件事推起来。
所以,谢谢大家。
谢谢第一批注册、充值、进群、反馈问题、帮忙解答、提出建议的朋友。
也谢谢那些还在观望,但愿意给老叶一点时间的人。
接下来我会继续把几件事做好:
继续扩充和维护号池稳定性;
继续优化模型体验和价格;
继续提高客服和问题响应效率;
继续把规则、文档、教程做得更清楚;
继续让 尽可能稳定、透明、长期地跑下去。
48 小时只是开始。
老叶会继续交作业。
也希望未来大家提到 的时候,不只是说:
“这是老叶做的。”
而是会说:
“这个东西,真的挺靠谱。愿意一直用下去。”
显示更多
我做了一个 AI 中转站,今天正式开放:
一开始做这个站,想法很简单。
主要是我自己平时 Token 消耗量大,身边也有不少朋友一直用不上稳定的 Claude / GPT。不是订阅麻烦,就是各种限制;去找别的中转站,又总担心不靠谱、信息不安全。
所以干脆自己搭了一个。
很多人问:为什么敢用老叶的?
这个问题我也理解。毕竟 AI 中转站这东西,大家最怕的不是贵一点,而是不知道对面是谁。
我在币圈这么多年,别的不敢吹,信用两字一直是招牌。前两年比特币生态火的时候,做过 Ybot 铸造工具。起初也有人担心资产安全。
Ybot 到现在跑了两年多,上万人用过,很多人甚至直接在网站里填过钱包私钥,总资产少说也有几千万。到今天为止,没有出过一次因为网站原因导致的资产事故。
这次做 AI 中转站也是一样,稳定靠谱依然是我们的标签。
目前站里支持 GPT、Claude 等模型,底层用的是官方正规订阅账号池,不是乱七八糟的灰产号。价格这块也尽量压到较低,最低大概 0.7 折。
过去 10 天,我们做了一轮小范围内测:
✅ 200+ 小伙伴参与
✅ 累计消耗超过 420 亿 Token
✅ 整体运行稳定,没出明显故障
内测跑完之后,我觉得可以正式放出来给更多人用了。
需要稳定、便宜、靠谱的 Claude / GPT 中转站的,可以试试:
有问题可以直接私信我,或者进群找我。
老叶不跑路,真出问题我负责。
用完觉得值,帮我转一下。
需要进群的朋友,可以看一下评论区一楼!
显示更多
我做了一个 AI 中转站,今天正式开放:
一开始做这个站,想法很简单。
主要是我自己平时 Token 消耗量大,身边也有不少朋友一直用不上稳定的 Claude / GPT。不是订阅麻烦,就是各种限制;去找别的中转站,又总担心不靠谱、信息不安全。
所以干脆自己搭了一个。
很多人问:为什么敢用老叶的?
这个问题我也理解。毕竟 AI 中转站这东西,大家最怕的不是贵一点,而是不知道对面是谁。
我在币圈这么多年,别的不敢吹,信用两字一直是招牌。前两年比特币生态火的时候,做过 Ybot 铸造工具。起初也有人担心资产安全。
Ybot 到现在跑了两年多,上万人用过,很多人甚至直接在网站里填过钱包私钥,总资产少说也有几千万。到今天为止,没有出过一次因为网站原因导致的资产事故。
这次做 AI 中转站也是一样,稳定靠谱依然是我们的标签。
目前站里支持 GPT、Claude 等模型,底层用的是官方正规订阅账号池,不是乱七八糟的灰产号。价格这块也尽量压到较低,最低大概 0.7 折。
过去 10 天,我们做了一轮小范围内测:
✅ 200+ 小伙伴参与
✅ 累计消耗超过 420 亿 Token
✅ 整体运行稳定,没出明显故障
内测跑完之后,我觉得可以正式放出来给更多人用了。
需要稳定、便宜、靠谱的 Claude / GPT 中转站的,可以试试:
有问题可以直接私信我,或者进群找我。
老叶不跑路,真出问题我负责。
用完觉得值,帮我转一下。
需要进群的朋友,可以看一下评论区一楼!
显示更多