Usrename
V2EX  ›  OpenAI

GPT5.4 的里面的 Extra High,和 Medium,有多大的推理准确度的差异, token 消耗量有多大的差异?

By Usrename at 3 月 24 日 · 3433 次点击

同样的问题,Medium 是不是已经足够应付多数情况了?

烧 token 的速度,同样的问题下,有多大差异?

大家都是开着 Extra High 来做 coding 的吗?

12 条回复  •  2026-03-25 21:16:51 +08:00
niubilewodev
   1
niubilewodev  
   3 月 24 日
我使用 high+fast 模式。
Extra High 太慢了。只有真的遇到问题了,采用 Extra High 。
GlobalNPC
   2
GlobalNPC  
   3 月 24 日
1 个问题 消耗了周额度的 5%
Mageblade
   3
Mageblade  
   3 月 24 日
开了 windsurf max 套餐,我现在反正无脑用 gpt 5.4 xhight ,偶尔用 claude opus 4.6 ,token 基本用不完
FH0
   4
FH0  
   3 月 24 日
对于我来说,20 美元的套餐是远远不够的,又没有 100 美元的套餐。所以我是 gpt-5.4-xhigh fast 双开的情况下用 codex 。
Saunak
   5
Saunak  
   3 月 24 日
@niubilewodev #1 pro 吗? plus 这样感觉不够吧
14
   6
14  
   3 月 24 日
xhigh 太慢了,我最近切回到 high 了,感觉大部分问题差别不大,反而迭代速度快了能提升整体效率
vsomeone
   7
vsomeone  
   3 月 24 日
我用 xhigh fast 没感觉很慢
niubilewodev
   8
niubilewodev  
   3 月 25 日
@Saunak 一个肯定不够。
原来是 7 个 team/plus 号。
现在换成注册机了。
iorilu
   9
iorilu  
   3 月 25 日
@niubilewodev 有没有注册机分享下
strawberrydafu
   10
strawberrydafu  
   3 月 25 日
openai 在 gpt-5.3-codex 发布时就提到,与直觉相反,在 benchmark 中,medium 的表现比 xhigh 的表现要更出色。

其原因可能是 xhigh 容易想多。

我在大多数情况下觉得 medium 就够用,但有的问题你不开 xhigh 就是得不到一个满意的解答。现在 codex 可以单独配置 plan mode 下的 model (包括思考强度),我觉得可以考虑执行默认 medium ,plan 看问题复杂性调整(如果能 adaptive 思考强度可能会更好)
fly2never
   11
fly2never  
   3 月 25 日
@Mageblade 已经开始限制了
Saunak
   12
Saunak  
   3 月 25 日
@strawberrydafu #10 plan 了之后,执行阶段模型会再补充思考吗?还是只进行编码?
© 2026 V2EX · 60ms · 3.9.8.5