

























10 strawberrydafu 3 月 25 日openai 在 gpt-5.3-codex 发布时就提到,与直觉相反,在 benchmark 中,medium 的表现比 xhigh 的表现要更出色。 其原因可能是 xhigh 容易想多。 我在大多数情况下觉得 medium 就够用,但有的问题你不开 xhigh 就是得不到一个满意的解答。现在 codex 可以单独配置 plan mode 下的 model (包括思考强度),我觉得可以考虑执行默认 medium ,plan 看问题复杂性调整(如果能 adaptive 思考强度可能会更好) |
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。