这几天,大家应该都用GPT-6 Astra了吧。
然后呢,我发现大家问我的问题,已经开始随着时间发生变化了。
第一天:“GPT-6 Astra上线了,你咋还没发,别睡了,起来评测搞快点。”
第二天:“GPT-6咋操控Blender啊?”
第三天:“不是,哥,我额度呢???咋就没了???”
真的。
这两天全网关于GPT-6讨论最热烈的话题之一,已经迅速从模型能力变成了:
不是,这玩意怎么这么烧额度啊???
这个推理等级,到底要怎么设置啊???
群里也都是在说的。


其实很多用户其实看到各种各样的推理等级,是真的有点懵逼的。
比如从低到中到高到极高到最高。

还有这个看着就非常富贵紫光闪闪的Ultra。

很多人就很懵逼。
这到底有啥区别?我日常用哪个最好?这些档位我要咋选?什么场景要用哪个?什么时候我开最高?什么时候该Ultra?
等等等等。
所以呢,我觉得还是可以写一篇文章给大家聊聊这个话题。
因为这涉及到大家买订阅会员的决策,以及究竟如何去使用GPT-6 Astra那个眼花缭乱的推理等级。
我自己这几天因为是各种测试+各种做演示case,还要兼着去做AIHOT的底层代码和数据库的全面重构等等,所以是蹬完了2个号的200刀的会员,今天重置完也用的只剩6%了。。。

然后大号莫名其妙还被OpenAI风控了,一直显示“模型额度已满”,导致我还阵亡了一个号,以至于我疯狂骂街。。。

不过整体上,我觉得还是有一些体感可以分享一下的。
首先,我觉得还是可以非常简单的说一下,这个所谓的努力等级,到底是啥意思。
这玩意,我们一般称为Reasoning Effort。
也就是推理强度等级,不过我自己一般更喜欢把它称为一个模型的努力程度等级。
你可以简单理解成:
你愿意给GPT-6 Astra多少时间,让它在交答案以前,再想想、再查查资料、再试一试、再多验证几轮。
模型你还是同一个GPT-6 Astra。
就像一道小学数学题,你让数学博士想1分钟,肯定是绝逼够了。但是你非说不行,你再想一个小时。
那最后答案也不会从42变成43。
所以,开到Max以后,他也不会突然就直接打通任督二脉解放双手直接原地斗气化马恐怖如斯。
真正变化的一点就是,这个模型到底它愿不愿意再多花点时间和力气再多想一想。
比如你把努力级别调到“低”,那模型可能觉得:“哦,这个问题我大概知道,这不就是XXX吗,直接干就行了。”
那如果是“高”,可能会想:“等等,这里是不是有一个边界条件?我再看两个文件,再跑一下测试,我再想想。”
那“最高”就可能在“高”的基础上继续:“这个假设真的成立吗?不行我再检查一下,还有没有另外一种架构?这个地方改了那个地方以后会不会炸啊?不行再验证一下。”
这大概就是模型在这几个努力等级上的心路历程。
所以推理强度越往上,通常也就伴随着:思考更多、验证更多、工具调用更多等等,相对应的,也就是额度消耗更多。
然后很多人有一个特别大的误区。
觉得这个努力等级是中等模型、高级模型、超级模型之类的区别。
但其实完全不是的。
我们再举一个非常详细的例子,可以把它想成同一个特别聪明的人。
“中”努力程度:“这个问题你看一下。”
“高”努力程度:“这个挺重要的,你认真搞一下。”
“最高”努力程度:“哥,这事真的会要我亲命的会死人的,你今晚别回家了,必须给我想明白把它搞定了,求求你了。”
人还是同一个人,只是你给他的思考预算不一样。
然后还有一个大家特别容易搞混的模型,Ultra。
Ultra跟前面几个档位,其实完全不是一个概念。
“最高”主要体现在,把一个Astra自己的努力程度开到最大,用十二分的努力去对待你这个任务。
大概就是把公司里最牛逼的那个人关会议室里,给我想,想不明白别出来。
但是呢,Ultra是这个最牛逼的人进会议室以后。
一看问题。
妈的,这问题好像有点大。
然后自己就跑出去喊:
“坤坤,你查数据库。”
“那个鹏鹏,你看前端。”
“老王啊,你去扫一下测试。”
然后拉着大家一起干,最后它再回来汇总。
所以很多人以为自己按Ultra,是以为这个玩意更聪明。
但其实你按下去的可能是:
“给我成立一个专项工作组。”
那能不贵吗,你要同时开好几倍的薪资呢。。。
所以啊,我一直说,大家千万不要迷信这个推理程度越高越好。
你看Tibo都说,GPT-6 Astra“低”的能力,已经可以超过过去GPT-5.6 Sol的“高”。

所以这里有一个特别重要的原则。
推理等级应该跟任务类型和难度匹配。
这块肯定得分Plus和Pro用户来说,因为这个区别还是有的。
先说Plus。
Plus最大的问题就是额度真不多,经不起折腾。
所以千万别用Codex来帮你去做一些聊天、搜索、分析之类的这些任务,你完全可以使用ChatGPT的聊天模式,因为ChatGPT的聊天模式跟Codex的额度是完全分开的,聊天你可以几乎随便用,且不占用你的Codex额度。
推荐你用网页版的ChatGPT聊天,这样分的清楚一点。

然后在Codex里,你是日常使用,我个人现在最推荐你的日常档位就是:
中。

对于一些你觉得稍微难一点的,觉得可能“中”也可能实在不保险的,可以开到“高”,但是就别在再往上开了,这个额度消耗是真的吃不消的。
然后就是核心的100刀和200刀的Pro用户。
100刀的额度是Plus的5倍,200刀的额度是Plus的20倍,我自己就是200刀的Pro会员,从额度单价上来说,肯定还是200刀的最划算,但是总价也会更高,这个就看大家各自的选择了。
在这个阶段里面,我自己日常一般是用“高”比较多,基本上就是“高”常驻。
坦率的讲,你说有没有一点心理作用?那肯定是有的。
毕竟我200美刀都花了。
你让我天天用“中”等级。
多少有一点买了个5090然后天天用它扫雷的感觉,就总感觉不得劲。
但抛开心理作用,我自己日常大量的工作,也确实都是Vibe Coding为主。
所以“高”对我来说是一个非常舒服的平衡点。
所以我自己一般只用两个档,一个“高”,一个是“最高”。
我的工作习惯是,一般简单的BUG啥的,就直接让“高”上了,但是稍微大型或者复杂一点的,我会选择先开“最高”+计划模式,让他全面审查和调研之后,给我列一个计划。

在计划出来之后,再把努力等级调成“高”,然后去执行计划。
我觉得这是我目前用下来最舒服、最省Token的一种方式。
因为在做规划和在做方案上,我们还是希望他能多思考,给他更多的时间、更多的空间去思考,在全面思考以后,把这个方案列出来以后,其实就是纯粹的执行了。那这个时候,低一点的努力等级其实也没有关系。
而“极高”这个档位对我来说就没啥意义了,我是几乎完全不用的。

因为我觉得它的定位对我来说实在是有点尴尬。
就比如一个任务如果只是普通任务,那肯定“高”就够了。
但一个任务如果已经难到你自己心里都觉得:“这确实是有点复杂的,我觉得有点难。”
那我肯定直接“最高”就上了啊。
很多时候,最省额度的方法,恰恰是一轮直接解决,你万一开着“极高”,出了问题,来来回回的调试和对话,那比开着“最高”一轮跑完,最后烧的Token可能还要更多。
至于Ultra,Emmmm,我只能说,我日常的任务,基本不太配用这玩意。
我日常只有一种情况会使用它。
那就是我知道Tibo要重置了,但是我还有一堆的额度没用完,那还说个屁,直接GPT-6 Astra + Ultra + Fast直接拉满,干他一炮。
大概就是这样。
这也差不多是我现在用GPT-6 Astra最舒服的一套逻辑。
当然,我也想说,如果你的经济条件允许,我还是比较建议你去尝试一下200刀的Pro会员。
虽然确实看着要一个月1400,但我想说,这依然可能是大家最有性价比且最值得的一笔投资。
很多时候。
比Token更贵的,是一个错误的方向,和你被浪费掉的时间。
希望大家玩得愉快~
文章来自于"数字生命卡兹克",作者 "卡兹克"。