如图~
1
xingye163 2 days ago
昨天试了下,同一个模型,中转站的也就勉强过的去,我以为是降智的原因,然后今天冲了 GPT plus 效果就好很多,说明跟降智关系不大,应该是注水了。
|
2
igamebox 2 days ago
PRO 20X 现在风控降智+overloaded 比 PLUS 强多了,
|
3
xiao8276 2 days ago
目前都有降脂问题,可以用经典鹈鹕测试
|
4
yinmin 2 days ago via iPhone
|
5
FrankAdler 2 days ago
我觉得不用判断,100%注水的
|
6
413420 2 days ago
中转站不注水利润上不去
|
7
XEdge 2 days ago
担心掺水可以检测模型指纹: https://xqy2006.github.io/ModelTrace/
智力的话可以测试糖果问题,嫌麻烦可以不跑脚本那就直接问里面的题目就行了: https://raw.githubusercontent.com/haowang02/codex-candy-eval/refs/heads/main/codex_candy_eval.py 被降智的账号: 使用 gpt-5.6-sol(low)回答不出正确答案 21 使用 gpt-5.6-terra(max)回答不出正确答案 21 正常账号以上两档正确率至少在 3/5 以上,即问五次至少对三次。使用 gpt-5.6-sol(medium)及以上档位包括 gpt-6-astra 一定答对。 都是些经验之谈,并不严谨。其实跑个鹈鹕测试之类的就能直观的看出能力上的差别了 |
8
ktyang 2 days ago
默认注水就行了,不要想那么多,不用就是最好的办法。
|
9
EMMMMMMMMM 1 day ago via Android
这还用判断?
|
10
AImoka 1 day ago
别只问「你是谁」。同参数连测几次鹈鹕/糖果题,再对照官方同档;看返回的 model 字段和用量日志是否对得上。指纹工具只能当信号。想先按自己 coding 场景试稳定接入,可加微信 mkapikey 。
|