最近 Kimi 、GLM 、DeepSeek 我都用了一些,我现在有个感觉,就是国产 AI 编程能力其实真没以前差那么远了。
尤其 Kimi 和 GLM ,我自己体感大概已经能有 GPT 七八成吧。肯定还是 GPT 强,但是已经不是那种完全没法比的感觉了。有时候我 GPT 写完东西,再扔给 Kimi 或者 GLM review 一遍,它还真能给你找出来一点 GPT 漏掉的东西。
所以我现在觉得拿国产模型做第二遍检查其实挺合适的。
但是有一点我真的受不了,就是太慢了。
同样一个东西,我用 GPT ,高思考模式可能三十秒就搞完了。换 Kimi 、GLM ,六七分钟都有可能。GLM 尤其慢,我感觉比 Kimi 还慢。有时候我都忘了刚才让它干嘛了,它还没跑完。
DeepSeek 也是这个问题。
然后价格这个东西我现在也有点怀疑。大家都说国产便宜,按百万 Token 算确实便宜,但是问题是同样干一件事,它消耗的 Token 好像也比 GPT 多不少。
GPT 可能很快就把问题解决了,国产在那想半天,跑一大堆 Token 。最后真按一个任务算下来,我感觉 GPT 好像也没贵,甚至可能还更便宜。
所以单看每百万 Token 多少钱,我现在觉得没啥意义。应该看同一件事最后到底花多少钱,还有花多长时间。
我目前用下来的感觉就是 GPT 综合性价比还是最高。贵是看着贵,但是快,而且大部分时候一次就能把事干明白。
国产里面我现在更喜欢 Kimi 一点,综合比较均衡。真要必须国产,比如数据比较敏感,那我估计还是会选 Kimi 。
GLM 我感觉能力其实挺好的,尤其拿来 review ,但就是慢,真的慢。
DeepSeek 现在我反而有点不知道用它干嘛了。以前便宜是个很大的优势,现在感觉也没有以前那么便宜,再加上还是慢,我自己用得越来越少。
不知道你们有没有这种感觉?尤其是平时真拿这些东西写代码、跑 Agent 的。
我挺想看看有没有人实际算过,同一个任务 GPT 、Kimi 、GLM 、DeepSeek 各跑一次,最后分别用了多少 Token 、多少钱、多少时间。我怀疑最后算总账,GPT 可能反而是最便宜的那个。
