今天用了下 DeepSeek V4.1 Flash ,快是真 TM 的快,一直稳定接近 300tok/s ,但在做复杂任务的时候,是真的蠢啊,尤其是和 Astra 比
我今天主要是拿它们来进行一些老手游的反编译和修改(都是已下线的游戏),这个任务其实很麻烦,会遇到各种各样的难题需要模型去解决,DeepSeek 全程疯狂输出 Token ,然后遇到难题就想方案 -> 改代码 -> 问题还在 -> 换方案,一直在重复这样的循环,就 TM 跟鬼打墙一样,关键是这个逼速度还飞快,所以你就看到它疯狂的吐 Token ,疯狂的换方案,最后狂奔 40 多分钟问题没解决,完事还把之前的一个已经破解的模块改坏了
实在受不了于是换了 Astra High ,Codex 不会展示完整的思维链,tok/s 相比于 DeepSeek 也慢不少,所以对比之下 Astra 就像一个慢吞吞的老头,不紧不慢的,但它是真的稳啊,任何问题遇到后基本两轮之内必能找到正确的方案,然后修复,同样的时间内 DeepSeek 可能已经尝试了 10 个方案了。连续几次都是这样,DeepSeek 疯狂穷举方案反复横跳最后无果,换 Astra 1-2 轮解决
感觉高难任务上国模差距还是非常明显,虽然 Token 速度拉上来了但体验是真的差