今早 kimi 申请退款了。
换了 scnet.cn 的按量调用。
我体验下来,模块级别代码补全、vibe coding 、人类强_监督的编程工作中,Deepseek-V4-Flash 已经很够用了。
突然"涌现"了一个想法,缓存命中是复用,"标准构建块" 复用怎么就不是复用了?
贵价模型,输出_消尓壳_代码,不是"殄暴尤物"了。
今早 kimi 申请退款了。
换了 scnet.cn 的按量调用。
我体验下来,模块级别代码补全、vibe coding 、人类强_监督的编程工作中,Deepseek-V4-Flash 已经很够用了。
突然"涌现"了一个想法,缓存命中是复用,"标准构建块" 复用怎么就不是复用了?
贵价模型,输出_消尓壳_代码,不是"殄暴尤物"了。
1
jhytxy 1 day ago
gemma4 qat 版本已经够用了
两张 2080ti 22g 的事 |
2
zhangli2946 OP @jhytxy 我 4060ti G(8) ~有用~
|
3
coefu 1 day ago
如果厂商为了性能更好,都搞隐式推理,显式的 token 生成就会大大降低量。不过订阅就要从纯 token 模式,换花样了,毕竟在他们模型里多跑几趟,那也是耗算力更多。
只要还用厂商 api ,那么就是砧板上鱼肉。 |
4
foryou2023 1 day ago
看了一下这个这么贵
|
5
foryou2023 1 day ago
@foryou2023 这比官方也贵太多了吧。
DeepSeek-V4-Flash-0731 [暂不支持闲忙时定价] [RPM 预设为 200] 2026 年 7 月 31 日发布的高效轻量化 MoE 模型,总参 284B ,激活 13B ,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG 、批量文案处理等普惠刚需场景。 模型价格 计费项 单价 输入 3 元 /百万 tokens 缓存命中输入 0.3 元 /百万 tokens 输出 9 元 /百万 tokens |
6
YanSeven 1 day ago
跟随市场而动即可,无所谓,大不了不用。
|
7
zhangli2946 OP @foryou2023 啊? 更贵了?
|
8
zimue 1 day ago
我开发一个,可以直接免费使用各平台 AI 的插件,而且解决的就是 TOKEN 太贵的问题,欢迎试试了。这是插件下载地址: https://github.com/07/dda/blob/main/duoda-ai-chrome.zip 。刚更新了官方:www.duodaai.com 。
|
9
msg7086 1 day ago
按量用不起,我还是订阅吧。
|
10
TArysiyehua 21h 47m ago
@zimue 哥们,你这玩意跟太贵没啥关系,说实话多个对比也解决不了问题,如果你能把各大厂商的这些免费额度提取出来给 codex ,cc 用,这才是真的省 token
|
11
wolfie 20h 24m ago
是越来越便宜吧?
|
12
Tiande 20h 10m ago
是越来越便宜吧?
|
13
SilencerL 19h 54m ago
美团客服可以当编码助手用
甚至 https://github.com/kltyton/fanzha-ai-proxy 也可以当编码助手用 |
14
luckyjoe 19h 48m ago
按照智能来约斤算,token 应该是便宜了。
|
16
iBaoger 18h 28m ago
Token 是新时代的流量,你把它当成手机流量看待,心里就平衡了,现在还有各种免费活动,后面很有可能都要付费的
|
17
XnEnokq9vkvVq4 17h 30m ago
越来越贵在哪?
o1 pro 输入输出 $150/$600 GPT-4.5 输入/输出 $75/$150 o1 输入/输出 $15/$60 |
18
CityFork 16h 45m ago
做不了什么,而且悲观地看,未来更聪明的智能,会更贵
现在已经是投资人补贴花钱买用户数据的周期(对于除 ds 外的大部分模型厂商来说),如果未来 infra/硬件没法大规模降价的话,那么现在应该已经是 sota 模型的廉价的巅峰 |
19
chjqpmain 13h 47m ago
我个人的打算是,
用跑通的盈利模型在如今相对划算时,利用大模型不断降本增效,同时扩大规模,积累足够的本金,声望,经验,履历.. 同时不断提升自己的技术,知识,争取未来能基础足够到参与前沿的活动 最好是准备做事,做人两手抓, 每时每刻都在不断博弈,谁掌握权力,谁拥有财富,谁才配拥有尊严, 虽然我也很想有了三就够了,但可能前两个和最后一个本就是一体两面的 |
20
mechunjun 13h 46m ago
并不贵
|
21
maolon 13h 31m ago
并不贵,不如说如果按同智能算还便宜不知多少了,去年的旗舰模型的编程能力今年一个 27b 的模型就能复刻,而 27b 的模型在各大 provider 这里基本都是 free 这一档的
而且尖端智能的价格前面也有人回过了,o1 和 4.5 的价格还摆在那呢 |
22
Hubs 13h 14m ago
试试我的开源项目,每天嫖个 2~3000w token 还是没问题的。
https://github.com/huzhensx/API-N1-Router https://i.imgs.ovh/2026/09/08/31d689bfe0d5d95397afde291c00b983.png |
23
zerovoid 12h 31m ago
没事,至少现在还需要人类来指挥 AI 敲代码,
再过几年不再需要人类指挥 AI 敲代码的时候, 也就无所谓 token 贵不贵了。 |
24
passive 12h 16m ago via Android
生命宝贵,时间宝贵; token 不贵,我喝咖啡时每分钟的消费都比 token 贵。不能把生命浪费在比咖啡还便宜的 token 就能完成的任务上。
|
25
canyue7897 10h 6m ago via iPhone
@passive 问题是咖啡一天就够了。一天的 token 费用一杯咖啡可不够。如果多个任务同时跑,那绝对天价。
|
26
WessonC 9h 51m ago
@canyue7897 那难道不是因为你任务的性价比太低嘛 :)
|
27
dhx920 9h 43m ago
@foryou2023 deepseek 这个价格也太贵了吧,你看看我之前的帖子,参考 deepseek 那个价格
|
28
meteor957 9h 40m ago via Android
什么都不想做,他贵任他贵,不想玩了。
|
29
ayamatsuura 9h 34m ago
哈哈哈,一直白嫖 gemini
|
30
Gomoku2024 9h 29m ago
@ktyang 这个可不是国家队的。。。
|
31
junas7 8h 56m ago
我有一个不消耗 token 的模型调用方式,但是大家都管它叫古法
|
33
dingwen07 8h 22m ago
国模确实越来越贵,性能也……
|
34
zimue 7h 25m ago via iPhone
@jamel 不用 api 的,就登录自己各个 ai 平台就行。我在自己的帖子下,每天有送码的。https://v2ex.com/t/1239749#reply8
|
35
Sezxy 6h 54m ago
把你的工资掏一半出来提效
|
36
ReinXD 6h 52m ago
gpt 其实越来越便宜了,别用国模,性价比被 gpt6 爆杀
|
38
xiaomushen 6h 49m ago
@Sezxy 人家是富哥,用 API 的
|
39
ShawnShi PRO kimi 确实也涨价了 感觉额度变少了
|
40
Dream4U 6h 46m ago
GPT6 虽然价格高点,但能力强太多了,大部分情况下超预期完成。
|
41
jamel 6h 42m ago
|
42
lynn1su 6h 15m ago
阿里 coding plan 200 元,90 万亿 token qwen3.7 plus ,了解下
我这个月用了 56 亿,可恨我没啥任务跑了 |
43
geese1028 6h 12m ago
充值即可。只要你做的东西能创造价值,那么这点 token 钱根本不是问题。
每天重置一下 5x 的 open AI 套餐一个月也不过 1300 美金,如果你真的可以每天烧完一个 5x 的周额度,那么你做的东西肯定远超 1300 美金。 |
45
EastLord 4h 18m ago
我们能忍气吞声
|
46
wobuhuicode 4h 5m ago
明明是越来越便宜。。。
|
47
287854442 3h 53m ago via Android
这个思路很有意思。被标题耽误了,哈哈哈
|
48
unpay 3h 38m ago
贵么。。。有折扣的。。
我们 3 折的合同已经签了 |
49
zhangli2946 OP @xiaomushen 我是冤总,我已经滚回去用 ds 官方的按量计费了。
|