最近自己做了一个国产大模型 API 服务:Kin ,想找一些真正有 AI Coding / Agent 调用需求的开发者一起用。
我自己平时会大量使用 Codex 、OpenCode 这类 Coding Agent ,一个非常明显的感受是:
Coding 场景真正烧起来以后,Token 成本非常高。
而且除了模型能力之外,实际体验还很受几个东西影响:
API 价格
缓存价格
首字延迟
请求成功率
上游稳定性
所以我做 Kin 的思路并不是简单“再搭一个 API 中转站”,而是想把重点放在:
国产 Coding 模型 + 低成本调用 + 稳定性监控。
目前主要在接入和测试 GLM 、Qwen 、DeepSeek 等模型,并兼容常见 API 协议,方便接入 Codex 、OpenCode 以及各种 Agent 。
接下来我准备长期做一个 Kin Coding Model Benchmark ,持续公开不同模型的:
成功率 / TTFT / 响应速度 / Coding 任务表现 / 实际 Token 成本。
例如同样跑一个 Coding Agent:
GLM 花多少钱?
Qwen 花多少钱?
缓存命中以后实际成本能降到多少?
哪个模型速度最快?
哪个模型连续跑几个小时最稳定?
这些数据我都会逐渐整理出来。
### 关于价格
Kin 目前的思路很简单:
不靠注册送额度拉注册量,直接把价格尽量做低。
所以目前没有“注册即送几十块额度”之类的活动。
如果只是想体验一下大模型,可能很多免费平台更合适。
如果你本身就在使用 Codex 、OpenCode 、Claude Code 、Agent ,或者自己的项目每天都有比较稳定的 API 调用量,那么会更适合 Kin 。
我更希望找到的是这种真正长期使用 API 的用户,因为他们对:
价格、稳定性、429 、缓存、模型质量
这些问题的反馈,对我现阶段优化 Kin 更有价值。
产品现在还比较早期,如果遇到:
兼容性问题、异常扣费、模型不稳定、请求失败或者有希望接入的模型,都可以直接告诉我,我会优先处理。
Kin 官网: https://kinneng.com/
[你的链接]
也很好奇大家现在 AI Coding 主要在用什么模型?
以及真正大量使用以后,你们目前最在意的是:
模型能力 / Token 价格 / 速度 / 稳定性?
我自己平时会大量使用 Codex 、OpenCode 这类 Coding Agent ,一个非常明显的感受是:
Coding 场景真正烧起来以后,Token 成本非常高。
而且除了模型能力之外,实际体验还很受几个东西影响:
API 价格
缓存价格
首字延迟
请求成功率
上游稳定性
所以我做 Kin 的思路并不是简单“再搭一个 API 中转站”,而是想把重点放在:
国产 Coding 模型 + 低成本调用 + 稳定性监控。
目前主要在接入和测试 GLM 、Qwen 、DeepSeek 等模型,并兼容常见 API 协议,方便接入 Codex 、OpenCode 以及各种 Agent 。
接下来我准备长期做一个 Kin Coding Model Benchmark ,持续公开不同模型的:
成功率 / TTFT / 响应速度 / Coding 任务表现 / 实际 Token 成本。
例如同样跑一个 Coding Agent:
GLM 花多少钱?
Qwen 花多少钱?
缓存命中以后实际成本能降到多少?
哪个模型速度最快?
哪个模型连续跑几个小时最稳定?
这些数据我都会逐渐整理出来。
### 关于价格
Kin 目前的思路很简单:
不靠注册送额度拉注册量,直接把价格尽量做低。
所以目前没有“注册即送几十块额度”之类的活动。
如果只是想体验一下大模型,可能很多免费平台更合适。
如果你本身就在使用 Codex 、OpenCode 、Claude Code 、Agent ,或者自己的项目每天都有比较稳定的 API 调用量,那么会更适合 Kin 。
我更希望找到的是这种真正长期使用 API 的用户,因为他们对:
价格、稳定性、429 、缓存、模型质量
这些问题的反馈,对我现阶段优化 Kin 更有价值。
产品现在还比较早期,如果遇到:
兼容性问题、异常扣费、模型不稳定、请求失败或者有希望接入的模型,都可以直接告诉我,我会优先处理。
Kin 官网: https://kinneng.com/
[你的链接]
也很好奇大家现在 AI Coding 主要在用什么模型?
以及真正大量使用以后,你们目前最在意的是:
模型能力 / Token 价格 / 速度 / 稳定性?