sentinelKV2EX member #631792, joined on 2023-05-30 20:41:02 +08:00Today's activity rank 748 |
| mac m5 ultra 上线中国官网。1.2T 显存带宽, 256GB 版本 8.6 万 Local LLM • sentinelK • Aug 28 • Lastly replied by sadan9 | 51 |
| RTX PRO 5000(或其他 48GB 显存)的 Qwen3.8-27B-FP8 配置交流(prefill 5000+t/s, decode 60+t/s)
1 Local LLM • sentinelK • Aug 26 • Lastly replied by tgfbeta
|
55 |
| OpenCode go 订阅开始区分模型提供额度, kimi-k3、deepseek-v4-pro 等只有 15$的额度,请各位注意用量。 程序员 • sentinelK • Jul 20 • Lastly replied by shuck | 49 |
| lama.cpp 目前有重大性能 bug: checkpoint 的巡回逻辑对于混合模型(比如 qwen3.6-27B)无效,从而导致大概率每次对话都要 prefill 全文,严重拖慢速度 Local LLM • sentinelK • Aug 3 • Lastly replied by tgfbeta | 16 |
| 阿里百炼的自建 DeepSeek 限速是 TPM 1.2M,这限速是拍脑袋的吗? 程序员 • sentinelK • May 28 • Lastly replied by sentinelK | 2 |
| Copilot pro 移除了 claude opus 模型的使用权限
3 GitHub Copilot • sentinelK • Apr 28 • Lastly replied by Nielsen
|
108 |
| LLM 时代的最大桎梏:概率与模糊,导致 AI 工具就像是中医圈子 程序员 • sentinelK • Apr 3 • Lastly replied by coefu | 13 |
8h 34m ago Replied to a topic by Jas0nG › 职场话题 › 多年经验总结,经常发送消息有错字的人工作能力都不佳,这是为啥? |
8h 52m ago Replied to a topic by Jas0nG › 职场话题 › 多年经验总结,经常发送消息有错字的人工作能力都不佳,这是为啥? |
13h 33m ago Replied to a topic by yodi › 程序员 › 如何让多不同模型在同一个 session 中与自己一起讨论问题? |
13h 39m ago Replied to a topic by voidGhost › OpenAI › OpenAI 发布 GPT-6 Astra 并宣告「欢迎来到 AGI 时代」,评测全面登顶 |
13h 52m ago Replied to a topic by AkinoKaedeChan › iDev › BYOK 的 AI 应用如何合规中国区 App Store |
13h 53m ago Replied to a topic by AkinoKaedeChan › iDev › BYOK 的 AI 应用如何合规中国区 App Store |
14h 16m ago Replied to a topic by ldm0 › Local LLM › 2 台 DGX Spark 上运行的本地 LLM 横向对比 |
1 day ago Replied to a topic by justwe7 › 程序员 › 感觉现在关于 github copilot 的讨论少了,还有人在主力使用的吗?想听听实际体验 |
1 day ago Replied to a topic by siriusliangcn › OpenAI › 据说 GPT6 的技术路线,可以压榨出十几倍的参数效果 |
1 day ago Replied to a topic by zencitta › 程序员 › 对大厂来说, Vibe Coding 是不是伪需求? |