V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  lynn1su  ›  全部回复第 1 页 / 共 64 页
回复总数  1262
1  2  3  4  5  6  7  8  9  10 ... 64  
@honjow #30 谢谢,已艾特
@Livid 站长,25 楼有人乱打广告
@tylerrrrrr #25 兄弟我记得站长说过不能在非广告节点打广告把?而且还是在人家帖子里,你不怕封号啊?
@S0lution #21 假的吧 glm 5.3 flash 才出 7 天啊
@xxx78797084 #15 GLM 5.5 flash 嘛?
@haizhen3587 #17 950k 上下文我测试过了不报错的
@haizhen3587 #17 不是 500K ,你看我上面发的,850k 都可以,是 1m 上下文的模型
@lchkid #11 不过我不认为 glm 能做到这么高速度
https://i.imgur.com/g1IMdwV.png
@lchkid #11 不知道有没有人做指纹测试
@FawkesV #8 这个不支持多模态哦。。
我发现输入大于 256k 以后,反应速度暴降。。目前发现 900k 的时候只有 1t/s 了,950k 只有 0.5t/s 了。。
852K token 的 prompt 被完整接受,而且首尾两个暗号都答对了——说明不是"只取头部"的截断式处理,是真·全上下文注意力,我觉得
@FawkesV #2 但是不是 2.5 pro ,因为我刚测试了,这个模型支持多模态
@FawkesV #2 确实思考链像小米的
模型思考链像 mimo 的。
目前,我这边测试发现应该是中国模型,模型参数不大,速度又 60t/s
@dilidilid 我只买 256g 存储的版本,然后靠雷电 5 扩容
8 月 31 日
回复了 Need4more 创建的主题 Local LLM mac 本地部署 llm 不是最佳选择
mac 没法做到 1m 上下文把? api 是可以的
6K 没高刷把?没高刷不得难受死
1  2  3  4  5  6  7  8  9  10 ... 64  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Privacy   ·   Solana   ·   1134 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 19ms · UTC 18:14 · PVG 02:14 · LAX 11:14 · JFK 14:14
♥ Do have faith in what you're doing.