• 请不要在回答技术问题时复制粘贴 AI 生成的内容
jxl594
V2EX  ›  程序员

最新的 deepseek-v4-flash 正式版真的有这么强吗?

  •  
  •   jxl594 · 6h 19m ago · 4882 views

    deepseek-v4-flash 正式版卡在 7 月最后一天发布,看评测数据很强,受不了智谱这种涨价方式,梁圣才是中国 AI 真正的希望

    55 replies    2026-07-31 21:40:43 +08:00
    xqk111
        1
    xqk111  
       6h 18m ago
    看跑分,超过了 grok4.5 ,感觉很强啊
    xqk111
        2
    xqk111  
       6h 17m ago
    也超过了 glm5.2 ,有点牛
    seakingii
        3
    seakingii  
       6h 15m ago
    希望是真的.DS FLASH 才是真的用的起的模型
    xiaomushen
        4
    xiaomushen  
       6h 14m ago   ❤️ 9
    是很强,但是 V 站上大部分,不都是非 Fable5 或 5.6Sol 不用的高级用户么?
    DS V4 Flash 强不强,和他们似乎关系不大吧
    ghostman
        5
    ghostman  
       6h 12m ago
    刚试用了下非常快
    jxl594
        6
    jxl594  
    OP
       6h 10m ago
    关键是,v4-flash 版本如果能达到 GLM5.2 的水平,那真是太便宜了,GLM5.2 和 KIMI3 可以暂时拜拜了
    jokcylou
        7
    jokcylou  
       6h 6m ago via Android
    glm 股价 200 可期
    TomatoCLI
        8
    TomatoCLI  
       6h 5m ago
    @jxl594 不仅便宜,而且还快
    jxl594
        9
    jxl594  
    OP
       6h 2m ago
    @TomatoCLI 对的,不过便宜比快更重要,后面看看小米 MIMO 能不能追上来。
    真是又期待,又害怕。能力强又便宜,那就能用得起了,但是,另一方面,程序员的含金量 K 线,感觉还在下降通道中。
    soulflysimple123
        10
    soulflysimple123  
       5h 59m ago
    deepseek v4 pro 如果有 gpt 5.5 的水平,友商就难了
    yiranw09
        11
    yiranw09  
       5h 59m ago
    刚才试了一下,感觉超过了之前的 dsv4pro ,关键似乎还降级了
    xiaomushen
        12
    xiaomushen  
       5h 59m ago
    503 了,
    vitozyl
        13
    vitozyl  
       5h 57m ago
    能用+够用才是正途. 智谱被称为中国的 Anthropic, 但也不能照搬全学呀
    Faintlike
        14
    Faintlike  
       5h 51m ago   ❤️ 1
    280b 秒了 740b ,肥鲸,现在的你,强的可怕...
    penll
        15
    penll  
       5h 49m ago
    非常牛逼,超过 GLM5.2
    cjhyy
        16
    cjhyy  
       5h 48m ago
    虽然 cc 和 codex 拉满了 但是自己总要搞点活啊 目前的感觉来看。模型的快速跃升期要到瓶颈了 60 分与 80 的差别可能不会那么大了 速度和成本应该下一个方向。之前自己充了 300 块 deepseek 用 pro 太慢了。flash 反而用的还顺手一点 做一些简单的活又便宜又快
    NealLason
        17
    NealLason  
       5h 45m ago
    体验下来很超预期
    jxl594
        18
    jxl594  
    OP
       5h 44m ago
    @cjhyy 确实,真正使用的时候,速度很重要,Qwen3.8-Max-Preview 运行一半就卡死在那里,GLM5.2 之前也慢的要死,正常工作几乎不可用。
    niceshell
        19
    niceshell  
       5h 42m ago
    @xiaomushen 不是这么说 真的用起来的时候 选最好的能节省时间
    jxl594
        20
    jxl594  
    OP
       5h 41m ago
    要是梁圣再开源一个好用的 harness 项目,那真是功德圆满了
    hanbaoji
        21
    hanbaoji  
       5h 39m ago
    真的假的?价格有变化吗?
    StudyFung
        22
    StudyFung  
       5h 39m ago
    试试就知道了
    FredWang
        23
    FredWang  
       5h 33m ago
    @jxl594 不是说即将发布么? deepseek harness
    utodea
        24
    utodea  
       5h 33m ago
    体验下来增强了不少,https://github.com/usewhale/whale
    xiaomushen
        25
    xiaomushen  
       5h 30m ago
    @niceshell 程序员的时间值钱么?
    menfrexu
        26
    menfrexu  
       5h 22m ago
    已经将 flash 作为主力模型了。牛逼 https://github.com/Menfre01/waveloom
    Dream4U
        27
    Dream4U  
       5h 14m ago   ❤️ 1
    @xiaomushen #4 主要是 20X Codex 用不完,天天重置,三个人分摊,一个人两三百,真是最便宜的套餐了。
    DS 看 API 价格是便宜,但如果用 Pro ,一天几十上百很正常。
    WashFreshFresh
        28
    WashFreshFresh  
       5h 8m ago
    不知道公司买的聚合服务什么时候更新
    jxl594
        29
    jxl594  
    OP
       5h 6m ago
    @WashFreshFresh 不知道 opencode go 上的 v4-flash 是不是官网直连的,那就更划算了
    stdout
        30
    stdout  
       5h 4m ago
    1kw token 不到 5 毛,用的越久 cache 命中越高,跟不要钱似的。
    jxl594
        31
    jxl594  
    OP
       5h 1m ago
    @stdout 目前跑了 3.4kw token ,价格 1.5 ¥,去 TM 的 coding planning ,用多少花多少才是真香
    yiranw09
        32
    yiranw09  
       4h 55m ago
    opencode go 可以用正式版本了
    但是需要在后台开启“启用部署在中国的模型”
    stdout
        33
    stdout  
       4h 54m ago
    @jxl594 国内唯一个能用的很爽的,能和 grok4.5 流畅,解决大部分问题不用反复问,我就非常满足了。deepseek falsh 已经满足我的需求了。我下个月把 grok 切换过来。
    xiaomushen
        34
    xiaomushen  
       4h 52m ago
    @Dream4U 这倒是..个人订阅根本用不完,奥圣动不动就重置。。
    listen2wind
        35
    listen2wind  
       4h 52m ago
    昨天站里还是梁÷,今天就成梁圣了
    stdout
        36
    stdout  
       4h 51m ago   ❤️ 6
    我做空了 minimax 和智谱,赚多少就充多少给 deepseek
    526457385
        37
    526457385  
       4h 50m ago
    我问一下各位啊,哪个模型出来跑分不是吊打其他所有模型,你们看看你们现在正在用的什么模型
    snowman231
        38
    snowman231  
       4h 44m ago
    特别,特别,特别的快。写起代码来很舒服。
    Aaron0705
        39
    Aaron0705  
       4h 42m ago
    试过了,很强,长任务方面比之前强了很多
    damila
        40
    damila  
       4h 40m ago
    我基本不看跑分,但是刚才体验了一下,效果远超个人预期,而且很快,这波是梁圣
    EngelEyes
        41
    EngelEyes  
       4h 34m ago
    反正比隔壁"性价比首选""对标美系旗舰"强。
    congminhcap246
        42
    congminhcap246  
       4h 29m ago   ❤️ 2
    刚好 deepseek 更新了,对比下同个 prompt 各个模型生成的效果。

    你是一个精通计算机图形学和前端性能优化的专家。请编写一个单文件( HTML + CSS + JavaScript ),实现一个惊艳的“3D 粒子动态涡流( Vortex )”视觉特效,支持移动端,支持动画暂停和重置另外带上我的署名。

    严格限制条件:
    1. 不允许使用任何第三方库(如 Three.js, Pixi.js, Canvas-nest 等),只能使用原生 HTML5 Canvas 2D Context 。
    2. 粒子必须在真正的 3D 空间内运动(拥有 X, Y, Z 坐标),并通过数学公式(透视投影 Perspective Projection )实时计算并映射到 2D 屏幕上,表现出近大远小的透视效果。
    3. 必须实现 3D 旋转矩阵,让粒子流能够随着鼠标的移动,围绕 X 轴和 Y 轴进行平滑的 3D 视角旋转。
    4. 必须处理深度排序( Depth Sorting/Z-indexing ):计算粒子的 Z 轴距离,远处的粒子先绘制,近处的粒子后绘制,并配合不同的透明度和模糊度,制造真实的纵深感。
    5. 包含色彩渐变或极光效果,粒子数量不低于 2000 个,必须使用 requestAnimationFrame 保证 60fps 的流畅度,代码要优雅、模块化,并写清核心数学公式的注释。

    https://llm.sweetui.com/opus5.html
    https://llm.sweetui.com/kimi3.html
    https://llm.sweetui.com/gpt5.6.html
    https://llm.sweetui.com/grok4.5.html
    https://llm.sweetui.com/deepseek.html
    maoqiucute
        43
    maoqiucute  
       4h 29m ago
    试了一下 确实又快又强
    jko123
        44
    jko123  
       4h 27m ago
    不知道 DeepSeek v4 pro 正式版能不能达到 GPT5.6 SOL 水平,能达到那就棒了
    albin504
        45
    albin504  
       4h 25m ago
    @congminhcap246 不懂题目是啥意思。但是看效果,deepseek 生成的更科幻、也更美观。
    gpt 和 kimi 生成的是啥玩意儿,至少有点糊
    albin504
        46
    albin504  
       4h 24m ago
    利好腾讯啊。 腾讯的 AI 产品能用好低价、开源的模型,真是福音
    jxl594
        47
    jxl594  
    OP
       4h 20m ago
    @congminhcap246 相对而言,还是 deepseek 效果差一点,不过总体要求基本都达到了吧
    BuffDog
        48
    BuffDog  
       4h 18m ago
    我试了下相当不错,比 v4 pro 预览版强不少
    kera0a
        49
    kera0a  
       4h 6m ago via iPhone
    flash 都这忘了,pro 不得起飞咯
    mgcnrx11
        50
    mgcnrx11  
       4h 1m ago
    它自己公布的跑分下,有行小字:对于公开基准测试集中的 Code Agent 任务,正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness (即将发布)的极简模式作为框架进行测试,并使用 max 档位,topp=0.95 ,temperature=1.0;

    不能看跑分就认为是模型进步了的,harness 对跑分的影响也非常大的
    min
        51
    min  
       3h 56m ago
    那 pro 出来了的话还得了?
    catazshadow
        52
    catazshadow  
       3h 30m ago
    @albin504 deepseek 连右上角的 fps 都是瞎写的
    pinylin
        53
    pinylin  
       52 mins ago   ❤️ 2
    我觉得智商不行, 非常简单的任务都错了。5.6 Luna-max 和 qwen3.7-max 都正常
    lovecodey
        54
    lovecodey  
       27 mins ago
    @congminhcap246 k3 不应该是这个实力,我用第三方部署试的
    https://cuddly-chocolate-0yslyari.edgeone.dev/
    ZeroDu
        55
    ZeroDu  
       4 mins ago
    deepseek ,glm 现在就差多模态。glm 这一涨价都赶上 gpt 了
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2767 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 90ms · UTC 13:44 · PVG 21:44 · LAX 06:44 · JFK 09:44
    ♥ Do have faith in what you're doing.