• 请不要在回答技术问题时复制粘贴 AI 生成的内容
wKong753900
V2EX  ›  程序员

有没有大佬测评一下 Qwen3.8

  •  
  •   wKong753900 ·
    Kun-GitHub · 1 day ago · 7595 views

    如题,跟 K3 对比怎么样

    57 replies    2026-07-21 22:42:05 +08:00
    v2mo
        1
    v2mo  
       1 day ago   ❤️ 3
    每次发布,都说世界前列。

    实际一用,就崩塌。

    大家可能都免疫了。
    v2mo
        2
    v2mo  
       1 day ago
    @v2mo 我指的是 qwen 每次新版发布哈
    my101du
        3
    my101du  
       1 day ago
    自从领了两杯送的奶茶后就卸载了。 回答其实中规中矩,比元宝还准确及时一些。 但是总觉得哪里用起来怪怪的。 另外就是 B 站都放了大量千问的广告,非常 low ,令人怀疑它到底想干什么。
    keshawnvan
        4
    keshawnvan  
       1 day ago
    @my101du 千问 C 端太迷了,既不舍得给好模型,又不好好打磨产品,那花钱推广干嘛呢?
    027creed
        5
    027creed  
       1 day ago
    @keshawnvan 都想摘果子,但是没有人种树,kip 的导致一切只看结果,派系斗争严重,所以阿里现在越来越拉
    catazshadow
        6
    catazshadow  
       1 day ago via Android
    时间久了,之前只配呆在中下层的人被公平性要求安到了决策层,所以所有的大型组织最后都会灭亡
    QlanQ
        7
    QlanQ  
       1 day ago
    就 qwen 这样的,明明就是一般,为啥还这么贵,就不理解
    shawnvan
        8
    shawnvan  
       1 day ago
    qwen 主要还是做 2b 市场吧
    Daitabashi
        9
    Daitabashi  
       1 day ago
    基座模型吧 似乎没(怎么)做后训练
    wKong753900
        10
    wKong753900  
    OP
       1 day ago
    哈哈,本来还想试用一下的,现在看还是先观望吧
    renzhe8102
        11
    renzhe8102  
       1 day ago
    說實話, 比上週某個新模型還是強的,但是感覺都是刷分
    ufan0
        12
    ufan0  
       1 day ago
    好奇有在商业订阅百炼的吗?垃圾到开个帖都吐槽不完。
    CloudnuY
        13
    CloudnuY  
       1 day ago
    用 chat 试了一下,单页面 HTML 效果挺不错的
    https://chat.qwen.ai/s/t_7137c533-5109-4c1f-a67a-435e48a6bd04?fev=0.2.74
    techmale
        14
    techmale  
       1 day ago
    中大型项目配合高质的 AGENTS.md 、tests 、SOP 等情况下。Codex 是最最最最靠谱的。没有之一。
    Yesr00
        15
    Yesr00  
       1 day ago
    我用 QWEN 感觉就是在被它薅。。。它家自带的 IDE...动不动就死循环。。。疯狂吃钱。。。我都想报警了。。。
    zhonghao01
        16
    zhonghao01  
       1 day ago
    qwen 每次新模型都吹得天花乱坠,多牛逼多牛逼,但是实际一用,太垃圾了,完全配不上价格。

    qwen 的新模型高产似母猪
    cb74883
        17
    cb74883  
       1 day ago   ❤️ 1
    他自己 Qoder 里面的定价是 0.5 ,GLM5.2 定价是 0.6 ,Kimi-K3 是 0.8 ,可以参考一下。
    kevan
        18
    kevan  
       1 day ago
    每次发布,都说世界前列。
    karld
        19
    karld  
       1 day ago
    垃圾
    unregister
        20
    unregister  
       1 day ago
    V 站没有一个人客观的,都是一句话的,别来这问了
    unregister
        21
    unregister  
       1 day ago   ❤️ 1
    X 上点赞的很多,到这里就是垃圾的不行。
    keshawnvan
        22
    keshawnvan  
       1 day ago   ❤️ 1
    体验了一下:
    1.速度很快,快的不像 2.4T 的模型,可能激活参数不高。
    2.在 Qoder 里一折,导致负载很高,可用性很差。
    3.后训练做的确实一般,查看 AGENTS.md 和知识库不积极。
    levn
        23
    levn  
       1 day ago
    测试了一个问题,用本地的 397b q2 来检查,发现一处错误。
    xiaokaitongxue
        24
    xiaokaitongxue  
       1 day ago
    只能说 现在打折 薅羊毛用用还行。
    Seanfuck
        25
    Seanfuck  
       1 day ago
    @CloudnuY 这个挺不错了。
    不管有没有吹,qwen 在国内总体算是第一的。
    xiaomushen
        26
    xiaomushen  
       1 day ago   ❤️ 1
    V 站上都是用 Fable5 和 GPT5.6 ,一般看不上这些国模,更别说用了
    lostwolfkf
        27
    lostwolfkf  
       1 day ago
    这是 qoder 里的倍率,我不信他又便宜又好
    ifoto
        28
    ifoto  
       1 day ago
    用的 3.7 写的确实一般。错误也多
    lscho
        29
    lscho  
       1 day ago via Android
    qwen3.8 拉中拉。。。写个样式都写不好,两个按钮大小不一致,让他改成一致的。因为 css 类名用了 Tailwind 的风格,他直接判定项目装了 Tailwind ,连 package.json 都不看就说改好了。。。然后故意没说原因,说没生效,提示两次还没处理好。
    ebushicao
        30
    ebushicao  
       1 day ago
    qwen 拉完了,上次的 3.7-max 也是吹的天花乱坠,用起来有时候还没 deepseek-v4-flash 聪明。kimi 虽然 2.7 拉了一坨,但是 k3 确实有点东西。

    看到#3 楼说到了之前千问的宣传,我顺带吐槽一下,当时我说要点奶茶,给我推了一堆奶茶,我说换一批便宜点的,结果给我返回一批蔬菜水果... 拉到我真的绷不住。
    Hilalum
        31
    Hilalum  
       1 day ago
    不管咋的,Qwen3.6-27B 简直是神
    wxjer
        32
    wxjer  
       1 day ago
    有没有可能分跑分版和普通版,参考国内手机送评/跑分内幕
    PopRain
        33
    PopRain  
       1 day ago
    千问插件自动变 Qoder 社区版,credits 突然清 0 了 ,白嫖不了也就不用了. (订阅有腾讯的)
    lenzhang
        34
    lenzhang  
       23h 54m ago
    @Hilalum 确实,qwen3.6 27b 是真的神
    zhoudaniu
        35
    zhoudaniu  
       23h 0m ago   ❤️ 1
    @techmale codex 已经沦为我的 方案审核工具了, 让它做一个任务的时间,我可以用 grok 做完+人工测试完+睡一觉
    Nzelites
        36
    Nzelites  
       21h 53m ago
    qwen 其实并不差 3.7plus review ds4p 经常可以胜利,虽然说 ds4p 也不算顶部模型就是,不过 plus 相比 max 也是丐版嘛
    GeruzoniAnsasu
        37
    GeruzoniAnsasu  
       18h 47m ago
    @unregister

    > V 站没有一个人客观的,都是一句话的,别来这问了

    你理解错了客观的含义。 客观≠全面,而是在东西垃圾的时候真的说垃圾,在好的时候真的说好。显然 qwen 用户没有说 qwen 好的,k3 用户也没有说 k3 能力不足的,这挺客观的。

    事实上,qwen 的模型长期以来只能作为文本任务的基准模型来用,而且作为开源模型,它的底模表现极其中庸,说白了啥都能干啥都干不好。在此基础上光是官方就发过一大堆不同针对的微调,社区更是五花八门,人格强化的、道德强化的、自定义蒸馏的、拿来训练自己的 persona 的什么都有。

    所有 qwen 在社区眼中应该属于一个「自己接过来训练比较有玩头」的模型,对于 c 端需要它真正完成代码和指令任务的需求并不匹配,它也确实干不好。大伙都没说错,懒得表达自己不关心的场景而已。
    MK47
        38
    MK47  
       14h 50m ago   ❤️ 1
    不 qwen3.8 还真的确实还可以
    xiangqiankan
        39
    xiangqiankan  
       14h 32m ago
    前阵子不是被实锤了 2 万多个账号吗,蒸馏的 faber5
    catazshadow
        40
    catazshadow  
       13h 30m ago
    @wxjer 有可能是多余的
    unregister
        41
    unregister  
       11h 8m ago
    @GeruzoniAnsasu 太长不看
    unregister
        42
    unregister  
       11h 5m ago
    @GeruzoniAnsasu qwen 3.8 2.4T 得参数你自己拿来改吗?你说的是小模型吧
    liangc230323
        43
    liangc230323  
       9h 46m ago
    @MK47 确实还行,但是感觉思考能力不如 3.7max ,执行能力更强了
    bojue
        44
    bojue  
       9h 36m ago
    测试用过 300 刀的 qwen ,写了一堆垃圾,全删了

    qwen 写代码蜜汁自信,后端有相同的功能,直接新增表新增逻辑,楞给你创建一个新模块,导致后端原有的功能无法缝合
    frantic
        45
    frantic  
       7h 36m ago
    在我心里,qwen 已经和 minimax 一桌了:吹牛第一名,干啥啥不行
    IamAngry1s
        46
    IamAngry1s  
       6h 53m ago
    @unregister 这点文字都看不了,就别上网了。大模型动不动给你输出千把个字,你这还能理解?有阅读障碍的话你还谈什么大模型。每天赢麻了就行。但凡用过点阿里的 coding 或者 token plan ,都说不出这么蠢的话。
    hidemyname
        47
    hidemyname  
       6h 39m ago
    @cb74883 这个比例并不能说明模型优劣,最多能说明算力成本
    hidemyname
        48
    hidemyname  
       6h 37m ago
    目前这些模型除非特别垃圾,其实处理日常开发拉不开多大距离,跟当期自动驾驶一样,同样参数差不多算力水平的模型没有特别大的差距
    hidemyname
        49
    hidemyname  
       6h 35m ago
    7 月份买一个月的 qoder cn 169 的订阅,主要用 qwen 3.7 plus 和 max ,整体用下来,也没出现什么解决不了的问题,可能我这后端项目比较简单吧
    seven777
        50
    seven777  
       6h 21m ago
    目前来看 QW 3.7, 3.8 preview 还行吧,一般问题也能解决,主要是便宜啊.能力上感觉比腾讯的 HY3 好一些.
    加上 Qoder 比 codebuddy 好太多,所以 Qoder+QW3.7 能做很多事.
    seven777
        51
    seven777  
       6h 18m ago
    @Yesr00 #15 Qoder? 它相对来说还好吧, 比 QQ 家的 codebuddy 好很多; 比内涵段子家的 Trae 要轻量化省资源.
    但是它很多毛病,比如专家团不能用来写代码,极不靠谱,但用来评审+找错很好.
    seven777
        52
    seven777  
       6h 17m ago
    @lostwolfkf #27 3.8 preview 是不稳定,不是不好. 你用就知道了,我的显示 0.01 倍率.
    jujusharp
        53
    jujusharp  
       6h 7m ago
    我实测下来,至少在前端,3.8 max preview 审美和完成度是完胜 gpt 5.6 sol 的,跟 kimi k3 各有千秋吧,虽然跟 gpt 比前端能力也不太公平,一向短板。后端仍然是用 gpt
    uCharles
        54
    uCharles  
       5h 28m ago
    昨天下午 3.7 给我的都是错误回答,我切 3.8 后,3.8 跟我道歉说上一个回答是错误的。。。
    xifangczy
        55
    xifangczy  
       5h 26m ago
    跑分没输过 实战没赢过
    Chuckle
        56
    Chuckle  
       3h 38m ago

    现在 0.05x ,便宜,蹬了两天,感觉今天下午开始降智了,昨天和上午,体感上比 glm5.2 强一点
    jwan
        57
    jwan  
       1h 48m ago
    https://qoder.com.cn/referral?referral_code=KgU28a7KG31mIlqf6wRZno2t331BJLJx 你的好友邀请你体验 QoderWork 中国版,阿里巴巴出品的桌面端智能工作助手,立即注册并下载客户端领 2,000 积分,完成学生/教师认证再领 4,000 积分。
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1613 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 125ms · UTC 16:30 · PVG 00:30 · LAX 09:30 · JFK 12:30
    ♥ Do have faith in what you're doing.