newzors
V2EX  ›  Ollama

太爽了,用 llama.ccp 本地部署 qwen2.5-coder-7b-instruct-q4_k_m.gguf

  •  
  •   newzors · 23h 38m ago · 532 views

    我的笔记本是 T550 4G,32G ,用 llama.ccp 部署了 qwen2.5-coder-7b-instruct-q4_k_m.gguf 跑起来太爽了,做一些普通的文本生成很棒!!!但是上下文 4096 太小了,增加参数好像也不行,不能用于 DSH ,有没有别的办法?外挂 GPU 么,有没有便宜的办法。

    5 replies    2026-08-19 18:05:57 +08:00
    snachx
        1
    snachx  
       23h 24m ago
    试试新的吧,2.5 应该进故纸堆了
    lancelock
        2
    lancelock  
       22h 53m ago
    这模型也太老了吧
    veni2023
        3
    veni2023  
       22h 10m ago
    现在不是 3.8 了吗
    cowcomic
        4
    cowcomic  
       22h 7m ago
    换 qwen3.5-9B ,int4 量化也能跑起来
    newzors
        5
    newzors  
    OP
       21h 54m ago
    @cowcomic 谢谢这位兄弟,我下载看看
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   5535 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 30ms · UTC 08:00 · PVG 16:00 · LAX 01:00 · JFK 04:00
    ♥ Do have faith in what you're doing.