newzors
V2EX  ›  Ollama

太爽了,用 llama.ccp 本地部署 qwen2.5-coder-7b-instruct-q4_k_m.gguf

  •  
  •   newzors · 6 days ago · 688 views

    我的笔记本是 T550 4G,32G ,用 llama.ccp 部署了 qwen2.5-coder-7b-instruct-q4_k_m.gguf 跑起来太爽了,做一些普通的文本生成很棒!!!但是上下文 4096 太小了,增加参数好像也不行,不能用于 DSH ,有没有别的办法?外挂 GPU 么,有没有便宜的办法。

    5 replies    2026-08-19 18:05:57 +08:00
    snachx
        1
    snachx  
       6 days ago
    试试新的吧,2.5 应该进故纸堆了
    lancelock
        2
    lancelock  
       6 days ago
    这模型也太老了吧
    veni2023
        3
    veni2023  
       6 days ago
    现在不是 3.8 了吗
    cowcomic
        4
    cowcomic  
       6 days ago
    换 qwen3.5-9B ,int4 量化也能跑起来
    newzors
        5
    newzors  
    OP
       6 days ago
    @cowcomic 谢谢这位兄弟,我下载看看
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   1138 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 32ms · UTC 23:17 · PVG 07:17 · LAX 16:17 · JFK 19:17
    ♥ Do have faith in what you're doing.