@yricky 在 请输入文本!q4量化版qwen3.8next本地部署编写高保真3D魔方 中发帖
我的天哪千问大人!
部署方法相当弱智,unsloth的q4xl模型下载下来,llamacpp pull master然后make,直接开跑,接cherrystudio一波出
[截屏2026-09-01 01.33.17]
内存占用相当友好,llamacpp最新代码已经将engram模块卸载到ssd了,128G的dgx spark后台挂着一个占用30G的comfy ui几乎不影响速度,也没爆显存,也就是实际上占用80G左右的显存