haodee 在 有没有玩DGX本地部署的佬聊聊天都用什么模型 中发帖
ornith1.5 35B-A3B 和Qwen 3.8 27B 哪个当主力模型,还是说上两台直接部署D4flash,我单机也跟部署了D4flash不过只有7-8token/s 难搞 😅
ornith1.5 35B-A3B 和Qwen 3.8 27B 哪个当主力模型,还是说上两台直接部署D4flash,我单机也跟部署了D4flash不过只有7-8token/s 难搞 😅