萝北来信 LuobeiLetters (@tobenot)接下来到场的是 Qwen 3.8 Flash-Next! 中发帖

之前我一直在折腾千问的3.8 27B。本地部署了许多天之后,感觉非常的舒适啊,而且各种隐私的内容也可以直接用它来处理。关键是算力是自己的,然后本身一个电脑耗电又只有几百W。而且他在 4090D 上速度飞快啊(50 token/s),比那个牛来模型,牛来虽然免费,但是卡卡的。OpenCode Go 的 flash 也卡卡的!这个新开源的,它能利用你的大内存(如果有的话)。我的电脑本身有一个大内存。我之前就想用混合专家来把这个内存给用上,但现在这个真是饭来张口,衣来伸手。啊,不对。是 踏破铁鞋无觅处,得来全不费工夫! 
这是下一代 Qwen4 架构的先行版,有 125B 总参,每个字只激活 6B,再挂 51B 的查表词库,遇到一些常见词直接查,他就不用去计算。但他要把这个【新华词典】给塞在内存和显存里。如果你有一台内存大、显存小的家用机,那这就是为它准备的。24G 显存都塞不下它,但是如果你有...