EinziegQwen3.8-27B BF16 / FP8 / NVFP4 实测 中发帖

本次测试对象为 Qwen3.8-27B 的 BF16、官方 FP8 和社区 NVFP4 。除权重精度外,SGLang、上下文、KV Cache、DFlash2、采样参数和题目都保持一致。 
测试对象




精度
模型
来源




BF16
Qwen/Qwen3.8-27B
Qwen 官方 BF16 权重


FP8
Qwen/Qwen3.8-27B-FP8
Qwen 官方 block FP8,block size 128


NVFP4
RadixArk/Qwen3.8-27B-NVFP4
社区 NVIDIA Model Optimizer 混合精度权重



测试环境




项目
配置




GPU
NVIDIA RTX PRO 6000 Blackwell Workstation Edition,96GB


Docker Engine
29.2.1


SGLang
0.0....