Einzieg 在 Qwen3.8-27B BF16 / FP8 / NVFP4 实测 中发帖
本次测试对象为 Qwen3.8-27B 的 BF16、官方 FP8 和社区 NVFP4 。除权重精度外,SGLang、上下文、KV Cache、DFlash2、采样参数和题目都保持一致。
测试对象
精度
模型
来源
BF16
Qwen/Qwen3.8-27B
Qwen 官方 BF16 权重
FP8
Qwen/Qwen3.8-27B-FP8
Qwen 官方 block FP8,block size 128
NVFP4
RadixArk/Qwen3.8-27B-NVFP4
社区 NVIDIA Model Optimizer 混合精度权重
测试环境
项目
配置
GPU
NVIDIA RTX PRO 6000 Blackwell Workstation Edition,96GB
Docker Engine
29.2.1
SGLang
0.0....