GPLer【建设中】Qwen3.8-Flash-Next-FP8 效果测试 中发帖

测试环境
模型: Qwen/Qwen3.8-Flash-Next-FP8 (从权重大小来看 BF16 有爆显存风险)
显卡: 4 x A800 80GB
引擎: vllm/vllm-openai:qwen38-flash-next (只能用这个,v0.28.0 起不来)
上下文长度: 256k (原生 256k 简单测测够用)
软件: Cherry Studio
思考强度: 默认 (xhigh)

不启用 MTP,输出速度大概 83 token/s;启用 MTP 输出速度大概 158 token/s

前端能力测试
鹈鹕骑车

提示词: 创建一个HTML,内容是SVG绘制一个鹈鹕骑自行车的2D动画。

[图片]
[图片]
[图片]

简评: 确实很认真,做了一整个完整的产品落地页,但是努力的方向好像错了?


题目全部来源上次 Qwen3.8 27B 测试,可...