曦岚 (@xilan)有点出乎意料:K100_AI 本地 Qwen3.8-27B vs Claude Sonnet 5 Max,一句话生成 HTML 小游戏 中发帖

[QQ_1788084757203] 
最近在测试海光 K100_AI 上部署的 Qwen3.8-27B,顺手拿 Claude Sonnet 5 Max 做了一次非常简单的单提示词对比。
测试提示词只有一句:
帮我写一个滑雪大冒险的小游戏,HTML格式。
没有补充 UI 风格、配色、布局、功能清单等额外要求,基本就是看模型自己对需求的理解、设计和发挥。
左侧:Claude Sonnet 5 Max
右侧:Qwen3.8-27B
Qwen3.8-27B 是部署在 海光 K100_AI 上的 W8A8 INT8 推理版本,Activation / KV Cache 使用 BF16,使用定制 SGLang 推理服务,模型上下文按官方原生 262K 配置。
从这一次生成结果看,比较让我意外的是 Qwen 右侧版本在视觉完成度上反而更高:雪道透视、远山、树木、太阳、主菜单以及整体画面...