@HCPTangHY 在 时隔10天,DeepSeek-V4-Flash-Vision-Exp正式开源 中发帖
DeepSeek 在 Hugging Face 上开源了 DeepSeek-V4-Flash-Vision-Exp,这是 DeepSeek-V4 系列中首个具备视觉理解能力的实验性多模态模型,采用 MIT 许可证。
该模型在 DeepSeek-V4-Flash 架构基础上引入视觉模块并进行持续训练。根据官方公布的基准测试数据,V4-Flash-Vision-Exp 在多模态智能体任务上相较前代 V4-Flash-0731 有显著提升——ApexBench 从 26.2 升至 36.5,ZeroBench 达到 35.0,超过 Opus-4.8 的 34.0。与此同时,该模型在纯文本智能体任务上保持了与前代相当的表现,DeepSWE 得分 59.3,略高于 Opus-4.8 的 58.0。
不过之前关于视觉的论文目前仍未重发