updream-视频生成助手
当前位置:首页>AI资讯>DeepSeek-V4-Flash-Vision-Exp开放模型权重,采用MIT协议开源

DeepSeek-V4-Flash-Vision-Exp开放模型权重,采用MIT协议开源

2026年08月31日,DeepSeek正式开放多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp的模型权重。需要说明的是,这并不是一款全新模型:该模型此前已经上线DeepSeek API平台,此次更新的核心是补齐开源权重与本地推理能力,让开发者可以脱离官方API进行研究、部署和二次开发。

DeepSeek-V4-Flash-Vision-Exp是DeepSeek-V4系列首个实验性多模态模型。它基于DeepSeek-V4-Flash架构加入视觉模块,并通过持续训练获得图像理解与多模态Agent能力。在处理图片、图表、网页界面和视觉任务的同时,模型仍保持了与DeepSeek-V4-Flash-0731相当的纯文本Agent性能。

目前,DeepSeek已在Hugging Face开放完整模型权重,仓库体积约168GB,包含48个Safetensors权重分片。同时开放的还有Tokenizer、图文提示编码、图像预处理、权重转换工具和最小PyTorch推理实现,覆盖Vision Encoder、Aligner、DFlash、MoE、Hyper-Connections及DSpark等主要结构。

模型采用MIT License,意味着开发者可以在遵守许可证的前提下,将其用于模型研究、私有化部署、Agent框架集成及商业项目开发。官方代码支持图文交错输入、多轮对话、工具调用和思考模式,并提供多卡张量并行推理示例。

不过,官方同时指出,当前提供的是便于理解模型结构的参考推理实现,并非开箱即用的生产级服务引擎。由于模型权重体积较大,本地运行需要较高的GPU显存、存储空间和多卡计算资源,普通个人电脑难以完整部署。

此次开放权重,意味着DeepSeek-V4-Flash-Vision-Exp从此前的API服务进一步扩展为可下载、可研究和可私有化部署的开源多模态模型,为开发者构建视觉Agent、图表分析、界面理解和多模态自动化应用提供了更完整的技术基础。

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-Vision-Exp

©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。 即梦AI