2026年08月21日,DeepSeek 正式上线实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,开发者将模型名称设置为 deepseek-v4-flash-vision-exp,即可通过 DeepSeek API 调用。
根据官方介绍,该模型在 Agent、推理和世界知识等纯文本任务上的能力与 DeepSeek-V4-Flash 正式版基本持平;在需要处理图像信息的 Agent 测试中则获得明显提升,多模态 Agent 能力已接近 Claude Opus 4.8。

借助新增的视觉理解能力,模型可以在 Agent 框架中完成商业 PPT 制作、网站视觉重构、前端动态 Demo 开发、图片识别和图表分析等任务。
API 支持 Chat Completions、Messages 和 Responses 三种调用格式,并提供 Base64、外部图片 URL 与 Files API 三种图片传入方式。图片会转换为 Token 后计费,每张图片最多占用 384 Tokens,调用价格与 DeepSeek-V4-Flash 保持一致。
DeepSeek 同时上线了免费的 Files API。开发者可以提前上传图片并通过 file_id 在多个请求中重复引用,从而减少带宽消耗,更适合需要持续处理同一批视觉素材的多轮 Agent 工作流。
©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。

