DeepSeek V4-Flash-Vision-Exp 上线:开启多模态 API 服务,Agent 能力接近 Opus-4.8
8 月 21 日消息,深度求索官方刚刚宣布全新的多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 上线 DeepSeek API 平台。

该模型支持在文本之外输入图片,可以让模型描述图片、识别截图中的文字、分析图表等。支持的图片格式包括 JPEG、PNG、GIF、WebP。
深度求索官方表示,V4-Flash-Vision-Exp 在各类 Agent 框架内展现出了较好的多模态适配能力,能够有效支持大家借助多样化的 Agent 工具解锁更多实用的工作场景。
提醒:这是一个实验性质的模型,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 访问该模型。
平衡文本与多模态能力
据悉,在纯文本能力方面,包括Agent、推理、世界知识等,DeepSeek-V4-Flash-Vision-Exp与DeepSeek-V4-Flash正式版不相上下。然而,在需要视觉理解的Agent Benchmark上,DeepSeek-V4-Flash-Vision-Exp却实现了大幅提升,其多模态Agent能力已接近Opus-4.8。
API 支持
若要访问V4-Flash-Vision-Exp模型的API,用户只需将model参数设置为'deepseek-v4-flash-vision-exp'。在该API服务中,图片会被转换为token,并按照token数量进行计费。值得注意的是,一张图片最多占用384个tokens,且计费价格与V4-Flash模型相同。
多模态 API 支持 Chat Completions、Messages、Responses 三种格式调用,可以方便接入各类 Agent 工具中使用,支持图文混合输入,支持 base64 内联、外部 URL、Files API 三种图片传入方式。
Files API 上线
Files API 现已开放,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而节省请求带宽(同一张图片在多个请求中无需重复上传)。
-
- 元宵节猜灯谜的祝福短信
- 角色扮演 |
-
- 我好喜欢你是什么梗?
- 角色扮演 |
-
- 新学期开学季祝福语简短励志(15篇)
- 角色扮演 |
-
- 白露时节问候短信(15篇)
- 角色扮演 |
-
- 五一节假日经典祝福贺词
- 角色扮演 |