DeepSeek V4-Flash-Vision

DeepSeek V4-Flash-Vision

模型算力 峰谷定价(输入空闲1.5元/百万tokens,输出空闲4.5元/百万tokens) 中国 #DeepSeek#多模态#视觉模型#V4#开源#API#Agent#视觉理解

DeepSeek于2026年8月21日上线的V4系列首款多模态视觉理解模型,实验性质版本,在保持V4-Flash文本能力基础上新增视觉输入,支持图片理解与多模态Agent任务。

月访问量
0
累计浏览
2
用户评分
4.6
收录时间
2026-08

产品介绍

产品介绍

DeepSeek-V4-Flash-Vision-Exp 是深度求索(DeepSeek)于2026年8月21日正式上线的实验性多模态视觉模型,也是 DeepSeek V4 系列首款接入视觉能力的模型。该模型在保持 DeepSeek-V4-Flash 完整文本推理能力的基础上,新增了图片输入理解功能,标志着 DeepSeek 正式补齐全模态能力版图。

核心能力

  • 视觉理解:支持图片输入,可识别图像内容、图表、文档截图等
  • 文本能力对齐:纯文本能力(Agent、推理、世界知识)与 DeepSeek-V4-Flash 完全持平
  • 多模态Agent:显著提升多模态 AI Agent 任务表现,支持看图操作、屏幕理解等场景
  • 1M上下文窗口:继承 V4 系列的百万级超长上下文能力
  • 峰谷定价:采用与 V4-Flash 相同的峰谷分时定价策略,性价比极高

技术规格

参数 规格
模型版本 DeepSeek-V4-Flash-Vision-Exp
上下文长度 1M tokens
最大输出 384K tokens
输入模态 文本 + 图片
并发限制 2500
API格式 OpenAI兼容 / Anthropic兼容

定价说明

  • 缓存命中输入:空闲0.05元/百万tokens,高峰0.10元/百万tokens
  • 缓存未命中输入:空闲1.5元/百万tokens,高峰3.0元/百万tokens
  • 输出:空闲4.5元/百万tokens,高峰9.0元/百万tokens
  • 高峰时段:北京时间 9:00-12:00、14:00-18:00
  • 图片按尺寸换算为token计费

API调用示例

from openai import OpenAI

client = OpenAI(
    api_key="your-deepseek-api-key",
    base_url="https://api.deepseek.com"
)

response = client.chat.completions.create(
    model="deepseek-v4-flash-vision-exp",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "请描述这张图片的内容"},
            {"type": "image_url", "image_url": {"url": "data:image/jpeg;base64,..."}}
        ]
    }]
)
print(response.choices[0].message.content)

使用场景

  • AI Agent视觉操作(看屏幕、点按钮、读界面)
  • 文档/图表/截图智能理解
  • 多模态内容分析
  • 视觉问答与推理
  • 网页和应用界面自动化

注意事项

  • 当前为实验性质版本(Exp),官方建议用于测试和探索
  • FIM补全暂不支持
  • 图片token换算规则请参考官方文档
  • 通过 DeepSeek API 平台调用,设置 model='deepseek-v4-flash-vision-exp'