DeepSeek-V4-Flash-Vision-Exp

DeepSeek-V4-Flash-Vision-Exp

模型算力 按量付费:与V4-Flash同价,输入1元/百万tokens,输出4元/百万tokens,图片封顶384 tokens/张 中国 #DeepSeek#多模态#视觉模型#开源#国产模型#高性价比

DeepSeek 首个多模态视觉理解模型,8月21日上线,纯文本能力与 V4-Flash 持平,视觉 Agent 能力接近 Opus-4.8,图片按 Token 计费封顶 384 tokens。

月访问量
0
累计浏览
1
用户评分
4.6
收录时间
2026-08

产品介绍

产品介绍

DeepSeek-V4-Flash-Vision-Exp 是 DeepSeek 于 2026 年 8 月 21 日正式上线的 V4 系列首个支持图片输入的视觉模型。该模型在保持 V4-Flash 纯文本能力的同时加入视觉理解,可处理图片分析、PPT 制作、网页重构和前端开发等任务。

核心功能

  • 文本能力不变:纯文本能力(Agent、推理、世界知识等)与 DeepSeek-V4-Flash 正式版完全持平
  • 视觉理解跃升:需要视觉理解的 Agent 任务大幅跃升,多模态 Agent 能力已接近 Opus-4.8
  • 超高性价比:图片按尺寸折算 Token,与 V4-Flash 文本完全同价,一张图封顶 384 tokens,比 GPT-4o 视觉便宜约 30 倍
  • 1M 上下文窗口:支持超长文档和图文混合输入
  • 最大输出 384K:满足长文生成需求
  • JSON Output 与 Tool Calling:支持结构化输出和工具调用
  • Files API 免费持久化:支持文件长期存储

技术规格

能力 参数
上下文窗口 1M tokens
最大输出长度 384K
图片 Token 上限 384 tokens/张
文本能力 与 V4-Flash 持平
视觉 Agent 能力 接近 Opus-4.8

API 调用

from openai import OpenAI

client = OpenAI(api_key="your-api-key", base_url="https://api.deepseek.com")
response = client.chat.completions.create(
    model="deepseek-v4-flash-vision-exp",
    messages=[{
        "role": "user",
        "content": [
            {"type": "text", "text": "描述这张图片"},
            {"type": "image_url", "image_url": {"url": "https://example.com/image.jpg"}}
        ]
    }]
)
print(response.choices[0].message.content)

定价

与 DeepSeek-V4-Flash 完全一致:

  • 输入:¥1/百万 tokens(缓存命中 ¥0.5/百万 tokens)
  • 输出:¥4/百万 tokens
  • 图片按 Token 计费,封顶 384 tokens/张

典型使用场景

  • 图片分析与理解
  • PPT 制作与文档可视化
  • 网页重构与前端开发
  • 多模态 Agent 任务
  • 图文混合内容生成