月访问量
0
累计浏览
1
用户评分
4.6
收录时间
2026-08
产品介绍
产品介绍
DeepSeek-V4-Flash-Vision-Exp 是 DeepSeek 于 2026 年 8 月 21 日正式上线的 V4 系列首个支持图片输入的视觉模型。该模型在保持 V4-Flash 纯文本能力的同时加入视觉理解,可处理图片分析、PPT 制作、网页重构和前端开发等任务。
核心功能
- 文本能力不变:纯文本能力(Agent、推理、世界知识等)与 DeepSeek-V4-Flash 正式版完全持平
- 视觉理解跃升:需要视觉理解的 Agent 任务大幅跃升,多模态 Agent 能力已接近 Opus-4.8
- 超高性价比:图片按尺寸折算 Token,与 V4-Flash 文本完全同价,一张图封顶 384 tokens,比 GPT-4o 视觉便宜约 30 倍
- 1M 上下文窗口:支持超长文档和图文混合输入
- 最大输出 384K:满足长文生成需求
- JSON Output 与 Tool Calling:支持结构化输出和工具调用
- Files API 免费持久化:支持文件长期存储
技术规格
| 能力 | 参数 |
|---|---|
| 上下文窗口 | 1M tokens |
| 最大输出长度 | 384K |
| 图片 Token 上限 | 384 tokens/张 |
| 文本能力 | 与 V4-Flash 持平 |
| 视觉 Agent 能力 | 接近 Opus-4.8 |
API 调用
from openai import OpenAI
client = OpenAI(api_key="your-api-key", base_url="https://api.deepseek.com")
response = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "描述这张图片"},
{"type": "image_url", "image_url": {"url": "https://example.com/image.jpg"}}
]
}]
)
print(response.choices[0].message.content)
定价
与 DeepSeek-V4-Flash 完全一致:
- 输入:¥1/百万 tokens(缓存命中 ¥0.5/百万 tokens)
- 输出:¥4/百万 tokens
- 图片按 Token 计费,封顶 384 tokens/张
典型使用场景
- 图片分析与理解
- PPT 制作与文档可视化
- 网页重构与前端开发
- 多模态 Agent 任务
- 图文混合内容生成