DeepSeek V4 Flash

DeepSeek V4 Flash

模型算力 按量付费:输入1元/百万tokens(缓存命中0.02元),输出2元/百万tokens 中国 #DeepSeek#开源#MoE#Agent#国产模型#高性价比#编程

DeepSeek 2026年7月31日发布的正式版轻量化大模型,284B MoE架构,100万token上下文,Agent能力反超V4 Pro预览版,极致性价比,原生支持Codex

月访问量
0
累计浏览
1
用户评分
4.5
收录时间
2026-08

产品介绍

产品介绍

DeepSeek V4 Flash(版本号 DeepSeek-V4-Flash-0731)是深度求索于 2026 年 7 月 31 日正式发布的轻量化大模型,从预览版升级为正式版 API 开启公测。模型架构保持 284B 总参数 / 13B 激活参数的 MoE 设计不变,原生支持 100 万 token 超长上下文及思考/非思考双模式。核心升级在于后训练驱动的 Agent 能力跃迁,九项智能体、代码和自动化基准测试成绩整体显著高于 V4-Pro 预览版。

核心功能

  • Agent 能力反超 Pro:Terminal Bench 2.1 得分 82.7,DeepSWE 得分 54.4,智能体能力超越 V4-Pro 预览版
  • 100 万 Token 上下文:支持超长文档分析、代码库级理解
  • 原生 Responses API 支持:首次原生适配 OpenAI Responses API 格式,可直接在 Codex CLI、VS Code Codex 插件中使用
  • 思考/非思考双模式:根据场景灵活切换推理深度
  • 极致性价比:缓存命中价格低至 0.02 元/百万 tokens,成本仅为 GPT-5.6 Sol 的数十分之一

API 调用

from openai import OpenAI

client = OpenAI(
    api_key="your-deepseek-api-key",
    base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "帮我重构这段Python代码并添加单元测试"}]
)
print(response.choices[0].message.content)

定价:缓存未命中输入 1 元/百万 tokens,输出 2 元/百万 tokens;缓存命中输入 0.02 元/百万 tokens(约 98% 命中率)。

典型使用场景

  • AI Agent 和工具调用应用
  • 代码生成与自动化编程(Codex 适配)
  • 大规模、高并发的日常对话任务
  • 企业级成本敏感型 AI 部署
  • 长文档处理与知识库问答

平台支持

通过 DeepSeek 官方 API 平台、SiliconFlow 硅基流动、Together AI 等第三方平台访问。