月访问量
0
累计浏览
1
用户评分
4.5
收录时间
2026-08
产品介绍
产品介绍
DeepSeek V4 Flash(版本号 DeepSeek-V4-Flash-0731)是深度求索于 2026 年 7 月 31 日正式发布的轻量化大模型,从预览版升级为正式版 API 开启公测。模型架构保持 284B 总参数 / 13B 激活参数的 MoE 设计不变,原生支持 100 万 token 超长上下文及思考/非思考双模式。核心升级在于后训练驱动的 Agent 能力跃迁,九项智能体、代码和自动化基准测试成绩整体显著高于 V4-Pro 预览版。
核心功能
- Agent 能力反超 Pro:Terminal Bench 2.1 得分 82.7,DeepSWE 得分 54.4,智能体能力超越 V4-Pro 预览版
- 100 万 Token 上下文:支持超长文档分析、代码库级理解
- 原生 Responses API 支持:首次原生适配 OpenAI Responses API 格式,可直接在 Codex CLI、VS Code Codex 插件中使用
- 思考/非思考双模式:根据场景灵活切换推理深度
- 极致性价比:缓存命中价格低至 0.02 元/百万 tokens,成本仅为 GPT-5.6 Sol 的数十分之一
API 调用
from openai import OpenAI
client = OpenAI(
api_key="your-deepseek-api-key",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "帮我重构这段Python代码并添加单元测试"}]
)
print(response.choices[0].message.content)
定价:缓存未命中输入 1 元/百万 tokens,输出 2 元/百万 tokens;缓存命中输入 0.02 元/百万 tokens(约 98% 命中率)。
典型使用场景
- AI Agent 和工具调用应用
- 代码生成与自动化编程(Codex 适配)
- 大规模、高并发的日常对话任务
- 企业级成本敏感型 AI 部署
- 长文档处理与知识库问答
平台支持
通过 DeepSeek 官方 API 平台、SiliconFlow 硅基流动、Together AI 等第三方平台访问。