月访问量
0
累计浏览
1
用户评分
4.5
收录时间
2026-08
产品介绍
产品介绍
DeepSeek V4-Flash 是深度求索(DeepSeek)于2026年7月31日正式发布的高性价比 Agent 大模型,API 进入公开测试阶段。该模型采用 284B 总参数 / 13B 激活参数的 MoE 架构,在保持轻量推理成本的同时,通过后训练优化实现了 Agent 和编程能力的跨越式提升,多项基准测试成绩超越 V4-Pro 预览版,以极致性价比挑战前沿模型定价体系。
核心功能
- 13B 激活参数 MoE 架构:284B 总参数,每次推理仅激活 13B,推理效率极高
- 1M Token 上下文窗口:支持超长文档分析和代码库理解
- Agent 能力大幅增强:Terminal-Bench 2.1 得分 82.7,DeepSWE 得分 54.4
- 原生 Responses API 支持:深度适配 Codex 和智能体工作流
- 极致性价比:输入约 $0.14/百万 tokens,输出约 $0.28/百万 tokens
- 多语言编程支持:在代码生成、调试、全栈开发任务中表现突出
API 调用
from openai import OpenAI
client = OpenAI(
api_key="your-api-key",
base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "帮我写一个 Python 爬虫并解释代码"}]
)
print(response.choices[0].message.content)
基准测试成绩
| 基准测试 | 成绩 |
|---|---|
| Terminal-Bench 2.1 | 82.7 |
| DeepSWE | 54.4 |
| NL2Repo | 54.2 |
| Cybergym | 76.7 |
| Toolathlon Verified | 70.3 |
| Agent Last Exam | 25.2 |
典型使用场景
- AI Agent 和工具调用应用
- 代码生成与辅助编程(Codex 适配)
- 低成本大规模推理部署
- 企业级智能客服与自动化工作流
- 长文档分析与信息抽取
平台支持
通过 DeepSeek API 官方平台、硅基流动、Vercel AI Gateway 等平台访问。V4-Pro 正式版即将发布。