DeepSeek V4-Flash

DeepSeek V4-Flash

深度求索2026年7月31日发布的官方版V4-Flash大模型,13B激活参数MoE架构,Agent与编程能力超越V4-Pro预览版,百万tokens仅需约1元人民币。

月访问量
0
累计浏览
1
用户评分
4.5
收录时间
2026-08

产品介绍

产品介绍

DeepSeek V4-Flash 是深度求索(DeepSeek)于2026年7月31日正式发布的高性价比 Agent 大模型,API 进入公开测试阶段。该模型采用 284B 总参数 / 13B 激活参数的 MoE 架构,在保持轻量推理成本的同时,通过后训练优化实现了 Agent 和编程能力的跨越式提升,多项基准测试成绩超越 V4-Pro 预览版,以极致性价比挑战前沿模型定价体系。

核心功能

  • 13B 激活参数 MoE 架构:284B 总参数,每次推理仅激活 13B,推理效率极高
  • 1M Token 上下文窗口:支持超长文档分析和代码库理解
  • Agent 能力大幅增强:Terminal-Bench 2.1 得分 82.7,DeepSWE 得分 54.4
  • 原生 Responses API 支持:深度适配 Codex 和智能体工作流
  • 极致性价比:输入约 $0.14/百万 tokens,输出约 $0.28/百万 tokens
  • 多语言编程支持:在代码生成、调试、全栈开发任务中表现突出

API 调用

from openai import OpenAI

client = OpenAI(
    api_key="your-api-key",
    base_url="https://api.deepseek.com"
)
response = client.chat.completions.create(
    model="deepseek-v4-flash",
    messages=[{"role": "user", "content": "帮我写一个 Python 爬虫并解释代码"}]
)
print(response.choices[0].message.content)

基准测试成绩

基准测试 成绩
Terminal-Bench 2.1 82.7
DeepSWE 54.4
NL2Repo 54.2
Cybergym 76.7
Toolathlon Verified 70.3
Agent Last Exam 25.2

典型使用场景

  • AI Agent 和工具调用应用
  • 代码生成与辅助编程(Codex 适配)
  • 低成本大规模推理部署
  • 企业级智能客服与自动化工作流
  • 长文档分析与信息抽取

平台支持

通过 DeepSeek API 官方平台、硅基流动、Vercel AI Gateway 等平台访问。V4-Pro 正式版即将发布。