DeepSeek上线多模态视觉模型V4-Flash-Vision-Exp,Agent能力接近Opus-4.8

正飞GEO 2026年08月23日 08:07 1 阅读 来源:51CTO/DeepSeek官方
DeepSeek上线多模态视觉模型V4-Flash-Vision-Exp,Agent能力接近Opus-4.8 DeepSeek上线多模态视觉模型V4-Flash-Vision-Exp,Agent能力接近Opus-4.8
DeepSeek于8月21日在API平台上线实验性多模态视觉模型deepseek-v4-flash-vision-exp,开发者首次可通过API传图调用。文本能力与V4-Flash正式版持平,多模态Agent能力接近Opus-4.8。

2026年8月21日,DeepSeek在API平台上线了实验性多模态视觉模型 deepseek-v4-flash-vision-exp。这意味着开发者第一次能用自己的API Key,把图片塞进DeepSeek的上下文,让模型看图、再让Agent接着干活。

需要说明的是,这不是DeepSeek第一次识图——网页和App端的识图模式早在2026年4月底灰度、6月全量上线。今天开放的是开发者API,能在代码里传图,而非仅在对话框里传图。此外,模型名带 exp,是实验版本,建议谨慎用于生产环境。

关键性能表现方面,官方benchmark显示:纯文本Agent、推理、世界知识能力与V4-Flash正式版持平,加视觉没有牺牲老本行。多模态Agent能力官方定位接近Opus-4.8:ApexBench从26.2跃升至36.5,Agents Last Exam得分27.3反超Opus-4.8的25.7,ZeroBench以35.0领先Opus-4.8的34.0。单图最高按384 token计费,定价保持亲民风格。

分享到: