快科技8月21日消息,DeepSeek在API平台正式上线实验性质多模态模型DeepSeek-V4-Flash-Vision-Exp,开发者设置model参数为deepseek-v4-flash-vision-Exp即可完成调用。
该版本保留V4-Flash全部文本能力,补齐视觉理解能力,多模态Agent综合表现接近Claude Opus-4.8旗舰水平。
纯文本层面,该模型的推理、知识储备、文本Agent能力与V4-Flash正式版保持对齐,Terminal Bench 2.1、DeepSWE、DSBench-Hard等文本类评测维持原有得分,能够继续胜任代码编写、工具调用、长文档处理等原有业务场景。
在视觉相关Agent基准测试当中,对比原版V4-Flash实现明显跃升,ApexBench、Agents'Last Exam、Chartography等多模态专项评测分数显著提升,可完成截图解析、界面识别、图表读取、图文混合任务,适配GUI智能体、屏幕操作、图文数据分析等开发场景。
计费规则沿用V4-Flash现有定价标准,图片输入会转换为token参与计费,单张图片最高计384 tokens,不会额外收取视觉专项费用,百万token输入缓存未命中1元,输出2元,缓存命中可低至0.02元每百万token,降低多模态Agent开发的调用成本。
模型延续100万token超长上下文窗口,支持思考模式,可设置high、max推理强度,复杂多模态智能体任务推荐开启max档位,适配Harness智能体框架,支持工具调用、Function Call,能够结合图片理解完成调研、数据提取、自动化任务编排等链路工作。
官方明确该产品属于Exp实验预览版本,不建议直接用于生产环境,后续会根据线上真实调用反馈迭代优化,稳定性、输出效果会持续调整,正式版上线时间暂未对外公布。



