据快科技8月21日报道,DeepSeek已在API平台上线一款实验版多模态模型DeepSeek-V4-Flash-Vision-Exp。开发者将model参数设为deepseek-v4-flash-vision-Exp即可完成调用。
新模型在完整继承V4-Flash文本能力的基础上,补足了视觉理解功能。官方数据显示,其多模态智能体综合表现已接近Claude Opus-4.8旗舰型号。
文本层面,该模型的推理、知识储备及文本智能体能力与V4-Flash正式版保持一致,Terminal Bench 2.1、DeepSWE、DSBench-Hard等评测结果维持原有水平,因此仍可胜任代码编写、工具调用、长文档处理等既有业务。

视觉智能体相关测试中,新模型相较原版V4-Flash提升明显,ApexBench、AgentsLast Exam、Chartography等专项评测分数显著提高,可完成截图解析、界面识别、图表读取及图文混合任务,适用于GUI智能体、屏幕操作、图文数据分析等开发场景。
计价规则继续沿用V4-Flash现行标准。图片输入将按token折算计费,单张图片最多计384 tokens,