公司其他

DeepSeek上线多模态视觉模型V4-Flash-Vision-Exp,API按token计费,图片最多384 tokens

发布:更新:作者:

本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。

DeepSeek-V4-Flash-Vision-Exp上线API平台,该多模态视觉理解模型于8月21日由DeepSeek官方宣布推出,支持Chat Completions、Messages、Responses三种格式调用。模型可在文本之外输入图片,执行图片描述、截图文字识别、图表分析等任务。在API服务中,图片会转换为token后按token计费,单张图片最多占用384个token。

该模型为一个实验性质版本,在各类Agent框架内展现多模态适配能力,可支持用户借助多样化Agent工具完成实际工作场景。在需要视觉理解的Agent Benchmark上,新模型相比V4-Flash实现大幅提升,官方称其多模态Agent能力接近Opus-4.8。官方展示的案例中,新模型可生成商业定制的西藏自驾游PPT,画面简洁精美。

定价方面,该模型的API计费价格与V4-Flash模型一致。百万tokens输入缓存命中为0.05元起,缓存未命中为1.5元起;百万tokens输出为4.5元起。

受影响行业