8月21日,DeepSeek宣布全新的多模态视觉理解模型DeepSeek-V4-Flash-Vision-Exp正式上线。这意味着,那个曾经在文本推理领域大杀四方的DeepSeek,终于补齐了“视觉理解”这块关键拼图。

文本能力不缩水,视觉能力大跃进
这次上线的V4-Flash-Vision-Exp是一个实验性模型,可能力一点不含糊。在纯文本能力方面,包括Agent任务、推理能力、世界知识等,它和现有的DeepSeek-V4-Flash正式版基本持平。
在此基础上,它的视觉理解能力实现了大幅提升。在需要视觉理解的Agent基准测试中,它的多模态Agent能力已经非常接近Opus-4.8模型。

多模态Agent能干什么活
V4-Flash-Vision-Exp的真正看点,在于它能把视觉理解和Agent任务合二为一,直接帮你产出结果。官方演示了几个典型场景:
商业PPT一键生成:输入“做一份西藏自驾游PPT,高端野性风”,直接输出完整PPT,含真实摄影风配图和三种定价方案。
网站风格二次创作:给一个网页链接,指定“黑蓝深海、玻璃UI”风格,几轮对话后就能得到重构好的未来主义风开发者网站。
前端动态特效制作:给一句创意描述,比如“3D黏土小怪物在复古舞池派对”,直接生成可运行的前端特效Demo。
以前用AI做这些事,可能得先请文生图模型帮忙,再把图喂给大模型,流程长还费劲。现在DeepSeek一个模型从头到尾搞定,看图干活一气呵成。
价格直接对齐V4 Flash,图片按尺寸折算Token
大家最关心的价格问题,DeepSeek-V4-Flash-Vision-Exp的API价格与V4 Flash完全一致,采用峰谷定价机制。高峰时段为北京时间9:00-12:00和14:00-18:00,其余时间均为空闲时段,空闲时段价格为高峰时段的一半。
具体价格如下:

(图片来源:DeepSeek)
图片不单独按张收费,而是根据图片尺寸折算成Token后,与文本Token一起计入输入费用。单张图片最多折算384个Token,性价比相当可观。
为了方便开发者,DeepSeek还同步推出了免费的Files API。你可以先把图片上传到平台,在请求中通过file_id引用,同一张图片在多个请求里就不用重复上传了,既节省带宽,调用效率也更高。
API怎么调用,搭配OpenClaw部署助手四步走
对于开发者来说,这次更新全是干货,但具体怎么把这个视觉模型用起来,才是大家最关心的。这里推荐OpenClaw部署助手,它能帮你把那些复杂的命令行和环境配置全部自动化。
步骤1:下载与安装
点击下方按钮,下载OpenClaw部署助手最新版。

好评率97%
下载次数:3540345 步骤2:一键部署环境
打开软件,在主界面点击「开始部署」按钮。程序会自动检测本地环境、下载核心依赖文件、配置运行参数等。只需等待进度条走完即可。

步骤3:接入DeepSeek V4大模型(两种方式任选)
部署成功后,点击左侧菜单的「AI模型」进入配置页面。针对不同需求,有2种接入方式:
方式①:内置AI模式(推荐新手)
如果你想用上多种AI模型,且不想折腾API Key配置,可以直接启用“内置AI”模式。该模式已预置DeepSeek、Kimi、智谱GLM、通义千问、ChatGPT、Gemini等25余款主流模型,无需提供任何密钥,开箱即用。

选择内置AI选项后,从列表中选择你想用的模型(比如这次的主角DeepSeek V4-Flash-Vision-Exp),再根据预估使用量选购合适的Token包即可。视觉模型产生的图片token费用也一并包含在内,不用额外操心计费逻辑。

方式②:用自己的API Key接入DeepSeek
如果你已经有DeepSeek申请的API Key,且希望固定使用自己的密钥,可以选择「DeepSeek」选项卡,在对应输入框中粘贴你之前保存的API Key,并准确填写模型名称(比如 deepseek-v4-flash-vision-exp),最后点击“保存并应用”即可生效。


步骤4:验证运行状态
配置完成后,返回软件主界面,确认运行状态显示为「服务运行中」,接着点击「打开聊天」按钮。

在对话框内发送一条测试消息,比如“请介绍一下你自己”,或者直接上传一张图片问问“这张图里有什么”。如果模型能正常生成回复,说明已接入成功,就可以构建自己的AI应用了。

这次DeepSeek-V4-Flash-Vision-Exp的上线,标志着DeepSeek从纯文本大模型向多模态AI的战略升级。
感兴趣的开发者,现在就可以去下载OpenClaw部署助手,按照上面的步骤体验一番DeepSeek V4的视觉能力了。拍张照、传个图,让AI帮你干活的感觉,确实不一样。
最新资讯
DeepSeekV4视觉模型发布,多模态Agent能力逼近Opus-4.8DeepSeek V4视觉模型上线,多模态API服务正式开放。新模型纯文本能力不降,多模态Agent能力逼近Opus-4.8。图片输入转token计费,单张最高384 tokens,同步推出免费Files API。了解调用方式与应用场景。
2026-08-21 19:57:33lucky22787
DeepSeek-V4-Flash-Vision-Exp上线:多模态API怎么接入使用?DeepSeek-V4-Flash-Vision-Exp视觉模型正式上线,支持图文混合输入和多模态API调用。本文介绍该模型能力特点、API使用方式,以及如何通过OpenClaw部署助手快速接入DeepSeek-V4-Flash-Vision-Exp,打造多模态Agent应用。
2026-08-21 19:35:02kevin9985
致命躯壳2开荒攻略:新手前期怎么玩?快速入门技巧分享《致命躯壳2》新手开荒怎么玩?本文整理前期路线、躯壳选择、武器推荐、战斗技巧以及升级方法,同时介绍如何通过驱动人生更新显卡驱动,解决游戏掉帧、帧率低等问题,帮助玩家获得更流畅的游戏体验。
2026-08-21 14:49:00kevin19357