![]() |
DeepSeek-V4首款多模态模型权重开放,“睁眼”后追上Opus-4.8
类别:资讯动态_最新资讯 时间:2026/9/1 15:47:36 点击:247 标签:DeepSeek-V4-Flash DSpark Agent Hugging Face flash 推理 模型 权重 首款 视觉 官方 编码器 文字 文本 边界
]article_adlist在连续强化了推理、代码和Agent能力之后,DeepSeek终于为V4补上了视觉输入。8月31日上午,DeepSeek在Hugging Face开放了DeepSeek-V4-Flash-Vision-Exp模型权重,开发者可以直接下载模型权重并自行部署。而官方仓库除了模型文件,还包括视觉编码器和Aligner等组件的参考推理实现,并覆盖DFlash Attention、MoE、Hyper-Connections和DSpark等部分。就在10天前,DeepSeek正式对外公布V4-Flash-Vision-Exp模型,规模约3050亿参数。从名字里的“Exp”不难看出,这是V4系列首款实验性多模态模型,其建立在V4-Flash架构之上,通过加入视觉模块并继续训练,使模型获得处理图片的能力。在纯文本任务上,官方称V4-Flash-Vision-Exp与V4-Flash整体保持相近水平,主要区别是新模型能够识别照片内容、读取截图中的文字、分析图表,也可以把图片作为Agent工作流程的一部分,而不再只能依赖文字描述。DeepSeek展示的案例…
![]() |

