DeepSeek 新视觉模型曝光

DeepSeek 全新视觉模型 deepseek-v4-flash-vision-exp 浮出水面,社区已通过 API 跑通,支持直接传图提问。

关键信号

  • 今日,DeepSeek Harness 已将该模型加入默认模型目录,明确标记支持图片输入

  • 对应代码 PR 标题为「publish the vision model」

  • 官方尚未正式官宣,API 文档暂未更新


早有伏笔

两天前,Harness RC.8 已为官方适配器补上原生图片输入,实现笔记中出现该模型名,但未列入默认目录,称需等模型端点就绪。

今日 Harness v0.1.1-rc.1 正式移除限制,将 deepseek-v4-flash-vision-exp 列为默认视觉模型。

背景

DeepSeek 网页和 App 已上线识图模式,视觉团队此前基于 V4-Flash 的研究,将点和边界框直接插入推理链,实现视觉 CoT 推理。新模型发布在即。