续报八月中旬Harness开源公测与rc.8多模态更新之后,本轮增量是把「能调用的视觉模型」与「外壳里的原生看图」钉在同一天发布节奏上。模型API有了、外壳读不了图,开发者仍要拆两套集成——DeepSeek用同日更新把这条缝补上。
DeepSeek Harness是DeepSeek面向开发者的开源Agent运行时,定位是把模型、工具、技能、会话与沙箱做成可替换插件。八月中旬前后,团队以MIT协议开放源码并推出v0.1开发者预览;rc.8已支持图文输入、子代理与Windows终端等能力。所谓原生图片请求,白话是让适配器直接按视觉模型的接口格式传图,而不是把图片临时转成纯文本描述再喂给模型——链路更短,信息损失通常更小。
8月21日,团队再次更新:DeepSeek模型适配器新增V4-Flash-Vision-Exp选项,并支持配置原生图片请求——与当日多模态API上线形成同日闭环。开发者可在同一Harness栈里切换文本与视觉实验模型,而不必拆两套集成。
升级清单里与视觉相关的边界:
可以把它想成:模型像新到的高清摄像头,Harness像机身卡口——卡口和镜头同一天到货,才谈得上「开箱就能拍」;否则开发者还得自己焊转接头。
产业观察上,模型与外壳同周迭代,是Agent基础设施从「拼模型」走向「拼栈」的信号。对试用方,仍要把实验模型标注、速率与失败恢复算进迁移清单;对企业,则关注预览版破坏性变更与存储不兼容提示是否写入升级手册。
需要把边界读清楚。Vision-Exp仍为实验性质;与API组合的稳定性和成本须按真实长会话复测。下一观察点是正式版视觉模型与Harness默认预设的合并节奏。