2026 年 8 月 21 日——DeepSeek 于 8 月 21 日接连发布 Agent 工具 DeepSeek Harness 的 v0.1.1-rc.1 与 v0.1.1-rc.2 两个预览版本:rc.1 为 DeepSeek 模型适配器新增官方多模态视觉理解模型 deepseek-v4-flash-vision-exp 的调用支持,rc.2 进一步将图像上传链路切换为优先通过 Files API 并复用已上传文件。经 GitHub Releases 与 npm registry 双源核实,该消息属实。
据 npm registry 官方数据,@deepseek-ai/dsh 包的最新标签(latest)已指向 0.1.1-rc.2;据 GitHub 仓库页面显示,deepseek-ai/deepseek-harness 仓库当前星标数约 18.2 万、复刻数约 1.99 万,两个版本均标注为预发布(Pre-release)。
1. 版本核实信息
以下信息整理自 GitHub Releases 页面与 npm registry(截至 2026 年 8 月 21 日):
| 项目 | v0.1.1-rc.1 | v0.1.1-rc.2 |
|---|---|---|
| 发布日期 | 2026 年 8 月 21 日 | 2026 年 8 月 21 日 |
| 版本类型 | 预发布(Pre-release) | 预发布(Pre-release) |
| 发布者 | imccyu | imccyu |
| 对应提交 | 528c682 | b150a55 |
| 核心变更 | 适配器新增官方视觉模型支持 | 图像上传与预处理链路优化 |
2. v0.1.1-rc.1:接入官方视觉模型
据 GitHub Release 说明,rc.1 的新增功能为"DeepSeek 适配器新增多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp"。本站已将本地环境升级至 v0.1.1-rc.2 实测确认:适配器默认模型目录即包含该视觉模型,与 deepseek-v4-flash、deepseek-v4-pro 并列公布,三者的上下文窗口均为 1M tokens;视觉模型条目显式声明 inputModalities: [text, image]。用户在会话中可直接选用该模型,无需手动修改适配器配置。
同期版本还包含以下变更(据 Release 说明):
- 问题修复:修复输入框内
@引用前增删改文本时的潜在布局问题;修复 Bubblewrap 沙箱内受限进程可经/proc/<pid>/root绕过限制的问题。 - 体验优化:优化会话中 Markdown 表格的自适应表现、缓存命中率处于 99.x% 区间时的精度显示、子代理会话标题切换交互;
ask_user_question回答内容支持多行输入、自动换行与 Shift+Enter 换行。
3. v0.1.1-rc.2:图像链路优化
rc.2 在 rc.1 基础上聚焦图像输入体验,据 Release 说明包含两项优化:
- Files API 上传优先:DeepSeek 适配器发送图像时优先通过 Files API 上传,并可复用已上传文件,同一图片多次引用时避免重复传输;
- 图像预处理优化:根据模型要求自动缩放图像并转换为合适格式后再提交请求。
本站据升级后本地环境的适配器随包文档与源码核实了具体实现:图像预处理按总像素预算等比缩放(默认 640,000 像素,例如 2048×1024 的图片会缩放至约 1130×565 后提交,不做正方形裁切),编码格式按图片特征自动选择——低色数图片先尝试 PNG,其余依次尝试质量 85 与 80 档的 WebP 或 JPEG;通过 Files API 上传的图片默认有效期为 7 天,临近过期会自动更换文件 ID,并发生成任务共享同一次上传,上传失败或超时会自动回退为 base64 内联方式;单次请求默认最多保留 600 张图片或 128 MiB 图像数据,超出时从最旧的图片开始省略。
上述优化与 DeepSeek API 视觉模型的计费规则相衔接:据官方文档,图像按尺寸转换为 token 后计入输入费用,单张图片消耗上限为 384 tokens,Files API 单图最大支持 64 MiB。
4. 背景:多模态支持的三步落地
Harness 的多模态能力并非首次出现。据本站此前报道,8 月 19 日发布的 v0.1.0-rc.8 已增强多模态支持度,允许 DeepSeek 适配器配置启用原生图片请求,其配置文件中出现 private-vision 模型条目,社区随后在源码中发现 deepseek-v4-flash-vision-exp 这一模型 ID;8 月 21 日,DeepSeek API 平台正式上线该视觉实验模型。至此,从配置预留、API 上线到 Harness 适配器默认接入,官方视觉模型的完整调用链路已经打通。
已安装用户可通过以下命令升级至最新预览版本:
npm install -g @deepseek-ai/dsh@latest
举手提问