DeepSeek Harness v0.1.1:Files API 图片上传、沙箱加固与视觉模型落地
August 26, 2026
• 共 503 字
• 阅读约 3 分钟
DeepSeek Harness 已经越过 0.1.0。v0.1.1 这周以两个 release candidate 落地,是一组紧凑而聚焦的更新:视觉模型接入适配器、图片处理更省、还修复了一个实打实的沙箱逃逸。
视觉模型接入适配器
rc.1 给 DeepSeek 适配器加上了 DeepSeek-V4-Flash-Vision-Exp——就是同周在 API 上线的那个多模态视觉模型。这补上了「API 能做视觉」和「Harness 真的能用」之间的缺口。原生图片输入现在有了一个一等公民的模型在背后撑着。
图片发送更省了
rc.2 从两头调优了图片管线:
- Files API 优先:适配器现在优先通过 Files API 上传图片,并复用已上传的文件。同一张截图发给十个请求,只上传一次。
- 自动预处理:图片会按模型需要自动缩放、转成合适格式——不用再为超大载荷付费,也不用再调试格式不匹配。
对那些 agent 真的要跟截图、文档打交道的用户来说,这就是「视觉能用」和「视觉用得起」的区别。
一个实打实的沙箱逃逸,修掉了
rc.1 里最被低估的一行是安全修复:Bubblewrap 沙箱里的受限进程,可以通过 /proc/<pid>/root 逃出限制。这不是理论上的挑刺——这直接关系沙箱的本职,现在补上了。
这是个有用的提醒:Harness 的安全能力正在「加功能」的同一次发布里被持续加固——这也是为什么「保持最新」很重要。
其余小改进
ask_user_question支持多行回答、自动换行和Shift+Enter。- 会话里的 Markdown 表格自适应。
- 99.x% 缓存命中率的精度显示修复。
结论
v0.1.1 不是那种上头条的大版本——它是那种让框架「日常好用」的版本:视觉模型接好了、图片成本降了、沙箱更紧了。如果你还在 rc.8,这次升级基本只有好处。