将聊天图片交给固定的 OpenAI 兼容视觉模型,把事实性观察交给当前主模型,并在事件回放、上下文压缩和重启时复用会话内观察。
dsh plugin add 1HelloMan1/dsh-vision-fallback
已收录的 DeepSeek Harness 扩展 —— 按分类筛选、按能力搜索,直达每个插件的源码仓库。
将聊天图片交给固定的 OpenAI 兼容视觉模型,把事实性观察交给当前主模型,并在事件回放、上下文压缩和重启时复用会话内观察。
dsh plugin add 1HelloMan1/dsh-vision-fallback
注册 `deepseek-vision` 路由:Web GUI 直接粘贴图片,由免费智谱 GLM 视觉模型转译为文字后,再交给 DeepSeek 适配器作答。
dsh plugin add 314857493/dsh-vision#vision-route
给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。
dsh plugin add 314857493/dsh-vision#vision-tool
纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。
dsh plugin add 54xkeee/dsh-vision
纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。
dsh plugin add 54xkeee/dsh-youreyes
通过已配置的 DSH Provider 或 OpenAI 兼容端点提供图片输入与识别。
dsh plugin add alaxrpg/dsh-vision-bridge
面向视觉模型的内容感知 PDF 读取插件:逐页分析图(矢量与栅格)、表格、公式风险与双栏排版,基于内容识别进行混合提取,图表/公式页渲染成高 DPI 区域裁切。提供低清预览以理解页面概况并支持指定选区获取高清渲染。功能包装为多个工具供Agent使用。
dsh plugin add AngelosZou/dsh-pdf-reader
让纯文本模型处理视觉任务:粘贴图片后自动切换到 Vision Toolkit 变体,支持图片问答、多图比较、长截图 OCR、截图还原前端 UI、元素定位与像素对比。默认无需 API Key——图片经作者自建的免费服务处理,每台机器每天 100 张;也可改为指向自己的服务商。
dsh plugin add Anionex/dsh-vision-toolkit
屏幕截图与外部视觉识别:take_screenshot、list_windows、analyze_image、view_image 四个工具,可配置 GPT 视觉通道(gpt-5.5 / gpt-5.6-sol / gpt-5.6-terra),API Key 经凭据服务存储,带设置卡片;view_image 在 Web 对话中显示截图,模型上下文只保留文字。
dsh plugin add ankye/dsh-client-vision#tool-vision
面向模型的图像生成工具,提供可配置通道和标准化图像参数。
dsh plugin add ankye/dsh-image-generation#tool-image-generation
基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。
dsh plugin add AtropinolTT/dsh-guide-dog
为 DeepSeek Harness 原生视觉模型 deepseek-v4-flash-vision-exp 提供高清识图:将图片准入上限提升至 32 MiB / 8192 px / 600 张,并新增 highres_read 工具,将大图切为整图与 800x800 分块后经宿主 read_image 注入模型。
dsh plugin add azwosile/dsh-highres-vision
视觉桥:纯文本 DeepSeek 也能收图(单独发、图文混发均可),快速小识图模型后台描述,对话框里图还在、模型只见文字;纯插件,卸载即复原。
dsh plugin add balue8246-maker/dseyesopen
让 AI 助手看见并操作真实安卓手机:phone_look(视觉+UI 树融合判读)、点击/滑动/输入、截图——经 adb,适用于任何 MCP 客户端。
dsh plugin add boheastill/phone-eye
为 DSH 纯文本模型补充视觉能力:识图技能(图片理解/OCR/文档解析,竞速池→自定义通道→本地)+ 幂等宿主补丁,让图片消息能送达模型侧。
dsh plugin add br1nosense/dsh-vision-solution
为纯文本 DSH 模型增加可配置识图能力:开启后图片消息先由任意 OpenAI 兼容视觉模型转写为文字描述,再交给主模型处理;设置页可配置 Base URL、Model ID 与密钥。
dsh plugin add bug-huntter/dsh-vision-plugin
复用 DeepSeek 网页端识图模式给纯文本模型补上看图能力:deepseek_vision 工具调用本地 deepseek-vision-cli 浏览器自动化(手动登录助手、自动开启深度思考、用后自动关窗),把图片描述以文字返回给模型。
dsh plugin add Cheng-cheng9669/dsh-deepseek-vision
免费视觉识别插件:自适应切块长文档识别,支持历史收藏与 MD/Word/长图/Excel 导出。
dsh plugin add Ck-epsilon/aura-vision
接入 gemini.google.com 的 MCP 桥:图片/视频视觉识别、Imagen 生图、Veo 生视频与历史对话管理,复用浏览器登录态,无需 API Key。
dsh plugin add ConsoleSun/Gemini-Eyes
在 DSH 聊天窗口自动调用生图工具(API 渠道,或本机 CLI:已支持 mmx / codex / agy)并展示图片,也支持利用对应 CLI 识别图片。
dsh plugin add corrinehu/dsh-chat-imagine
让纯文本模型也能处理聊天贴图,提供原生视觉体验,支持批量看图,走内置 OpenAI 兼容识图工具 analyze_image;具备视觉能力的模型不受影响。
dsh plugin add dami9527/dsh-image-pathify
describe_image 模型工具:让纯文本模型通过视觉语言模型获得图像理解能力。
dsh plugin add DamonKoy/dsh-web-ui#dsh-tool-describe-image
面向 DSH Web GUI 的 AI 生图插件:通过可配置的 OpenAI 兼容端点(gpt-image-2 / gpt-image-1 / dall-e-3)实现文生图与图生图,提供 api_url/api_key 设置卡片与侧边栏分栏生图工作台。
dsh plugin add dickpy/dsh-imagegen
DeepSeek 视觉桥接:注册原生 LLM provider,聊天内粘贴的图片自动由视觉模型(pi-ai/llama.cpp 上的 Qwen3-VL)转成文字描述后交给纯文本 DeepSeek 作答——图片准入、路由与会话压缩全部走 harness 原生机制,带 LRU 描述缓存与 503 重试。
dsh plugin add Einskyle/dsh-llm-vision-bridge
第 1 / 5 页
按分类或关键词筛选 —— 每一条都指向公开的 GitHub 项目。
命令按上游列表生成,实际包名请以各仓库 README 为准。
插件会以你的权限运行第三方代码 —— 先读源码再安装。
本目录是社区维护的 awesome-dsh-plugin 列表快照(更新于 2026-09-07)。插件名称与简介取自上游中英文双语列表;条目均链接到作者本人的仓库,收录不代表背书,也不等于安全审计。缺了某个插件?欢迎去上游列表提交。