DSH 双引擎截图:思灵桌面壳内,全局快捷键/托盘打开全屏框选浮层(多显示器、逐屏像素级抓帧),选区定格后工具条就地画红框,一次确认送进输入框;纯 DSH(浏览器)下由输入框相机按钮经 getDisplayMedia 捕获屏幕,复用同一套单阶段框选+标注遮罩。均走官方附件通道。
dsh plugin add Max-Null/dsh-capture
已收录的 DeepSeek Harness 扩展 —— 按分类筛选、按能力搜索,直达每个插件的源码仓库。
DSH 双引擎截图:思灵桌面壳内,全局快捷键/托盘打开全屏框选浮层(多显示器、逐屏像素级抓帧),选区定格后工具条就地画红框,一次确认送进输入框;纯 DSH(浏览器)下由输入框相机按钮经 getDisplayMedia 捕获屏幕,复用同一套单阶段框选+标注遮罩。均走官方附件通道。
dsh plugin add Max-Null/dsh-capture
本地 Tesseract 识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
dsh plugin add maxwell-feng/dsh-tesseract-ocr
本地 Windows 引擎(Windows.Media.Ocr)识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
dsh plugin add maxwell-feng/dsh-windows-ocr
给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。
dsh plugin add MicroHEROX/dsh-koboldcpp-hands
把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地运行的 Unsloth Desktop(Unsloth Studio)服务器:unsloth_run 与 unsloth_vision 两个工具,纯 HTTP 客户端,不拉起也不持有任何进程。
dsh plugin add MicroHEROX/dsh-unsloth-hands
面向纯文本模型的免费视觉桥与生图:粘贴读图、GLM-4V-Flash 与 Gemini 引擎故障转移、modlens 同款结构化证据输出,并自动播种免费视觉模型路由。
dsh plugin add MJorgin/dsh-media-skills
DeepSeek Harness 视觉能力全家桶:vision_understand 工具(OpenAI 兼容视觉 API,默认免费智谱 GLM-4V-Flash)+ 粘贴/拖拽/按钮三入口识图。
dsh plugin add moon09300731/dsh-vision-tools
视觉增强的 DeepSeek 适配器:由视觉模型把图片描述成文字,纯文本 DeepSeek 模型再基于描述推理。
dsh plugin add NagasakiSoyo-ui/dsh-llm-deepseek-vision
让纯文本 DeepSeek 代理在同一会话内读图:委派给视觉子代理,发送时自动把图片转为文件路径。
dsh plugin add niuniuaba/dsh-subagent-vision
基于 macOS Vision Framework 的全本地识图插件:`ocr_image`(文字提取,表格结构+坐标)与 `view_image`(场景/人脸/二维码);web 输入框可直接粘贴多张图片,图片永不离开你的 Mac。
dsh plugin add niyongsheng/free-vision-skill
为纯文本 DeepSeek Harness 主模型搭视觉桥:自动从已配置模型中挑选多模态模型,通过 vision 工具把图片描述以纯文本返回。
dsh plugin add NormanFxxkingRockwell/dsh-auto-vision
在 DSH 网页中用 AI 操控鸿蒙手机:实时 H.264 投屏、触控与系统按键、hilog 日志,并让模型读屏、定位 UI 控件,再执行点击/长按/按键/输入。
dsh plugin add ns-zzj/dsh-hos-scrcpy
为纯文本 DeepSeek 提供原生图片上传体验:在 Web GUI 粘贴/拖入图片即以缩略图附件进入会话,发送前由 host 用免费智谱 GLM-4V-Flash 视觉 API(glm-4v-flash 降级链)读取并替换为文字描述,DeepSeek 据此回答,原图保留在聊天历史中。
dsh plugin add Okkay712/DSH-dseyes
DSH 轻量截图插件:轻——零依赖零二进制;摆——一键全屏、窗口排版、悬停吸附截取被遮挡窗口;自助——Agent 可自助截屏,传路径不传图,路径通用,接上 modlens(选装)一步读出结构化内容。
dsh plugin add paicat1/dsh-screenshot
多引擎文生图(OpenAI Images 与智谱 CogView 预设):按会话配额、引擎故障切换、凭证安全配置,结果卡片支持重新生成。
dsh plugin add PerryLink/dsh-draw
给纯文本主模型加可配置识图模型:vision_read_image 工具、输入框识图模型选择器,以及纯文本路由的图片自动转文字。
dsh plugin add poiuyjie/dsh-vision-opencode
为纯文本模型装上本地眼睛:eyes_render 在 Web 界面画布上绘制文字/图形/Mermaid,eyes_paste 接收用户粘贴的图片,eyes_ocr 用 Windows 自带 OCR 离线读文字,eyes_analyze 把像素解析成结构化数据,全程无需视觉模型。
dsh plugin add Renji004/dsh-omni-vision
为任意 DSH 路由装上眼睛:Web 输入框贴图按意图自动聚焦分析,视觉子代理代读��作区图片,原图可随时物化编辑。
dsh plugin add ruby1304/dsh-vision-subagent
让纯文本模型拥有视觉:describe_image 工具调用 dsh 模型列表中的视觉模型描述图片,走 harness 自身的 LLM 运行时。
dsh plugin add s3yf1337/dsh-easyvision
通过 inspect_image 工具将本地图片或 HTTP(S) 图片链接发送至配置的 OpenAI 兼容视觉端点,并将文字结果带回对话。
dsh plugin add Scorp1o117/dsh-tool-vision
视觉桥:贴图先经 deepseek-v4-flash-vision-exp 转写为文字,再交给纯文本的 deepseek-v4-pro 回答,零第三方依赖。
dsh plugin add ShaineDemo/dsh-vision-pro-bridge
在纯文本 DeepSeek 线路上开放贴图准入,用视觉 sidecar 把附件转成文字,原生视觉模型不改写。
dsh plugin add shinjiyu/dsh-plugin-multimodal
视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。
dsh plugin add siegfly/dsh-deepseek-vision
给纯文本模型的设计稿保真判定:`deepseek_vision` 工具从任意 OpenAI 兼容视觉路由借来一只眼,让模型判断实现与设计稿是否一致——并附上支撑该判定的基准(4 组夹具、23 处注入缺陷、逐格原始输出)与其依赖的提问纪律。
dsh plugin add sunxin-ai/dsh-design-qa
第 83 / 138 页
按分类或关键词筛选 —— 每一条都指向公开的 GitHub 项目。
命令按上游列表生成,实际包名请以各仓库 README 为准。
插件会以你的权限运行第三方代码 —— 先读源码再安装。
本目录是社区维护的 awesome-dsh-plugin 列表快照(更新于 2026-09-07)。插件名称与简介取自上游中英文双语列表;条目均链接到作者本人的仓库,收录不代表背书,也不等于安全审计。缺了某个插件?欢迎去上游列表提交。