图片转文字输入插件:粘贴/拖拽图片自动转为结构化文字描述发送,给纯文本 LLM 提供图片输入接管(OpenAI 兼容视觉 API)。
dsh plugin add Elohia/dsh-plugin-image-input
已收录的 DeepSeek Harness 扩展 —— 按分类筛选、按能力搜索,直达每个插件的源码仓库。
图片转文字输入插件:粘贴/拖拽图片自动转为结构化文字描述发送,给纯文本 LLM 提供图片输入接管(OpenAI 兼容视觉 API)。
dsh plugin add Elohia/dsh-plugin-image-input
通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。
dsh plugin add Elohia/dsh-plugin-mm-vision
为 DeepSeek Harness 接入 Labnana 图片生成:文生图 / 图生图 / 精准编辑,含积分预估、余额查询与网页设置界面。
dsh plugin add exoticknight/dsh-labnana
让 DeepSeek Harness 的 Agent 直接驱动本地或远程 ComfyUI:comfyui_run / comfyui_object_info / comfyui_workflow 工具生成与编辑图像、视频,附带工作流库(图工作流提取:按分量 / 主流程 / 整体)、加载区分辨率自动匹配、实时队列、SDXL 与 Wan 2.1 模板、配套 skill 与同源媒体代理。
dsh plugin add fandc520/dsh-comfyui
DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经官方 deepseek-v4-flash-vision-exp 原生识图转译,再交给纯文本的 DeepSeek 作答(纯文本 V4-Pro 也能看图);支持任意 OpenAI 兼容 VLM 与本地 Ollama 作为备选。
dsh plugin add Flyvhidbwo/dsh-vision-proxy
免费视觉插件:纯文本模型看图 / OCR / UI / 报错分析,优先免费模型(千问 Qwen3-VL-Flash、豆包、DeepSeek-OCR),设置界面可配置。
dsh plugin add FuzzySoul/dsh-free-vision
本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。
dsh plugin add gloryxpnv/dsh-tool-vision
纯文本路由的透明图片护栏:贴图不再 400 卡死会话,附带 vision_analyze 工具(OCR/PDF/docx/pptx/视频)。
dsh plugin add good-boy4069/dsh-vision-guard
将图片交给所选的视觉模型处理(自动改写、显式工具或混合模式),使纯文本聊天模型也能处理包含图片的对话。
dsh plugin add GooDAnDReaDY/dsh-vision-bridge
面向纯文本 DeepSeek 的视觉 MCP + DSH 插件:analyze_image / analyze_clipboard / compare_images / vision_status 四个工具、可视化配置页、默认免费 GLM-4.6V-Flash、结果缓存与限流容错,Key 不入日志。
dsh plugin add GOU-GEE/deepseek-vision#plugins/dsh-plugin-deepseek-vision
将会话图片转交可配置视觉服务,并向符合条件的 DeepSeek Harness 模型路由返回纯文本分析。
dsh plugin add GXX182/dsh-vision-bridge
把文本、识图和生图 API 组合成一个 Mix 模型并按对话内容自动路由:纯文本走聊天模型,用户图片和 Agent 截图走识图模型,后续可继续追问同一张图;还支持图片生成与编辑及会话级调用记录。
dsh plugin add haiziyao/dsh-vision-mix
DeepSeek Harness 图像理解插件:8 种分析模式(描述、OCR、图表取数、UI 评审、目标检测、对比、代码生成、诊断),支持任意 OpenAI/Anthropic 兼容视觉 API,内置免费视觉模型与限流自动切换。
dsh plugin add Harvey-Will/dsh-vision-analysis
苹果设备端 Vision 工具:本地 OCR(含中文)、图像分类、人脸检测、文档版面分析与综合描述,100% 离线、无需 API key,支持长截图切片。
dsh plugin add Harzva/dsh-maclens
DSH 的本地微信 OCR 工具:`wechat_ocr_recognize` 针对本地图片路径返回识别文本和引擎的结构化结果。
dsh plugin add hawkhai/wechat-ocr
DSH 的本地 Windows 11 OneOCR 工具:`oneocr_recognize` 返回 OCR 文本,以及包含行/词多边形、置信度、旋转角度和手写体样式的结构化结果。
dsh plugin add hawkhai/win11-oneocr
为纯文本 DeepSeek 路由提供视觉桥接:通过可配置的 OpenAI Responses、Chat Completions 或 Anthropic Messages 端点分析附件与本地图片,同时保持支持图片的路由走原生路径。
dsh plugin add Hyp6666/dsh-open-eyes
通过模式化提示分析对话图片(描述、UI、文档、定位、拓扑等),将含坐标原语(框、点、引用)的结构化证据以文本注入上下文,会话级缓存跨回放与压缩复用。
dsh plugin add InkshadeWoods/dsh-tool-visual-primitives
纯文本模型双层识图:优先本地快速 OCR(RapidOCR,离线),不足时回落视觉模型(modlens)。
dsh plugin add Isanti2016/dsh-quicksight
给纯文本模型的"读图"能力:图片降分辨率+降色深+结构/色彩指纹渲染成文本网格喂回对话,模型像多模态一样自主缩放、取样、OCR 读图;纯本地零外部模型依赖,附读图方法论 skill 与可选 PaddleOCR。
dsh plugin add jing-hy/picturereader
纯文本模型的透明多模态路由:每一次模型调用里的每张图片先由你自己配置的多模态理解模型全量转述(逐字 OCR、数据、不确定区、防注入),vision_relook 定点复看,图片类报错自动转述重试。不内置端点、不借登录态。
dsh plugin add jmxsxwyzjdwl/dsh-mmroute
纯文本 dsh 模型的识图插件:粘贴图片自动由你配置的多模态模型转成文字——透明孪生路由、模型可自主调用识图工具、无内置密钥与中转。
dsh plugin add Junkrat9527/dsh-autovision
给纯文本模型装上眼睛:把用户图片转发给任意 OpenAI 兼容的视觉模型生成描述,并在 Web UI 右侧面板展示结果。
dsh plugin add jyh20030112/dsh-visual-plugin
按需自动把 DeepSeek 路由切到视觉模型:flash 主会话直接切(A),pro 保持深推理并交给视觉子代理读图(B),子代理恒切,含失败回退,无需手动切模型。
dsh plugin add k2d5rqjpkg-art/dsh-auto-vision
第 2 / 5 页
按分类或关键词筛选 —— 每一条都指向公开的 GitHub 项目。
命令按上游列表生成,实际包名请以各仓库 README 为准。
插件会以你的权限运行第三方代码 —— 先读源码再安装。
本目录是社区维护的 awesome-dsh-plugin 列表快照(更新于 2026-09-07)。插件名称与简介取自上游中英文双语列表;条目均链接到作者本人的仓库,收录不代表背书,也不等于安全审计。缺了某个插件?欢迎去上游列表提交。