全部插件
结果
-
已收录
Bundle 已验证
为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。
dsh plugin --profile default add github:ysr666/dsh-vision-router -
已收录
Bundle 已验证
给纯文本模型的"读图"能力:图片降分辨率+降色深+结构/色彩指纹渲染成文本网格喂回对话,模型像多模态一样自主缩放、取样、OCR 读图;纯本地零外部模型依赖,附读图方法论 skill 与可选 PaddleOCR。
dsh plugin --profile default add github:jing-hy/picturereader -
已收录
Bundle 已验证
外挂识图插件:鲸鱼按钮配置面板、图片识图自动回传、模型自主截图识图工具。
dsh plugin --profile default add github:linenxi-ctrl/dsh-vision -
已收录
Bundle 已验证
DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经 OpenAI 兼容 VLM 转译成文字,再交给纯文本的 DeepSeek 作答——有 key 自动走快速通道(默认 qwen3.7-flash,支持百炼/智谱/OpenRouter 等任意 OpenAI 兼容端点),无 key 自动探测本地 Ollama(零配置,图片不出本机)。
dsh plugin --profile default add github:Flyvhidbwo/dsh-vision-proxy -
已收录
Bundle 已验证
本地 Windows 引擎(Windows.Media.Ocr)识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
dsh plugin --profile default add github:maxwell-feng/dsh-windows-ocr -
已收录
Bundle 已验证
在 DSH 聊天窗口自动调用生图工具(API 渠道,或本机 CLI:已支持 mmx / codex / agy)并展示图片。
dsh plugin --profile default add github:corrinehu/dsh-chat-imagine -
已收录
Bundle 已验证
基于 MiniMax 的多模态插件:实时语音通话模式(流式对话、悬浮胶囊 UI)、语音模式与麦克风语音输入,并提供图像/视频/音乐/语音生成与视觉检查工具。
dsh plugin --profile default add github:AtropinolTT/dsh-guide-dog -
已收录
Bundle 已验证
DeepSeek 视觉桥接:注册原生 LLM provider,聊天内粘贴的图片自动由视觉模型(pi-ai/llama.cpp 上的 Qwen3-VL)转成文字描述后交给纯文本 DeepSeek 作答——图片准入、路由与会话压缩全部走 harness 原生机制,带 LRU 描述缓存与 503 重试。
dsh plugin --profile default add github:Einskyle/dsh-llm-vision-bridge -
已收录
Bundle 已验证
输入框贴图自动识别:由 OpenAI 兼容视觉模型转成文字描述后,再交给纯文本 DeepSeek 模型处理。
dsh plugin --profile default add github:ximengxiaolan/dsh-vision-bridge -
已收录
Bundle 已验证
本地 Tesseract 识别附加图片:只把识别出的文字发送给模型,图片字节不进入上下文;视觉直通可选开启。
dsh plugin --profile default add github:maxwell-feng/dsh-tesseract-ocr -
已收录
Bundle 已验证
DeepSeek Harness 视觉能力全家桶:vision_understand 工具(OpenAI 兼容视觉 API,默认免费智谱 GLM-4V-Flash)+ 粘贴/拖拽/按钮三入口识图。
dsh plugin --profile default add github:moon09300731/dsh-vision-tools -
已收录
Bundle 已验证
免费视觉插件:纯文本模型看图 / OCR / UI / 报错分析,优先免费模型(千问 Qwen3-VL-Flash、豆包、DeepSeek-OCR),设置界面可配置。
dsh plugin --profile default add github:FuzzySoul/dsh-free-vision -
已收录
Bundle 已验证
DeepSeek Harness 统一生图路由:自动识别任意 OpenAI 兼容端点的绘图模型(商汤、阶跃、Agnes、千问、Flux、SD、Imagen 等),提供 Agent 工具与 REST API。
dsh plugin --profile default add github:xiaozhe7772222/dsh-draw-router -
已收录
Bundle 已验证
通过 DashScope OpenAI 兼容视觉接口提供 image_describe 识图工具;在纯文本模型会话中,将粘贴图片保存为模型可读取的本地路径,并在聊天记录中回显图片。
dsh plugin --profile default add github:wanshichenguang/dsh-tool-vision -
已收录
Bundle 已验证
314857493/dsh-vision#vision-route: 注册 `deepseek-vision` 路由:Web GUI 直接粘贴图片,由免费智谱 GLM 视觉模型转译为文字后,再交给 DeepSeek 适配器作答。 314857493/dsh-vision#vision-tool: 给 DeepSeek Harness 的纯文本模型补上免费识图:`vision` 工具直连智谱 GLM 视觉 API 描述/OCR 图片文件(glm-4v-flash 降级链),无需任何外部 CLI。
dsh plugin --profile default add dsh-vision-proxy-route -
已收录
Bundle 已验证
复用 DeepSeek 网页端识图模式给纯文本模型补上看图能力:deepseek_vision 工具调用本地 deepseek-vision-cli 浏览器自动化(手动登录助手、自动开启深度思考、用后自动关窗),把图片描述以文字返回给模型。
dsh plugin --profile default add github:Cheng-cheng9669/dsh-deepseek-vision -
已收录
Bundle 已验证
为纯文本 DeepSeek 模型提供按需视觉:上传图片后,模型通过 view_image 工具调用任意 OpenAI 兼容视觉端点(默认 Qwen/DashScope)。
dsh plugin --profile default add github:Leeminjing/dsh-eyes -
已收录
Bundle 已验证
让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。
dsh plugin --profile default add github:lsjspl/dsh-plugin-grok2api-media-tool -
已收录
Bundle 已验证
本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。
dsh plugin --profile default add github:gloryxpnv/dsh-tool-vision -
已收录
Bundle 已验证
通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。
dsh plugin --profile default add github:Elohia/dsh-plugin-mm-vision