Awesome DeepSeek Harness Plugin

DeepSeek Harnessdsh)插件精选列表。

收录 0 个插件 · 什么是 DeepSeek Harness?↗

dsh-market —— 在 DeepSeek Harness 里直接逛并安装本列表全部插件
  1. 为纯文本模型架起视觉桥梁:粘贴图片,输出结构化 JSON 证据(OCR、版面、语义)。

    视觉与多模态
    安装 ▾
  2. 让纯文本模型更好地做视觉任务:带意图的图片问答、长截图 OCR、UI 还原等。

    视觉与多模态
    安装 ▾
  3. 为纯文本 Agent 提供视觉能力:内置免 Key 视觉链 + 像素级视觉工具(看图问答、定位、裁剪、像素对比、取色、OCR、矢量化、抠图、截图);粘贴图片即可用。

    视觉与多模态
    安装 ▾
  4. 外挂识图插件:鲸鱼按钮配置面板、图片识图自动回传、模型自主截图识图工具。

    视觉与多模态
    安装 ▾
  5. DeepSeek 大脑 + 自动识图:GUI 附加的每张图片自动经 OpenAI 兼容 VLM 转译成文字,再交给纯文本的 DeepSeek 作答——有 key 自动走快速通道(默认 qwen3.7-flash,支持百炼/智谱/OpenRouter 等任意 OpenAI 兼容端点),无 key 自动探测本地 Ollama(零配置,图片不出本机)。

    视觉与多模态
    安装 ▾
  6. 给纯文本模型装上眼睛:把用户图片转发给任意 OpenAI 兼容的视觉模型生成描述,并在 Web UI 右侧面板展示结果。

    视觉与多模态
    安装 ▾
  7. 接入 gemini.google.com 的 MCP 桥:图片/视频视觉识别、Imagen 生图、Veo 生视频与历史对话管理,复用浏览器登录态,无需 API Key。

    视觉与多模态
    安装 ▾
  8. 面向纯文本模型的免费视觉桥与生图:粘贴读图、GLM-4V-Flash 与 Gemini 引擎故障转移、modlens 同款结构化证据输出,并自动播种免费视觉模型路由。

    视觉与多模态
    安装 ▾
  9. 面向纯文本 DeepSeek 的视觉 MCP + DSH 插件:analyze_image / analyze_clipboard / compare_images / vision_status 四个工具、可视化配置页、默认免费 GLM-4.6V-Flash、结果缓存与限流容错,Key 不入日志。

    视觉与多模态
    安装 ▾
  10. DeepSeek 视觉桥接:注册原生 LLM provider,聊天内粘贴的图片自动由视觉模型(pi-ai/llama.cpp 上的 Qwen3-VL)转成文字描述后交给纯文本 DeepSeek 作答——图片准入、路由与会话压缩全部走 harness 原生机制,带 LRU 描述缓存与 503 重试。

    视觉与多模态
    安装 ▾
  11. 在纯文本 DeepSeek 线路上开放贴图准入,用视觉 sidecar 把附件转成文字,原生视觉模型不改写。

    视觉与多模态
    安装 ▾
  12. 输入框贴图自动识别:由 OpenAI 兼容视觉模型转成文字描述后,再交给纯文本 DeepSeek 模型处理。

    视觉与多模态
    安装 ▾
  13. 通过已配置的 OpenAI 兼容生图模型或本机 MiniMax CLI,在 DeepSeek Harness 对话中生成并展示图片。

    视觉与多模态
    安装 ▾
  14. 面向 DSH Web GUI 的 AI 生图插件:通过可配置的 OpenAI 兼容端点(gpt-image-2 / gpt-image-1 / dall-e-3)实现文生图与图生图,提供 api_url/api_key 设置卡片与侧边栏分栏生图工作台。

    视觉与多模态
    安装 ▾
  15. 把文本、识图和生图 API 组合成一个 Mix 模型并按对话内容自动路由:纯文本走聊天模型,用户图片和 Agent 截图走识图模型,后续可继续追问同一张图;还支持图片生成与编辑及会话级调用记录。

    视觉与多模态
    安装 ▾
  16. 给纯文本模型的"读图"能力:图片降分辨率+降色深+结构/色彩指纹渲染成文本网格喂回对话,模型像多模态一样自主缩放、取样、OCR 读图;纯本地零外部模型依赖,附读图方法论 skill 与可选 PaddleOCR。

    视觉与多模态
    安装 ▾
  17. 视觉增强的 DeepSeek 适配器:由视觉模型把图片描述成文字,纯文本 DeepSeek 模型再基于描述推理。

    视觉与多模态
    安装 ▾
  18. 基于 macOS Vision Framework 的全本地识图插件:`ocr_image`(文字提取,表格结构+坐标)与 `view_image`(场景/人脸/二维码);web 输入框可直接粘贴多张图片,图片永不离开你的 Mac。

    视觉与多模态
    安装 ▾
  19. 极简的原生视觉能力增强,支持免费的智谱模型或本地千问视觉模型。

    视觉与多模态
    安装 ▾
  20. DeepSeek Harness 统一生图路由:自动识别任意 OpenAI 兼容端点的绘图模型(商汤、阶跃、Agnes、千问、Flux、SD、Imagen 等),提供 Agent 工具与 REST API。

    视觉与多模态
    安装 ▾
  21. 纯文本 DeepSeek 的识图插件:默认走豆包 Web(零成本、免 API key,经 Windows CDP 桥接驱动已登录 Chrome),另有反重力额度(flash/pro)与 Gemini 降级通道;档位自动升级、视觉证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

    视觉与多模态
    安装 ▾
  22. 纯文本 DeepSeek 的识图工具包:模型可主动调用的 `vision` 工具、deepseek/opencode-go 包装适配器(v4 flash/pro)、反重力额度(默认,flash/pro)/ 任意 OpenAI 兼容 VLM / Gemini / 本地 Ollama 通道、证据记忆与会话压缩恢复、内容哈希缓存、双语客户端面板。

    视觉与多模态
    安装 ▾
  23. 通感编码器(Synesthesia Encoder):调用视觉模型把图片翻译成紧凑的结构化空间文字(画布/元素/百分比坐标),让纯文本 LLM 获得像素级看图能力(`mm_vision` 工具)。

    视觉与多模态
    安装 ▾
  24. 免费视觉插件:纯文本模型看图 / OCR / UI / 报错分析,优先免费模型(千问 Qwen3-VL-Flash、豆包、DeepSeek-OCR),设置界面可配置。

    视觉与多模态
    安装 ▾
  25. 本地优先的结构化视觉插件:图片交给本地 OpenAI 兼容 VLM,返回 JSON 证据(摘要、逐字 OCR、版面区域、实体/关系、配色、显式不确定项),带反幻觉回退与可选粘贴/上传桥;零云端成本,图片不出本机。

    视觉与多模态
    安装 ▾
  26. 让 dsh 通过 grok2api 的 API 获得生成图片与视频能力。

    视觉与多模态
    安装 ▾
  27. 给在线模型装上本地双手:koboldcpp_run 与 koboldcpp_vision 工具把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地 KoboldCpp(llama.cpp)服务器,并按需拉起与管理服务器生命周期。

    视觉与多模态
    安装 ▾
  28. 视觉语言网关:注册支持图片输入的 DeepSeek provider 路由,图片先由可配置 VL 模型(默认 Qwen-VL)描述成文字再发送。

    视觉与多模态
    安装 ▾
  29. Agent 可调用的视觉工具:通过你配置的任意 OpenAI 兼容视觉端点描述本地图片,支持多模型交叉核对,不内置任何密钥。

    视觉与多模态
    安装 ▾
  30. 纯文本 DeepSeek 的聊天识图插件:view_image 工具转发任意 OpenAI 兼容 VLM(本地 Ollama 或云端),对话框粘贴/拖拽的图片自动改写为 view_image 路径标记供模型查看。

    视觉与多模态
    安装 ▾
  31. 图片转文字输入插件:粘贴/拖拽图片自动转为结构化文字描述发送,给纯文本 LLM 提供图片输入接管(OpenAI 兼容视觉 API)。

    视觉与多模态
    安装 ▾
  32. 纯文本路由的透明图片护栏:贴图不再 400 卡死会话,附带 vision_analyze 工具(OCR/PDF/docx/pptx/视频)。

    视觉与多模态
    安装 ▾
  33. 纯文本模型双层识图:优先本地快速 OCR(RapidOCR,离线),不足时回落视觉模型(modlens)。

    视觉与多模态
    安装 ▾
  34. 视觉模型路由:把附加图片经可配置模型(15+ OpenAI 兼容与 Anthropic 供应商)转译为文字,对话仍由 DeepSeek 作答。

    视觉与多模态
    安装 ▾
  35. GPT Image 2 `image_gen`:默认复用 Codex 订阅 OAuth,也可显式使用 API Key;显影卡片、最多 3 张 API 实时局部图、持久附件回放/灯箱/下载、纯文本模型输出和受限的凭据安全请求。

    视觉与多模态
    安装 ▾
  36. 把重复的文本与视觉(OCR、图像分析、对比)劳动交给本地运行的 Unsloth Desktop(Unsloth Studio)服务器:unsloth_run 与 unsloth_vision 两个工具,纯 HTTP 客户端,不拉起也不持有任何进程。

    视觉与多模态
    安装 ▾
  37. 让纯文本 DeepSeek 代理在同一会话内读图:委派给视觉子代理,发送时自动把图片转为文件路径。

    视觉与多模态
    安装 ▾
  38. 纯文本模型的视觉补全:vision_agent 工具把读图委托给可配 MiniMax/Kimi 路由的一次性子代理,另有 Codex 式输入框粘贴桥——图片在隔离上下文分析,只有文本进入主会话。

    视觉与多模态
    安装 ▾
  39. 让纯文本模型拥有视觉:describe_image 工具调用 dsh 模型列表中的视觉模型描述图片,走 harness 自身的 LLM 运行时。

    视觉与多模态
    安装 ▾
  40. `describe_image` 视觉桥:经 opencode Zen API(凭据 `OPENCODE_GO_API_KEY`,免费线路优先、付费兜底)把图片发给 mimo-v2.5、返回文字描述给纯文本模型,原生格式直发,SVG/TIFF/HEIC 等格式经 ImageMagick 自动转码。

    视觉与多模态
    安装 ▾
没有匹配的插件。

安装

# npm 包(预构建)
dsh plugin --profile web add <npm-package>

# GitHub 源码(首次需按提示配置 allowBuilds 构建授权后重试)
dsh plugin --profile web add github:owner/repo

装任何插件都等于在你的机器上跑第三方代码,权限和你本人一样大——能读你的文件、用你的凭据、访问网络,工具审批管不到它。GitHub 来源的插件还会在安装时执行构建脚本。请只安装可信来源,并尽量锁定 commit(github:owner/repo#sha)。

收录你的插件

awesome-dsh-plugin 提一个 PR:在每个 README 语言文件中各加一行,网站会自动同步。也请为你的仓库打上 dsh-plugin topic。