兄弟们,DeepSeek Harness 的生态还在加速。
上一次写的时候才3000多个插件, 才过了几天, 已经有人整理出了18个分类的精选清单, 而且还在疯狂增长。
今天给大家带来两个DSH生态的重磅内容: 一个是全品类精选插件清单(收藏向), 一个是目前评分最高的视觉插件(深度向)。
清单党和技术党,都能找到你要的。
先说这个清单——0xsline/awesome-deepseek-harness, 创建才6天,已经675星、238个fork。
这不是随便列几个插件的水清单, 而是从官方Hub和GitHub dsh-plugin话题里精挑细选出来的, 分了整整18个大类, 可以说是目前DSH生态最全面的导航了。

说真的,18个分类这个数量已经很说明问题了—— DSH的生态不是只有几个玩具插件, 而是已经形成了完整的产业链, 从核心到外围、从工具到安全、从开发到运维, 每个环节都有人在做。
重点来了。
DSH生态目前评分最高的插件, 不是什么效率工具, 而是一个给纯文本模型装眼睛的视觉工具箱。
插件名:dsh-vision-toolkit评分:94分(dshfind 最高评分插件)创建时间:2026-08-13 星数:595⭐协议:MIT如果你在DSH里用DeepSeek或者其他纯文本模型, 大概率遇到过这些问题:
1.截图看不懂:发个截图,模型只能大概描述,说不准 2.按钮点不对:想让Agent点个按钮,它不知道坐标在哪 3.UI还原不准:生成的页面"差不多",但差多少说不清楚 4.长截图OCR:长截图里的文字提取不全
说白了就是——纯文本模型是个"瞎子",看不见图片里的信息。
这个插件就是给它配了一副眼镜。
1. 图片问答(带意图理解) 不是简单的"图里有什么", 而是带着你的意图去理解图片。 比如你发一张网页截图,问"这个页面的登录按钮在哪", 它不只是描述图片,而是直接回答你的问题。
2. 长截图 OCR 长截图里的文字提取, 比普通OCR准很多, 因为它不只是识别文字, 还能理解上下文结构。
3. UI 还原 给一张设计稿截图, Agent能还原成代码, 而且能量化评估还原度—— 不是"差不多",而是"差了多少像素"。
4. 像素对比 两张图差在哪? 用像素级对比直接给你标出来, 做UI还原、页面监控特别有用。
5. Artifacts 支持 直接在DSH里展示可视化结果, 不用切来切去。
6. Web UI 操作 支持Web端的视觉任务, 找按钮、填表单、截图对比…… 相当于给Agent装了个"眼睛+手"。
这个插件不是自己训练了个视觉模型, 而是做了一件更聪明的事:把图片信息翻译成文本模型能懂的语言。
打个比方:
普通方案是"你自己看吧"(把图片直接丢给模型) 这个方案是"我帮你把图里的东西讲清楚"(结构化提取后给模型)
就像一个翻译官, 把视觉信息翻译成文本模型能理解的结构化描述, 包括坐标、颜色、文字、布局关系等等。
这样一来, 即使是纯文本模型, 也能精准完成视觉任务。
这不是一个普通的"好用的插件", 而是补齐了DSH的一个核心短板。
Agent要真正能干实事, 光会聊天、会写代码是不够的, 它必须能感知和操作真实世界的界面—— 网页、APP、桌面……
视觉能力就是这个入口。
有了视觉, Agent才能:
看懂你发的截图 操作网页上的按钮 还原设计稿 做UI自动化测试 完成各种"需要用眼睛看"的任务
这是从"文本助手"到"全能助手"的关键一步。
两个项目都很容易装, 给大家整理好了:
github.com/0xsline/awesome-deepseek-harnessdsh install @anionex/dsh-vision-toolkitnpx -y @anionex/dsh-vision-toolkit这两个项目放在一起看, 能读出一些有意思的信号:
如果你已经在用DSH, 或者正准备试试:
✅ 新手建议先从核心预设开始, 不用一个个插件折腾, 装个预设包直接用。✅ 进阶用户按需求加插件:写代码多 → 加Git和工程类 做设计多 → 加视觉工具 追求好看 → 加UI主题 喜欢折腾 → 试试Agent编排
DSH的生态发展速度, 说实话超出了我的预期。
以前说"一切皆插件"觉得是个口号, 现在看真有人在一件件落地。 从核心功能到边缘工具, 从效率提升到趣味玩法, 整个生态在以肉眼可见的速度丰富起来。
这可能就是开放插件生态的魅力—— 官方搭好台子, 所有人都能上台表演。
你在用DSH吗?装了哪些好插件? 评论区聊聊,互相种草~
如果这篇对你有帮助, 记得收藏起来, 以后找插件不用到处翻了👇
觉得文章有用?欢迎点赞、在看、转发三连支持~
关注「AI源探索」,获取更多AI科技干货
夜雨聆风