最近在折腾DeepSeek Harness,它“一切皆插件”的玩法确实有意思,不用改底层代码,装几个插件就能把体验拉起来。看了下各种小视频都推荐的插件,都在说“ModLens”视觉插件,给dsh一双眼睛,但真的好用吗?
DeepSeek Harness插件安装必备要素(必须全局安装pnpm和git)
检查pnpm和git是否安装
pnpm
pnpm -v #没出现版本就下一条命令安装npm install -g pnpm #全局安装pnpm
git
git -v #没出现版本就搜索适合系统的git安装
ModLens:给纯文本模型加个“眼睛”
DeepSeek本身只能处理文字,遇到截图、UI稿、流程图就只能干瞪眼。ModLens是目前DSH生态里最火的视觉插件,人人都推荐。 装完之后直接把模型变成了“图文通吃”。
核心功能:粘贴图片就能自动输出结构化JSON,包含OCR文字、页面布局、语义关系,甚至能识别图片的主色调和风格。
小提示:如果图片分辨率太高,建议设置
--image-resolution 1080,避免上下文溢出;做UI转代码时可以关掉OCR预识别,防止干扰生成逻辑。
重点来了,如何安装这个 DSH 插件?
1.复制下面的命令,在 DeepSeek Harness 终端中运行即可。
dsh plugin --profile web add github:liustack/modlens
2.重启DSH检查插件安装情况

3.如何使用
未使用插件前:返回模型不支持图片
使用插件后



哈哈哈,忘记配置Gemini API Key ,等我有了Key再测试(玩AI都是Money啊)
结语
说实话,亲身用下来挺好玩的,第一感觉识别挺慢。如果你也在玩DeepSeek Harness,不妨试试亲身体验一下,不必看到小视频就感到技术的焦虑,也可以感受一下“一切皆插件”的魅力。
夜雨聆风