这是什么
一座给纯文本编程 Agent 用的视觉桥。把图片粘进对话,modlens 会把它转成结构化的 JSON 证据——完整文字转录、按阅读顺序排列的版面区域、实体和关系——而不是让模型靠猜。
The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics).
它对设计意味着什么
- UI 截图变成逐元素的走查记录,Agent 可以直接照着行动。
- 信息密集的图表和数据可视化会被完整读出来:坐标轴、刻度、配色、高亮区域。
- 一次粘贴多张参考图,它会先识别出共同的视觉家族,再逐张描述。
包含哪些内容
- Highlights
- Installation
- Usage
- See it work
- Documentation
如何安装
modlens
-
在终端里运行这条命令。
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@latest -
重启 dsh web,让它加载这个插件。
-
然后描述你想要的设计,DeepSeek Harness 会自动用上插件提供的工具。
如何配合 DeepSeek Harness 使用
-
装上插件,模型选择器里会多出带 modlens 视觉的 DeepSeek-V4 变体。
-
把截图、样机或图表直接粘进对话。
-
对着结构化证据提设计问题,不用再费劲复述图里有什么。
这里的每个插件都可以免费安装,并附上真实的上游源地址。
在 DeepSeek Harness 仓库里了解更多 ↗下一步
用 NEXGERCORE 做设计,省掉那些配置
你可以自己装这个插件,也可以用 NEXGERCORE 在 DeepSeek Harness 外面套一整层精选设计层。自带 API Key,产出归你所有。