The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。
Stars 3.7k +14Forks 105许可证 MIT更新 2026/8/25
ModLens 是给纯文本编码智能体补充图像读取能力的视觉插件,主要面向 DeepSeek Harness,也可作为其他 Harness 的视觉桥接层。用户把图片粘贴到对话后,插件会提取 OCR、版面和语义信息并返回结构化证据。
它既支持把粘贴图片保存为临时文件后调用读取工具,也能为确认是纯文本的模型路由增加视觉包装入口。插件会跳过已有原生视觉能力的模型,不要求修改 Harness 配置或运行本地代理,并提供明确的输出契约供后续工具消费。
核心能力
- 把粘贴的图片转成文件路径,再由 modlens_read_image 读取 OCR、版面和语义并返回结构化证据
- 为元数据确认为纯文本的 DeepSeek 或 GLM 路由生成带 (modlens vision) 后缀的包装模型条目
- 跳过已有原生视觉能力的型号,不改 Harness 配置、不跑本地代理进程
- 多个 API 密钥用英文逗号分隔,鉴权、限流或配额失败时自动轮换
如何开始
- 1用 dsh 安装插件
DeepSeek Harness 用户执行该命令添加插件,装完即可使用 modlens_read_image。
npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.24.2 - 2对话中粘贴图片
正常聊天时粘贴图片或给出路径并提问,skill 会把图片交给视觉引擎,后续追问同一张图不必再贴。
使用前确认
只有被元数据确认纯文本的模型才会被接管,确认不了的一律不动。需要可用的视觉引擎,复用本机 CLI 登录态会先征得同意。
Star 增长
数据来源:定期同步保存的 Star 快照;增长不构成质量、安全或官方背书。
GitHub Topics
相关项目
收录或清单确认都不等于本站验证。该项目因仓库添加了 dsh-plugin Topic 而自动进入目录。相关度与排查提示由公开信息自动生成,不构成质量、安全或官方背书;本站没有替你安装、运行或审核其兼容性和安全性。第三方项目可能在 Harness 进程中运行。请自行审查源代码、依赖、许可证、安装方式和权限;Star 数量不构成质量、安全或官方背书。