liustack

modlens

精选插件

The first vision plugin for DeepSeek Harness, and the vision bridge for every text-only coding agent. Paste an image, get structured JSON evidence (OCR, layout, semantics). | 全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

Stars 3.7k +14Forks 105许可证 MIT更新 2026/8/25

ModLens 是给纯文本编码智能体补充图像读取能力的视觉插件,主要面向 DeepSeek Harness,也可作为其他 Harness 的视觉桥接层。用户把图片粘贴到对话后,插件会提取 OCR、版面和语义信息并返回结构化证据。

它既支持把粘贴图片保存为临时文件后调用读取工具,也能为确认是纯文本的模型路由增加视觉包装入口。插件会跳过已有原生视觉能力的模型,不要求修改 Harness 配置或运行本地代理,并提供明确的输出契约供后续工具消费。

核心能力

  • 把粘贴的图片转成文件路径,再由 modlens_read_image 读取 OCR、版面和语义并返回结构化证据
  • 为元数据确认为纯文本的 DeepSeek 或 GLM 路由生成带 (modlens vision) 后缀的包装模型条目
  • 跳过已有原生视觉能力的型号,不改 Harness 配置、不跑本地代理进程
  • 多个 API 密钥用英文逗号分隔,鉴权、限流或配额失败时自动轮换

如何开始

  1. 1
    用 dsh 安装插件

    DeepSeek Harness 用户执行该命令添加插件,装完即可使用 modlens_read_image。

    npx -y @deepseek-ai/dsh plugin --profile web add @liustack/modlens@3.24.2
  2. 2
    对话中粘贴图片

    正常聊天时粘贴图片或给出路径并提问,skill 会把图片交给视觉引擎,后续追问同一张图不必再贴。

使用前确认

只有被元数据确认纯文本的模型才会被接管,确认不了的一律不动。需要可用的视觉引擎,复用本机 CLI 登录态会先征得同意。

Star 增长

3.1k → 3.7k Stars跨度 7 天 · 7 个快照点

数据来源:定期同步保存的 Star 快照;增长不构成质量、安全或官方背书。

GitHub Topics

agent-skillsclaude-codeclaude-skillscodexcordisdeepseekdshdsh-pluginglmharnessharness-engineeringhermes-agentimage-to-textmultimodalocropenclawpi-agenttext-only-llmvisionvision-transformer

相关项目

使用方式

该仓库不是已验证的可安装插件;请查看仓库 README 了解使用方式。

收录或清单确认都不等于本站验证。该项目因仓库添加了 dsh-plugin Topic 而自动进入目录。相关度与排查提示由公开信息自动生成,不构成质量、安全或官方背书;本站没有替你安装、运行或审核其兼容性和安全性。第三方项目可能在 Harness 进程中运行。请自行审查源代码、依赖、许可证、安装方式和权限;Star 数量不构成质量、安全或官方背书。