Eyes for text-only DeepSeek Harness agents: built-in free vision chain (no key) + pixel-level vision tools (Q&A, grounding, crop, pixel diff, colors, OCR, SVG trace, cutout, screenshots). One-command install, no Python, image turns work like ordinary tool-calling turns.
Stars 973 +4Forks 44许可证 MIT更新 2026/8/26
dsh-vision-router 是给 DeepSeek Harness 纯文本智能体使用的视觉路由插件,把图像处理保留在视觉模型一侧,再把结构化结果交给 DeepSeek 推理。图片回合仍按普通工具调用运行,可连续定位、裁剪、描述、比较和复查。
插件包含十四项图像工具,覆盖 OCR、目标定位、像素差异、颜色、SVG 描摹、抠图和网页截图,整条链使用 Node 依赖与系统浏览器,不要求 Python。默认可使用有限速的匿名视觉服务,也能优先配置自己的视觉模型,并按图片内容缓存结果。
核心能力
- 把图像处理留在视觉模型一侧,把结构化结果交给 DeepSeek 推理,图片回合仍按普通工具调用运行
- 提供 OCR、目标定位、像素差异、颜色、SVG 描摹、抠图和网页截图等图像工具
- 整条链使用 Node 依赖与系统浏览器,不要求 Python
- 默认可使用有限速的匿名视觉服务,也能优先配置自己的视觉模型,并按图片内容缓存结果
如何开始
- 1安装插件
用 DSH 插件命令把 dsh-vision-router 加到 web 配置。
npx @deepseek-ai/dsh plugin --profile web add dsh-vision-router - 2开启识图
聊天页右下角只选会话模型。需要看图时在输入框旁点「👁 识图」,上传或粘贴图片不会自动开启。
- 3贴图使用工具
开启识图后把图片贴进对话,Agent 可调用 vision_describe、vision_ground、vision_crop 等工具。
使用前确认
若该 profile 里已有通过 cordis.patch.yml 手动挂载的社区插件,不要与 dsh plugin add 或 dsh plugin list 混用,否则可能重复注册。首次装进已长期运行的 Web 进程时需要重新加载插件本体。匿名视觉兜底按 IP、按模型限速。会话已含图片时,Host 可能拒绝切回不接受图片的纯文本路由。
Star 增长
数据来源:定期同步保存的 Star 快照;增长不构成质量、安全或官方背书。
GitHub Topics
相关项目
收录或清单确认都不等于本站验证。该项目因仓库添加了 dsh-plugin Topic 而自动进入目录。相关度与排查提示由公开信息自动生成,不构成质量、安全或官方背书;本站没有替你安装、运行或审核其兼容性和安全性。第三方项目可能在 Harness 进程中运行。请自行审查源代码、依赖、许可证、安装方式和权限;Star 数量不构成质量、安全或官方背书。