dsh-vision-toolkit:DeepSeek Harness 的视觉工具箱插件
anionex/dsh-vision-toolkit
DSH Vision Toolkit 为 DeepSeek Harness 纯文本模型赋予视觉能力:粘贴图片问答、长截图 OCR、UI 还原、元素定位与像素对比,一行安装即用。
dsh-vision-toolkit 是 DeepSeek Harness 生态中的首个全面视觉工具插件,为纯文本模型赋予图像问答、长截图 OCR、UI 还原、像素对比等能力。它解决了文本模型无法直接处理图像的问题,让模型能粘贴图片直接提问、识别截图内容、还原前端 UI,并支持多图问答与截图到前端 UI 还原等场景。该插件由 Anionex 维护,采用 MIT 协议,深度集成 DSH 的 Web 与 Headless Profiles,是 DSH 生态中首个全面的视觉工具插件。
如何安装
dsh plugin --profile web add @anionex/dsh-vision-toolkit- 分类
- 工具与能力
- 平台
- DSH Plugin
- 作者
- anionex
- 分发方式
- 插件
dsh-vision-toolkit 核心特性
dsh-vision-toolkit 仓库简介
它是做什么的?
DSH Vision Toolkit 是 DeepSeek Harness(DSH)的视觉工具箱插件,为纯文本模型赋予图像问答、长截图 OCR、UI 还原、像素对比等视觉能力。它解决文本模型无法直接处理图像的问题,让模型能粘贴图片直接提问、识别截图内容、还原前端 UI,并支持多图问答与截图到前端 UI 还原等场景。该插件由 Anionex 维护,采用 MIT 协议,深度集成 DSH 的 Web 与 Headless Profiles,是 DSH 生态中首个全面的视觉工具插件。
核心功能
- 图像问答:粘贴图片即可直接提问,模型自动切换至视觉变体,无需手动切换模型。
- 长截图 OCR:支持长截图文字识别,提取关键信息。
- UI 还原:从截图还原前端 UI,辅助界面开发与测试。
- 像素对比:对比两张图片的像素差异,用于截图测试。
- 定位与裁剪:识别图像中的目标位置(如按钮、错误提示),并支持裁剪与追踪。
- 内置视觉技能:捆绑 Skill 指导模型针对不同视觉任务选择工具、执行步骤并验证结果。
怎么使用这个插件?
在 DSH 中启用插件后,进入 Settings → Vision Toolkit 配置视觉提供方,即可开始使用。在 Web 界面中,直接粘贴图片并提问,模型会自动切换至视觉变体并回答;在 Headless 模式中,可通过相应工具调用视觉能力。需要调整时,可在高级设置中修改透明路由等选项,或参考官方文档配置模型。
本页是基于该插件官方 README 独立重写的导读——权威文档和最新变更请以源头为准:anionex/dsh-vision-toolkit。插件是安装时就在你机器上运行的第三方代码;收录不代表背书——安装前请自行审阅源码。
