跳到正文

oil-oil/dsh-vision

414最近提交 2026年8月14日

dsh-vision DSH 插件

dsh-vision 是 DeepSeek Harness 的插件,为支持视觉的模型提供原生图像处理,同时为纯文本模型搭建视觉桥接。当主模型支持图像时,直接透传;否则,由配置的视觉模型分析图像并将结果作为上下文注入。支持多种云视觉提供商以及 macOS 本地 Vision OCR 或 Tesseract 回退。

如何安装 dsh-vision DSH 插件

dsh plugin --profile web add github:oil-oil/dsh-vision

复制不会执行命令。安装 dsh-vision DSH 插件前请核对仓库和版本。

dsh-vision DSH 插件数据来源

dsh-vision DSH 插件快照日期:2026年8月16日

discovered

dsh-vision DSH 插件能做什么

  • 对支持视觉的模型,直接透传原始图像,无需预处理或 OCR。
  • 对纯文本模型,将图像发送到配置的视觉模型,并将其输出作为不可信上下文注入。
  • 支持同时分析多张图片,便于比较和联合证据推理。
  • 可配置的云视觉提供商:ZenMux、阿里云百炼、TokenDance、OpenRouter。
  • 云服务不可用时,自动回退到 macOS 本地 Vision OCR 或 Tesseract(Linux/Windows)。
  • API 密钥通过 Harness 凭证服务安全存储,浏览器中仅可写不可读。
  • 视觉输出标记为不可信观察数据,防止图像中的指令注入。

dsh-vision DSH 插件适合哪些场景

  • 让纯文本模型(如 deepseek-official)理解并描述聊天中的图片内容。
  • 同时上传多张图片,让模型进行比较分析,例如找出差异或共同点。
  • 无需更换主模型,插件自动在需要时启用视觉桥接。
  • 自由选择云视觉提供商,或为了隐私敏感场景回退到本地 OCR。

dsh-vision DSH 插件适合谁

  • DeepSeek Harness 用户,希望为其工作流添加图像理解能力。
  • 偏好使用纯文本模型,但偶尔需要处理图像的用户。

dsh-vision DSH 插件的限制

  • 当前仅支持 DeepSeek Harness 0.1.0-rc.6 版本,其他版本兼容性不保证。
  • 本地回退方案主要基于 OCR,无法提供完整的多模态理解(如复杂场景解析)。

dsh-vision DSH 插件的仓库 README 摘录

以下文字摘自 dsh-vision DSH 插件的上游仓库 oil-oil/dsh-vision 的 README,版权归原作者,仅作引用。

English | <a href="./README.zh.md">中文</a> </p> <p align="center"> <a href="https://github.com/oil-oil/dsh-vision/actions"><img alt="CI" src="https://img.shields.io/github/actions/workflow/status/oil-oil/dsh-vision/ci.yml?style=flat-square&label=CI"></a> <a href="./LICENSE"><img alt="MIT License" src="https://img.shields.io/badge/license-MIT-4D6BFE?style=flat-square"></a> <img alt="DeepSeek Harness" src="https://img.shields.io/badge/DeepSeek%20Harness-0.1.0--rc.6-4D6BFE?style=flat-square"> </p> `dsh-vision` is a plugin for DeepSeek Harness. Vision-capable models keep receiving images natively. When the selected main model is text-only, the plugin asks a separate vision model to observe the original images, then lets the original DeepSeek model produce the final answer. ## How it works | Main model | Image path | Final answer | | --- | --- | --- | | Supports images | Original images are sent directly, without preprocessing or OCR | Current model | | `deepseek-official` or another text-only model | A configured vision model observes the original images; its output is injected as untrusted attachment context | DeepSeek | | Cloud vision unavailable | Falls back to macOS Vision

阅读完整 README仓库许可: MIT

dsh-vision DSH 插件常见问题

如何安装 dsh-vision?

在终端执行命令 `npx @deepseek-ai/dsh plugin --profile web add github:oil-oil/dsh-vision`,然后重启 DeepSeek Harness,插件会自动生效。

dsh-vision 会替换我的主模型吗?

不会。插件不会替换 Harness 中选择的模型。它仅当主模型是纯文本模型时才会启用视觉桥接。对于支持视觉的模型,图片会直接透传。

支持哪些云视觉提供商?

支持 ZenMux、阿里云百炼、TokenDance 和 OpenRouter。你可以在“设置 → 插件 → 插件配置”中的“视觉识别”卡片中选择提供商并配置 API 密钥。

没有云 API 密钥能用吗?

可以。在“视觉识别”中选择“自动”模式,插件会优先尝试 Harness 中已配置的视觉模型,然后回退到本地 OCR(macOS Vision 或 Tesseract)。但本地回退仅支持 OCR,无法提供完整的多模态理解。

我的 API 密钥安全吗?

是的。API 密钥通过 Harness 的官方凭证服务存储,在浏览器中只写不读:插件可以检测密钥是否存在,但绝不会将密钥读回到页面、聊天、设置文档或会话日志中。