跳到正文

121103qwq/dsh-vision-sidecar

50最近提交 2026年8月14日

dsh-vision-sidecar DSH 插件

dsh-vision-sidecar 是一个 DSH 插件,拦截会话中的图像,将其发送到 OpenAI 兼容的视觉 API,并将文本描述作为持久的会话消息注入。默认使用 LLM7.io 的匿名视觉层,无需注册或 API 密钥。该插件适用于任何不依赖不透明提供者重放状态的 DSH 文本路由。

如何安装 dsh-vision-sidecar DSH 插件

dsh plugin --profile web add github:121103qwq/dsh-vision-sidecar#v0.1.4

复制不会执行命令。安装 dsh-vision-sidecar DSH 插件前请核对仓库和版本。

dsh-vision-sidecar DSH 插件数据来源

dsh-vision-sidecar DSH 插件快照日期:2026年8月16日

discovered

dsh-vision-sidecar DSH 插件能做什么

  • 默认通过 LLM7.io 匿名视觉,无需注册或 API 密钥
  • 持久且可重放:VLM 输出作为真实的 DSH 会话消息存储,而非隐藏重写
  • 可替换推理目标:转发到任何配置的 targetProvider 和 targetModel
  • 失败时大声报错:缺少凭证、超时、速率限制和提供者失败均返回类型化错误
  • 免构建 Git 安装:原生 ESM JavaScript,无需 prepare 脚本
  • 支持多个免费视觉提供者:LLM7.io、OVHcloud、智谱 GLM、OpenRouter、Hugging Face、ModelScope
  • 通过 DSH Desktop 的模型设置页面自定义视觉提供者

dsh-vision-sidecar DSH 插件适合哪些场景

  • 在不替换推理模型的情况下,为仅文本的 DSH 模型添加视觉能力
  • 使用免费托管的视觉 API 描述聊天会话中的图像
  • 确保视觉描述在进程重启和会话重放后依然持久
  • 将图像路由到自定义 OpenAI 兼容视觉端点,同时保持推理模型不变
  • 在配置付费提供者之前,使用无密钥的视觉设置进行测试和开发

dsh-vision-sidecar DSH 插件适合谁

  • 希望无需本地 GPU 或 VLM 即可为仅文本推理模型添加视觉的 DSH 用户
  • 构建需要远程视觉 API 处理图像的 DSH 工作流的开发者

dsh-vision-sidecar DSH 插件的限制

  • 需要 DSH 0.1.0-rc.6 或更新的 0.1.x 版本,以及 Node.js 22.19+ 或 24+
  • 默认免费视觉提供者(LLM7.io)有速率限制:每天 500,000 tokens,每小时 60 次请求,每分钟 10 次请求,每秒 1 次请求
  • 图像发送到远程服务;除非提供者条款可接受,否则不要发送个人、机密或受监管的图像
  • 仅支持 OpenAI Chat Completions 协议用于视觉端点;无法直接使用 Responses 和 Anthropic 协议
  • 不支持本地 VLM;插件完全依赖外部视觉 API

dsh-vision-sidecar DSH 插件的仓库 README 摘录

以下文字摘自 dsh-vision-sidecar DSH 插件的上游仓库 121103qwq/dsh-vision-sidecar 的 README,版权归原作者,仅作引用。

Give text-only models in [DeepSeek Harness](https://github.com/deepseek-ai/deepseek-harness) hosted visual perception without replacing the reasoning model. Images go to a free or custom OpenAI-compatible vision API; the exact description sent to the configured reasoning model is then committed to the DSH session and replayed as ordinary text. The default is LLM7.io's anonymous `default` vision route. No local VLM, GPU, account, or vision API key is required for its documented anonymous allowance. No local VLM, GPU, or multi-gigabyte model download is required. ## Why this plugin - **No-key hosted vision default.** On top of a working DSH text route, the default LLM7.io vision endpoint works without registration or a vision key; an LLM7 token is optional for higher limits. - **Durable and replayable.** VLM output is a real DSH session message, not a hidden request-time rewrite or process-only cache. - **No image overhead for text.** The vision provider is contacted only when an undescribed image exists. - **Replaceable reasoning target.** The sidecar forwards to `targetProvider` and `targetModel`; any DSH text route that does not depend on opaque provider replay state can be sel

阅读完整 README仓库许可: MIT

dsh-vision-sidecar DSH 插件常见问题

使用默认视觉需要 API 密钥吗?

不需要。LLM7.io 的默认视觉端点无需任何密钥即可匿名访问。匿名访问限制为每天 500,000 tokens、每小时 60 次请求、每分钟 10 次请求、每秒 1 次请求。如需更高限制,可在 token.llm7.io 创建免费令牌,并通过 `visionApiKeyEnv` 配置设置。

能否使用本地视觉模型替代远程 API?

不行。该插件仅设计用于远程 OpenAI 兼容视觉 API。不支持本地 VLM、GPU 或数 GB 模型下载。如果需要本地解决方案,可以考虑其他社区插件如 dsh-vision-proxy 或 modlens,但它们需要本地模型设置。

图像是如何处理和存储的?

图像以有界批次发送到配置的视觉 API。仅当所有批次成功完成后,精确的视觉描述和附件 SHA-256 ID 才会作为不可信证据通知附加到持久会话中。描述作为真实的 DSH 会话消息存储,因此在进程重启和重放后仍然存在。后续轮次会重用记录的描述,不会再次消耗 VLM 配额。

这个插件支持哪些文本模型?

任何不依赖不透明提供者重放状态的 DSH 文本路由都可以作为推理目标。在插件配置中设置 `targetProvider` 和 `targetModel`。默认示例使用一个已有文本模型的配置文件,但插件不要求特定的提供者或模型。

如何添加自定义视觉提供者?

可以通过 DSH Desktop 的设置 → 模型页面添加自定义 OpenAI 兼容视觉提供者。选择“添加自定义提供者”,输入 Provider ID、HTTPS 基础 URL,选择“openai-completions”,添加一个视觉模型 ID,然后粘贴你的 API 密钥。最后在插件配置中设置 `visionProvider` 和 `visionModel` 指向该路由。