
121103qwq/dsh-vision-sidecar
50最近提交 2026年8月14日
dsh-vision-sidecar DSH 插件
dsh-vision-sidecar 是一个 DSH 插件,拦截会话中的图像,将其发送到 OpenAI 兼容的视觉 API,并将文本描述作为持久的会话消息注入。默认使用 LLM7.io 的匿名视觉层,无需注册或 API 密钥。该插件适用于任何不依赖不透明提供者重放状态的 DSH 文本路由。
如何安装 dsh-vision-sidecar DSH 插件
dsh plugin --profile web add github:121103qwq/dsh-vision-sidecar#v0.1.4复制不会执行命令。安装 dsh-vision-sidecar DSH 插件前请核对仓库和版本。
dsh-vision-sidecar DSH 插件数据来源
dsh-vision-sidecar DSH 插件快照日期:2026年8月16日
discovered
dsh-vision-sidecar DSH 插件能做什么
- 默认通过 LLM7.io 匿名视觉,无需注册或 API 密钥
- 持久且可重放:VLM 输出作为真实的 DSH 会话消息存储,而非隐藏重写
- 可替换推理目标:转发到任何配置的 targetProvider 和 targetModel
- 失败时大声报错:缺少凭证、超时、速率限制和提供者失败均返回类型化错误
- 免构建 Git 安装:原生 ESM JavaScript,无需 prepare 脚本
- 支持多个免费视觉提供者:LLM7.io、OVHcloud、智谱 GLM、OpenRouter、Hugging Face、ModelScope
- 通过 DSH Desktop 的模型设置页面自定义视觉提供者
dsh-vision-sidecar DSH 插件适合哪些场景
- 在不替换推理模型的情况下,为仅文本的 DSH 模型添加视觉能力
- 使用免费托管的视觉 API 描述聊天会话中的图像
- 确保视觉描述在进程重启和会话重放后依然持久
- 将图像路由到自定义 OpenAI 兼容视觉端点,同时保持推理模型不变
- 在配置付费提供者之前,使用无密钥的视觉设置进行测试和开发
dsh-vision-sidecar DSH 插件适合谁
- 希望无需本地 GPU 或 VLM 即可为仅文本推理模型添加视觉的 DSH 用户
- 构建需要远程视觉 API 处理图像的 DSH 工作流的开发者
dsh-vision-sidecar DSH 插件的限制
- 需要 DSH 0.1.0-rc.6 或更新的 0.1.x 版本,以及 Node.js 22.19+ 或 24+
- 默认免费视觉提供者(LLM7.io)有速率限制:每天 500,000 tokens,每小时 60 次请求,每分钟 10 次请求,每秒 1 次请求
- 图像发送到远程服务;除非提供者条款可接受,否则不要发送个人、机密或受监管的图像
- 仅支持 OpenAI Chat Completions 协议用于视觉端点;无法直接使用 Responses 和 Anthropic 协议
- 不支持本地 VLM;插件完全依赖外部视觉 API
dsh-vision-sidecar DSH 插件的仓库 README 摘录
以下文字摘自 dsh-vision-sidecar DSH 插件的上游仓库 121103qwq/dsh-vision-sidecar 的 README,版权归原作者,仅作引用。
Give text-only models in [DeepSeek Harness](https://github.com/deepseek-ai/deepseek-harness) hosted visual perception without replacing the reasoning model. Images go to a free or custom OpenAI-compatible vision API; the exact description sent to the configured reasoning model is then committed to the DSH session and replayed as ordinary text. The default is LLM7.io's anonymous `default` vision route. No local VLM, GPU, account, or vision API key is required for its documented anonymous allowance. No local VLM, GPU, or multi-gigabyte model download is required. ## Why this plugin - **No-key hosted vision default.** On top of a working DSH text route, the default LLM7.io vision endpoint works without registration or a vision key; an LLM7 token is optional for higher limits. - **Durable and replayable.** VLM output is a real DSH session message, not a hidden request-time rewrite or process-only cache. - **No image overhead for text.** The vision provider is contacted only when an undescribed image exists. - **Replaceable reasoning target.** The sidecar forwards to `targetProvider` and `targetModel`; any DSH text route that does not depend on opaque provider replay state can be sel
阅读完整 README仓库许可: MIT
dsh-vision-sidecar DSH 插件常见问题
使用默认视觉需要 API 密钥吗?
不需要。LLM7.io 的默认视觉端点无需任何密钥即可匿名访问。匿名访问限制为每天 500,000 tokens、每小时 60 次请求、每分钟 10 次请求、每秒 1 次请求。如需更高限制,可在 token.llm7.io 创建免费令牌,并通过 `visionApiKeyEnv` 配置设置。
能否使用本地视觉模型替代远程 API?
不行。该插件仅设计用于远程 OpenAI 兼容视觉 API。不支持本地 VLM、GPU 或数 GB 模型下载。如果需要本地解决方案,可以考虑其他社区插件如 dsh-vision-proxy 或 modlens,但它们需要本地模型设置。
图像是如何处理和存储的?
图像以有界批次发送到配置的视觉 API。仅当所有批次成功完成后,精确的视觉描述和附件 SHA-256 ID 才会作为不可信证据通知附加到持久会话中。描述作为真实的 DSH 会话消息存储,因此在进程重启和重放后仍然存在。后续轮次会重用记录的描述,不会再次消耗 VLM 配额。
这个插件支持哪些文本模型?
任何不依赖不透明提供者重放状态的 DSH 文本路由都可以作为推理目标。在插件配置中设置 `targetProvider` 和 `targetModel`。默认示例使用一个已有文本模型的配置文件,但插件不要求特定的提供者或模型。
如何添加自定义视觉提供者?
可以通过 DSH Desktop 的设置 → 模型页面添加自定义 OpenAI 兼容视觉提供者。选择“添加自定义提供者”,输入 Provider ID、HTTPS 基础 URL,选择“openai-completions”,添加一个视觉模型 ID,然后粘贴你的 API 密钥。最后在插件配置中设置 `visionProvider` 和 `visionModel` 指向该路由。