跳到正文

MeowLynxSea/dsh-cot-summerization

30最近提交 2026年8月16日

dsh-cot-summerization DSH 插件

本插件在 DSH 中拦截思考模型的推理流,将原始思维链发送给摘要模型改写为简洁摘要,仅显示摘要到 UI。原始思维链通过 model-only 替换事件保留在模型历史中,不影响多轮推理,但人类用户和日志均不可见。

如何安装 dsh-cot-summerization DSH 插件

dsh plugin add github:MeowLynxSea/dsh-cot-summerization

复制不会执行命令。安装 dsh-cot-summerization DSH 插件前请核对仓库和版本。

dsh-cot-summerization DSH 插件数据来源

dsh-cot-summerization DSH 插件快照日期:2026年8月16日

discovered

dsh-cot-summerization DSH 插件能做什么

  • 流式分段摘要,可配置分块大小和间隔
  • 基于 bigram Dice 系数(阈值 0.65)和最长公共子串的近重复消除
  • 支持多种摘要风格(简洁、描述、文言、自定义)和语言
  • 自适应分块,根据实时流速率和摘要模型 RTT 动态调整
  • 可选的打字机模式,逐字展示摘要内容

dsh-cot-summerization DSH 插件适合哪些场景

  • 隐藏冗长的推理链,提升用户界面整洁度
  • 在 AI 对话应用中提供更专业的体验
  • 保护模型内部思考过程不被直接展示
  • 模拟闭源模型的『隐藏思维链』体验
  • 减少调试日志中的视觉杂乱,用紧凑摘要代替原始 CoT

dsh-cot-summerization DSH 插件适合谁

  • 使用 DSH 构建开源 AI 聊天界面的开发者
  • 希望不看到原始推理步骤的普通用户
  • 追求开源且可审计的『隐藏推理』体验的团队

dsh-cot-summerization DSH 插件的限制

  • 需要额外一次 API 调用给摘要模型,增加成本和延迟
  • 短于 32 字符的思维链直接透传,不进行摘要
  • 非思考模型(无推理流)不受影响
  • 依赖 DSH 的 LLM 通道配置,必须能访问摘要模型
  • 开启打字机模式后,整个流会串行化,输出被排队

dsh-cot-summerization DSH 插件的仓库 README 摘录

以下文字摘自 dsh-cot-summerization DSH 插件的上游仓库 MeowLynxSea/dsh-cot-summerization 的 README,版权归原作者,仅作引用。

**DeepSeek Harness 插件:把模型的原始思维链拦截在半空,改写成一份体面的摘要再端给你。** 闭源模型花钱隐藏思维链,开源模型免费全裸。 我们识别出了开源生态最后一块体验短板,并亲手为它补上—— 方向可能和大家期待的不太一样,但确实是补上了。 </div> <img src="assets/divider-wave.svg" width="880" alt=""> ## 🎯 项目使命 <img src="assets/logo.svg" width="200" align="right" hspace="16" alt="logo:被锁住的眼睛"> 长期以来,「隐藏思维链」是闭源大厂的专属奢华配置:不可关闭、不可审计、不可验证,但很贵。开源模型则把每一步推理都摊开在你面前——坦诚,透明,像一份没整理过的草稿纸。 **我们相信这不应该是一道单选题。** 本插件以工业级严谨,在完全开源、完全可审计的 harness 里,复刻了闭源生态最具标志性的体验:让你看不见思维链。不同的是,我们的隐藏是开源的、可配置的、可关闭的——业界首次把「不可见」做得如此可见。 三大支柱: | 支柱 | 立场 | | :--- | :--- | | 🛡️ **模型隐私权** | 思维链是模型的内心世界。你不会翻别人的日记,除非付费。 | | 🧹 **视觉卫生** | 原始 CoT 又长又乱,充满「等等,我再想想」。得体的人不看这些。 | | 💎 **神秘感平权** | 闭源模型靠神秘感溢价。现在开源用户也能免费获得——本地酿造,纯手工。 | <br clear="right"> ## ✨ 核心特性:宣传名与现实对照 以下每一项,源码均可查。这很讽刺,我们接受。 | 宣传名 | 现实 | | :--- | :--- | | **Information Never Existed™** | 原始 reasoning 增量在 `llm/stream` 拦截层被直接吞掉——UI、流式 chunk、落地 transcript 三处均无原文。模型可见历史除外:那里有一份 model-only 的 surface 替换事件,悄悄把原文还给了模型(推理性能要紧)。 | | **夏日渐进蒸馏** | 流式分段摘要:每凑满 `chunkChars`(500 字)或 `chunkIntervalMs`(8 秒)触发一次,切分点优先落在句边界;开启 `adaptiveChunk` 后,分块大小会随流速率与总结器 RTT 动态缩放。 | | **BioGram™ 重叠度量** | bigram Dice 系数,阈值 0.65。该阈值经历了 0.8 → 0.7 → 0.65 的科学调参过程。 | | **连续核心追踪引擎** | 最长公共子串,滚动数组实现,O(n

阅读完整 README仓库许可: MIT

dsh-cot-summerization DSH 插件常见问题

我还能看到原始思维链吗?

可以,但需要特定配置。将 `onError` 设为 `pass-through` 可在摘要失败时显示原文;关闭 `preserveRawForModel` 后模型历史中也不保留原始链。但默认行为是隐藏,UI 和日志均不可见。

摘要模型失败会怎样?

默认情况下失败时显示占位符(hide)。你可以通过 `onError` 设置改为 `pass-through` 让原始推理链通过。插件还有 30 秒超时设置,防止卡死。

插件会把数据发送到外部服务器吗?

思维链通过 DSH 自身的 LLM 通道发送到已配置的提供方。如果你将提供方指向本地模型(如 Ollama),数据完全不出网。除了 DSH 框架,插件不引入额外网络调用。

这和单纯折叠思维链有什么区别?

折叠只是视觉上隐藏,原始数据仍在 HTML 和日志中。本插件在流层面拦截,原文从未到达 UI 和 transcript。模型历史中保留原始链是为了性能,但用户看到的输出是完全替换过的。

能用于非思考模型吗?

不能。本插件只影响会产生 `reasoning` 流的思考模型。如果模型没有思维链,插件会原样透传流,不做任何干预。