
MeowLynxSea/dsh-cot-summerization
30最近提交 2026年8月16日
dsh-cot-summerization DSH 插件
本插件在 DSH 中拦截思考模型的推理流,将原始思维链发送给摘要模型改写为简洁摘要,仅显示摘要到 UI。原始思维链通过 model-only 替换事件保留在模型历史中,不影响多轮推理,但人类用户和日志均不可见。
如何安装 dsh-cot-summerization DSH 插件
dsh plugin add github:MeowLynxSea/dsh-cot-summerization复制不会执行命令。安装 dsh-cot-summerization DSH 插件前请核对仓库和版本。
dsh-cot-summerization DSH 插件数据来源
dsh-cot-summerization DSH 插件快照日期:2026年8月16日
discovered
dsh-cot-summerization DSH 插件能做什么
- 流式分段摘要,可配置分块大小和间隔
- 基于 bigram Dice 系数(阈值 0.65)和最长公共子串的近重复消除
- 支持多种摘要风格(简洁、描述、文言、自定义)和语言
- 自适应分块,根据实时流速率和摘要模型 RTT 动态调整
- 可选的打字机模式,逐字展示摘要内容
dsh-cot-summerization DSH 插件适合哪些场景
- 隐藏冗长的推理链,提升用户界面整洁度
- 在 AI 对话应用中提供更专业的体验
- 保护模型内部思考过程不被直接展示
- 模拟闭源模型的『隐藏思维链』体验
- 减少调试日志中的视觉杂乱,用紧凑摘要代替原始 CoT
dsh-cot-summerization DSH 插件适合谁
- 使用 DSH 构建开源 AI 聊天界面的开发者
- 希望不看到原始推理步骤的普通用户
- 追求开源且可审计的『隐藏推理』体验的团队
dsh-cot-summerization DSH 插件的限制
- 需要额外一次 API 调用给摘要模型,增加成本和延迟
- 短于 32 字符的思维链直接透传,不进行摘要
- 非思考模型(无推理流)不受影响
- 依赖 DSH 的 LLM 通道配置,必须能访问摘要模型
- 开启打字机模式后,整个流会串行化,输出被排队
dsh-cot-summerization DSH 插件的仓库 README 摘录
以下文字摘自 dsh-cot-summerization DSH 插件的上游仓库 MeowLynxSea/dsh-cot-summerization 的 README,版权归原作者,仅作引用。
**DeepSeek Harness 插件:把模型的原始思维链拦截在半空,改写成一份体面的摘要再端给你。** 闭源模型花钱隐藏思维链,开源模型免费全裸。 我们识别出了开源生态最后一块体验短板,并亲手为它补上—— 方向可能和大家期待的不太一样,但确实是补上了。 </div> <img src="assets/divider-wave.svg" width="880" alt=""> ## 🎯 项目使命 <img src="assets/logo.svg" width="200" align="right" hspace="16" alt="logo:被锁住的眼睛"> 长期以来,「隐藏思维链」是闭源大厂的专属奢华配置:不可关闭、不可审计、不可验证,但很贵。开源模型则把每一步推理都摊开在你面前——坦诚,透明,像一份没整理过的草稿纸。 **我们相信这不应该是一道单选题。** 本插件以工业级严谨,在完全开源、完全可审计的 harness 里,复刻了闭源生态最具标志性的体验:让你看不见思维链。不同的是,我们的隐藏是开源的、可配置的、可关闭的——业界首次把「不可见」做得如此可见。 三大支柱: | 支柱 | 立场 | | :--- | :--- | | 🛡️ **模型隐私权** | 思维链是模型的内心世界。你不会翻别人的日记,除非付费。 | | 🧹 **视觉卫生** | 原始 CoT 又长又乱,充满「等等,我再想想」。得体的人不看这些。 | | 💎 **神秘感平权** | 闭源模型靠神秘感溢价。现在开源用户也能免费获得——本地酿造,纯手工。 | <br clear="right"> ## ✨ 核心特性:宣传名与现实对照 以下每一项,源码均可查。这很讽刺,我们接受。 | 宣传名 | 现实 | | :--- | :--- | | **Information Never Existed™** | 原始 reasoning 增量在 `llm/stream` 拦截层被直接吞掉——UI、流式 chunk、落地 transcript 三处均无原文。模型可见历史除外:那里有一份 model-only 的 surface 替换事件,悄悄把原文还给了模型(推理性能要紧)。 | | **夏日渐进蒸馏** | 流式分段摘要:每凑满 `chunkChars`(500 字)或 `chunkIntervalMs`(8 秒)触发一次,切分点优先落在句边界;开启 `adaptiveChunk` 后,分块大小会随流速率与总结器 RTT 动态缩放。 | | **BioGram™ 重叠度量** | bigram Dice 系数,阈值 0.65。该阈值经历了 0.8 → 0.7 → 0.65 的科学调参过程。 | | **连续核心追踪引擎** | 最长公共子串,滚动数组实现,O(n
阅读完整 README仓库许可: MIT
dsh-cot-summerization DSH 插件常见问题
我还能看到原始思维链吗?
可以,但需要特定配置。将 `onError` 设为 `pass-through` 可在摘要失败时显示原文;关闭 `preserveRawForModel` 后模型历史中也不保留原始链。但默认行为是隐藏,UI 和日志均不可见。
摘要模型失败会怎样?
默认情况下失败时显示占位符(hide)。你可以通过 `onError` 设置改为 `pass-through` 让原始推理链通过。插件还有 30 秒超时设置,防止卡死。
插件会把数据发送到外部服务器吗?
思维链通过 DSH 自身的 LLM 通道发送到已配置的提供方。如果你将提供方指向本地模型(如 Ollama),数据完全不出网。除了 DSH 框架,插件不引入额外网络调用。
这和单纯折叠思维链有什么区别?
折叠只是视觉上隐藏,原始数据仍在 HTML 和日志中。本插件在流层面拦截,原文从未到达 UI 和 transcript。模型历史中保留原始链是为了性能,但用户看到的输出是完全替换过的。
能用于非思考模型吗?
不能。本插件只影响会产生 `reasoning` 流的思考模型。如果模型没有思维链,插件会原样透传流,不做任何干预。