DeepSeek Harness 插件

moon09300731/dsh-peak-cost-mode

Star 数 ★ 0 分类 通知与集成 收录于 2026-08-18 npm dsh-peak-cost-mode

在 DeepSeek 高峰计价时段(北京时间 09:00–12:00、14:00–18:00,价格 ×2)自动切换 caveman 超精简输出省 token,标题栏常驻状态徽章,档位切换时弹提醒。

安装

# npm 包(预构建)

dsh plugin --profile web add dsh-peak-cost-mode

# GitHub 源码(首次需按提示配置 allowBuilds 构建授权后重试)

dsh plugin --profile web add github:moon09300731/dsh-peak-cost-mode

装任何插件都等于在你的机器上跑第三方代码,权限和你本人一样大——能读你的文件、用你的凭据、访问网络,工具审批管不到它。GitHub 来源的插件还会在安装时执行构建脚本。请只安装可信来源,并尽量锁定 commit(github:owner/repo#sha)。

README

DeepSeek 峰谷计价省钱插件,适用于 DeepSeek Harness(DSH):高峰计价时段(北京时间 09:00–12:00、14:00–18:00,价格 ×2)自动切换 caveman 超精简输出 省输出 token,标题栏徽章 + 切换 toast 随时告知当前档位。

功能

  • 自动监测 —— 每 30 秒按北京时间(UTC+8,无夏令时)对照 DeepSeek V4 峰谷时刻表:
    时段(北京时间) 档位 价格
    09:00–12:00 高峰 ×2
    12:00–14:00 低谷 ×1
    14:00–18:00 高峰 ×2
    18:00–次日 09:00 低谷 ×1
  • 高峰省流 —— 高峰期间注入「高峰省流模式」提示段:要求模型以 caveman 超精简风格回复(去客套/铺垫/填充词,代码、命令、API 名、路径、精确错误信息、数字一律原样保留;安全警告与不可逆操作确认永不压缩)。
  • 切换提醒 —— 每次档位切换弹 toast:
    • 低谷 → 高峰:「梁文锋来了,少说话多做事。」
    • 高峰 → 低谷:「梁文谷来了,一切正常。」
  • 常驻状态徽章 —— 会话标题栏右侧(会话日志按钮左侧):高峰红底「高峰 ×2 · 省流中」,低谷绿底「低谷 ×1」;悬停显示完整信息(窗口/倍率/北京时间/下次切换)。点击徽章打开收益报告。
  • 省流收益计量(0.2.0) —— 高峰期间拦截每一次流式模型调用(llm/stream),按模型记录真实 token 用量(输入未命中 / 缓存命中 / 输出,DeepSeek 适配器输出的分离计数),再估算 caveman 压缩帮你省了多少、并按 DeepSeek 高峰价折成人民币:
    • 省下 tokens ≈ 高峰实际输出 × r/(1−r)r = 压缩率,默认 0.6(保守;可配 0–0.9)。
    • 省下 RMB = 省下 tokens × 模型高峰输出价 / 1e6(高峰 = 低谷 ×2;如 V4-Flash 输出 ¥9.0/百万、V4-Pro ¥27.0/百万)。
    • 缓存命中考虑 —— 输入按缓存命中/未命中分列计费(Flash 命中 ¥0.05 vs 未命中 ¥1.5 → 差 30×,Pro 同理),展示输入缓存命中率健康度;并给出「缓存损益」一行(实际命中率高于基线为 +省,低于为 −多花);净省 = 输出省 + 缓存损益。
    • 台账按高峰波次封档,落盘 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/stats.json,重启不丢(写不动则降级内存)。
    • 口径说明:「省」是估算(反事实——未压缩会输出多少无法精确得知),UI 中明确标注「估算」。
  • 收益展示位置 —— 标题栏徽章(高峰实时计数)、输入框上方常驻读数(conversation.composer.dock)、出峰 toast(本波高峰汇总)、「收益报告」面板(点徽章):本高峰/今日/累计 的 token + 人民币、按模型明细、缓存命中率 vs 基线、实际 vs 反事实账单、清空按钮(POST /api/peak-cost/reset)。

安装

dsh plugin --profile web add dsh-peak-cost-mode
# 或从 GitHub 安装
dsh plugin --profile web add github:moon09300731/dsh-peak-cost-mode

安装后重启 dsh web 并硬刷新浏览器页面。

配置

可选配置文件 ${DSH_HOME:-~/.dsh}/dsh-peak-cost-mode/config.json

{
  "saveRatio": 0.6,
  "baseCacheHitRate": 0.5,
  "multiplier": 2,
  "prices": {
    "deepseek-v4-flash": { "hit": 0.05, "miss": 1.5, "output": 4.5 },
    "deepseek-v4-pro": { "hit": 0.15, "miss": 4.5, "output": 13.5 }
  }
}
  • saveRatio —— caveman 假设的输出压缩率(默认 0.6,范围 0–0.9)。
  • baseCacheHitRate —— 无低谷实测时,「无插件」反事实输入账单采用的缓存命中率基线(默认 0.5)。
  • multiplier —— RMB 折算的高峰倍率(默认 2)。
  • prices —— 每个模型的低价谷价(元/百万 tokens);精确模型键覆盖内置 flash/pro 默认。价目会变,请以 DeepSeek 官方定价页为准;展示的省钱为估算,非账单。

工作原理

  • Host(src/index.mjs):30 秒定时器计算北京时间;进入高峰窗口即注册 systemPrompt 段落(peak-cost-mode,order 60),让之后每一轮模型回复走精简输出;退出高峰即移除。0.2.0 起另订阅 llm/stream waterfall,包住每次调用、在完成时刻(北京钟点处于高峰时)采集 usage(输入/缓存命中/输出 token)+ 模型 id,按波次累计台账,并暴露 GET /api/peak-cost/stateGET /api/peak-cost/statsPOST /api/peak-cost/reset
  • Client(client.js):每 30 秒轮询 /api/peak-cost/state(快照镜像到 localStoragedsh.peakCost.v1),渲染徽章、toast、输入框读数和报告面板。

说明:提示段落注册在宿主作用域,高峰时段对部署内所有会话生效(这正是省钱的目的)。若只想对单个会话启用高峰压缩,请改用动态插件方式。

开发

npm test   # node --check src/index.mjs && node --check client.js

许可证

MIT © moon09300731

内容来自项目 README(GitHub)↗

链接

同类插件

查看整个分类 →