DeepSeek涨价了?!下载这个插件,直接剩下一大堆token!
DeepSeek涨价的消息,这两天在开发者圈子里直接炸了锅。
2026年8月17日0时起,DeepSeek新版API定价正式生效。以V4 Pro为例,高峰时段缓存命中的输入价格从0.025元涨到0.3元,涨幅1100%;缓存未命中输入从3元涨到9元,涨幅200%;输出从6元涨到27元,涨幅350%。Flash版本也涨到了原来的2到4倍。原来那个"价格屠夫"DeepSeek,这回是真涨价了。
但别急着换模型——有个GitHub项目能帮你把多花的钱省回来。
这个项目是什么?
dsh-memory-plus 是一个为 DeepSeek Harness(DSH) 打造的记忆优化插件集,定位是"记忆全家桶 + 修地基"。它通过一系列底层优化,直接减少每次请求的Token消耗。
目前DSH生态里已有20多个记忆插件,但绝大多数都是"单点功能",而且几乎都建立在官方sessionQuery之上——官方unicode61的中文缺陷,意味着整个生态的中文召回都是坏的。这个项目做的第一件事,就是修复这个地基问题:通过trigram双表 + 1–2字LIKE回退,实测从0命中变成全命中。
怎么帮你省Token?
项目提供了6个核心插件,从不同维度减少Token消耗:
1. 工具结果去重 —— 纯省输入Token
dsh-tool-result-dedup:对重复的工具结果(比如多次git status、ls、重复读取文件)进行哈希去重,替换为指针。重复内容不再重复计费。
2. 中文会话全文检索 —— 生态唯一的中文修复
dsh-session-query-sqlite-cjk:FTS5双tokenizer双表(unicode61 + trigram),按查询是否含CJK自动路由。20多个记忆插件共同受益。
3. 混合记忆检索 —— 向量 + 词法双路召回
dsh-memory-index:sqlite-vec向量臂 + FTS5词法臂 → RRF融合;事件级增量嵌入 + file词条过滤。让AI能精准召回历史信息,避免重复问、重复答。
4. 模型可调用的记忆搜索工具
dsh-memory-tool:模型可调用的memory_search工具,会话旧内容混合召回,输出有界。
5. 近无损压缩 + 来源定位
dsh-compaction-locator:每个``追加Exact Sources定位符(spill路径/文件路径/seq区间)。压缩不丢信息,溯源有据可查。
6. 技能自我进化(Phase 3)
skill_write/delete/list + 后台反思蒸馏——Hermes式学习循环,请求路径零开销。
目前Phase 0–3已全部落地,并在真实harness(headless profile)中集成验证,65个单测通过。
省钱的逻辑
DeepSeek涨价后,省钱的核心逻辑无非两条:
-
减少输入Token:工具结果去重、记忆精准召回,都让每次请求少传重复/无关内容。
-
提高缓存命中率:DeepSeek的缓存命中价格远低于未命中——V4 Pro高峰时段缓存命中0.3元 vs 未命中9元,相差30倍。稳定的前缀和上下文结构,能大幅提升缓存命中率。
dsh-memory-plus通过记忆持久化 + 上下文结构化,让每次请求的前缀更稳定、内容更精炼——缓存命中率更高,Token用量更少。
怎么装?
项目采用 MIT协议,完全开源免费。安装方式:
bash
# 通过DSH插件管理器安装 dsh plugin --profile default add https://github.com/QIANLING-0831/dsh-memory-plus
详细文档在项目README里,还有生态盘点对照表:docs/DSH-MEMORY-ECOSYSTEM.md。
总结
DeepSeek涨价是既定事实——V4 Pro最高涨了11倍。但与其骂"梁圣变梁子",不如动手把多花的钱省回来。
dsh-memory-plus 通过中文检索修复、工具结果去重、混合记忆检索、近无损压缩四个维度,系统性地减少Token消耗——而且它是生态唯一修复了中文召回地基问题的项目。
趁涨价刚落地,赶紧装上试试。省下来的Token,都是真金白银。
更多推荐



所有评论(0)