Blog · 分析

为什么 Harness 的选择让账单差 7 倍

2026 年 8 月 14 日 · dshbase

DeepSeek 模型单 token 已经很便宜——但你跑它的 harness 可以把账单翻好几倍。编码 Agent 每一步都要重发系统提示词、工具定义、历史对话和代码。

前缀缓存

如果请求开头与之前匹配,提供方直接复用计算结果。缓存命中率就是本次输入中复用此前计算的 token 占比——越高越便宜。改个时间戳、调换工具顺序都可能让缓存失效。

实测:99.93% 命中率

开源 Agent Pi(GitHub 约 8.6 万 star)接 DeepSeek 实测约 99.93% 缓存命中率——不命中率 0.07%。Pi 默认只给模型四个工具,会话只追加不重写。据报影响:有缓存约每 10 亿 token ¥19,无缓存 ¥900+

7 倍差距

Composio 横向测试把 DeepSeek V4 Flash 接进 8 款 harness 跑真实任务:Pi 每次成功任务约 $0.028(最低),Claude Code 约 $0.195(接近 Pi 的 7 倍)。同一个模型,不同 harness,账单天差地别。

结论

  • 最小工具集 + 只追加会话 = 缓存命中的最大杠杆。
  • DSH 方向一致:小活动面、一切皆插件、PTC 把中间数据留在上下文外。

以上为社区实测数据,非官方 DeepSeek 基准——投入前请核实当前价格。

全部文章 →

🌐 English