Kimi Code 用量分析

May 24, 2026 · View on GitHub

分析日期:2026-05-24 数据来源:bunx ccusage(全量记录 2026-01 ~ 2026-05)


Token 比例(全量累积)

项目全量累积占比
输入(Cache Miss)~154M4.9%
缓存创建~89M2.8%
输出~12M0.4%
缓存读取(Cache Hit)~2,896M91.9%
总计~3,152M100%

背后原因

缓存 91.9% 是 vibe coding 长 session 的典型特征:

  • Claude Code + kimi-for-coding 模式下,每轮对话都携带完整历史
  • 只有最后一次提问和回复是 cache miss,前面 N-1 轮全部命中缓存
  • 单 session 50-100 轮对话下,缓存占比自然逼近 92-98%

月度费用估算(按 1.5B tokens/月)

Kimi K2.6 标准 API 定价(无 Coding Plan)

项目单价月用量月费用
输入(Cache Miss)¥6.50/MTok73.5M¥478
缓存读取(Cache Hit)¥1.10/MTok1,378.5M¥1,516
输出¥27.00/MTok5.55M¥150
缓存创建(按输入计)¥6.50/MTok42.5M¥276
合计1.5B≈ ¥2,420/月

费用占比:缓存读取 63% > 输入 31% > 输出 6%

与 Coding Plan 对比

方案月费用
Kimi K2.6 按量付费≈ ¥2,420
Coding Plan(会员)¥39~¥199
差价12~60 倍

Coding Plan 的核心价值:把缓存读取和大量输入都包进订阅费。

优化建议

  • 善用 /clear/compress 指令切断历史
  • 新话题主动开新 session
  • 可从缓存占比 92% 降至 70-80%,费用减半以上