VibeCoding 省钱指南 · 一页速查

高效对话与省钱第 6 / 7 篇

写作日期:2026-08-24|复核:2026-09-07|本篇没有可机器核实的锚点

零外链、无包名、无 CLI 断言 —— 它是省钱指南的速查卡。 ⇒ 正文一处未改。

⚠️ 唯一会过期的是下面那个 120× —— 它是视频口播的数字,不是本文实测。 配套长文里当场用 DeepSeek 的公开定价对冲过(命中价约为未命中价的 1/10), 并写明「数字口径不同」。 ⇒ 记结论的方向(缓存命中是省钱大头),别记这个倍数。 要当天的准确数字,去你实际用的那家的定价页看。

🧠 核心公式与认知

一次调用成本 = 输入成本 + 输出成本 输出 = 输出token × 单价 | 输入 = 深受缓存命中率影响(命中/未命中差价可达 120×)

  • 成本 ≠ 单价:便宜模型循环多 → 总账更贵。看总账,别看单价。
  • 80% 费用来自 20% 对话,共性是循环轮数多。
  • 三条黄金律:① 循环才是成本杀手 ② 少即是多,上下文做减法 ③ 杀鸡不用牛刀。

🎯 四心法 × 工具

心法 工具 一句话 无损 用在哪 开关
看账单 agenttrace 诊断+对比,找烧钱对话 — 所有 全程配合
减token·输入 RTK 压缩命令噪声,省 50–80% ✅ 命令类/开发机 全局开
减token·输出 Caveman 让模型简洁输出,省 75% ❌有损 只在「不读中间过程」的代码生成 拿不准=别开
减token·上下文 caveman-compress 压缩 CLAUDE.md — 文件臃肿时 推荐用
减循环 CodeGraph 知识图谱砍探索循环 — 大型项目 越大越用
提缓存命中 Reasonix DeepSeek专用,命中95–99%,输入成本→1/5 — 用 DeepSeek 用DS就配它
降单价 LLM路由 / Claude Code Router 按任务路由到不同模型 — 既要省又要效果 进阶必做

安装速记:agenttrace(TUI)/agenttrace --overview -f html | rtk init -g --opencode + rtk discover/rtk gain | npx reasonix code(Node≥22)


🔀 路由(降单价)速记

两种工作流(可组合):

  • 执行者⇄顾问者:弱模型干活,卡住才问强模型。→ Haiku执行+Opus顾问:分数翻倍,成本↓85%
  • 调度者→执行者:主流编排,但默认 subagent 同模型 不省钱 → 必须自定义路由。

三角色选型(成本优先,够用就行):

  • 顾问者 = 你能用的最强模型
  • 执行者 = 能干完活的最便宜模型
  • 调度者 = 中档即可(小白直接用最强)

怎么实现: Claude Code 原生多提供商开箱即用 | OpenCode 需 Claude Code Router 中间层 | 或用 CLI 脚本串联(探索用 Codex+GPT,编码切 Reasonix+DeepSeek)


🧩 模型×Agent 配对评分

组合 分 成本
Codex + GPT 80 基准(小白稳妥)
Codex + DeepSeek 50 ❌ 别接
Claude Code/OpenCode + DeepSeek 70 基准
Reasonix + DeepSeek 70 便宜 5× ✅

铁律:用哪家模型就用哪家 agent;Codex 不接第三方模型。


✅ 落地 7 步

  1. 装观测工具 → 找出烧钱的 20% 对话
  2. 全局开 RTK(无痛无损)
  3. caveman-compress 压缩 CLAUDE.md
  4. 纯代码生成场景 → 开 Caveman(其余关)
  5. 大型项目 → 上 CodeGraph
  6. 用 DeepSeek → 配 Reasonix
  7. 进阶 → 搭路由(执行者最便宜 + 顾问者最强)

典型省钱链路: 探索/计划 Codex+GPT → 编码 Reasonix+DeepSeek → 卡住回强模型当顾问擦屁股。


工具名已核对:agenttrace(github.com/luoyuctl/agenttrace)· RTK(github.com/rtk-ai/rtk)· Reasonix(npx reasonix code) 完整版见《VibeCoding省钱指南-保姆级教程.md》· 2026-07-14