VibeCoding 省钱指南 · 一页速查
🧠 核心公式与认知
一次调用成本 = 输入成本 + 输出成本 输出 = 输出token × 单价 | 输入 = 深受缓存命中率影响(命中/未命中差价可达 120×)
- 成本 ≠ 单价:便宜模型循环多 → 总账更贵。看总账,别看单价。
- 80% 费用来自 20% 对话,共性是循环轮数多。
- 三条黄金律:① 循环才是成本杀手 ② 少即是多,上下文做减法 ③ 杀鸡不用牛刀。
🎯 四心法 × 工具
| 心法 | 工具 | 一句话 | 无损 | 用在哪 | 开关 |
|---|---|---|---|---|---|
| 看账单 | agenttrace | 诊断+对比,找烧钱对话 | — | 所有 | 全程配合 |
| 减token·输入 | RTK | 压缩命令噪声,省 50–80% | ✅ | 命令类/开发机 | 全局开 |
| 减token·输出 | Caveman | 让模型简洁输出,省 75% | ❌有损 | 只在「不读中间过程」的代码生成 | 拿不准=别开 |
| 减token·上下文 | caveman-compress | 压缩 CLAUDE.md | — | 文件臃肿时 | 推荐用 |
| 减循环 | CodeGraph | 知识图谱砍探索循环 | — | 大型项目 | 越大越用 |
| 提缓存命中 | Reasonix | DeepSeek专用,命中95–99%,输入成本→1/5 | — | 用 DeepSeek | 用DS就配它 |
| 降单价 | LLM路由 / Claude Code Router | 按任务路由到不同模型 | — | 既要省又要效果 | 进阶必做 |
安装速记:
agenttrace(TUI)/agenttrace --overview -f html|rtk init -g --opencode+rtk discover/rtk gain|npx reasonix code(Node≥22)
🔀 路由(降单价)速记
两种工作流(可组合):
- 执行者⇄顾问者:弱模型干活,卡住才问强模型。→ Haiku执行+Opus顾问:分数翻倍,成本↓85%
- 调度者→执行者:主流编排,但默认 subagent 同模型 不省钱 → 必须自定义路由。
三角色选型(成本优先,够用就行):
- 顾问者 = 你能用的最强模型
- 执行者 = 能干完活的最便宜模型
- 调度者 = 中档即可(小白直接用最强)
怎么实现: Claude Code 原生多提供商开箱即用 | OpenCode 需 Claude Code Router 中间层 | 或用 CLI 脚本串联(探索用 Codex+GPT,编码切 Reasonix+DeepSeek)
🧩 模型×Agent 配对评分
| 组合 | 分 | 成本 |
|---|---|---|
| Codex + GPT | 80 | 基准(小白稳妥) |
| Codex + DeepSeek | 50 | ❌ 别接 |
| Claude Code/OpenCode + DeepSeek | 70 | 基准 |
| Reasonix + DeepSeek | 70 | 便宜 5× ✅ |
铁律:用哪家模型就用哪家 agent;Codex 不接第三方模型。
✅ 落地 7 步
- 装观测工具 → 找出烧钱的 20% 对话
- 全局开 RTK(无痛无损)
caveman-compress压缩 CLAUDE.md- 纯代码生成场景 → 开 Caveman(其余关)
- 大型项目 → 上 CodeGraph
- 用 DeepSeek → 配 Reasonix
- 进阶 → 搭路由(执行者最便宜 + 顾问者最强)
典型省钱链路: 探索/计划 Codex+GPT → 编码 Reasonix+DeepSeek → 卡住回强模型当顾问擦屁股。
工具名已核对:agenttrace(github.com/luoyuctl/agenttrace)· RTK(github.com/rtk-ai/rtk)· Reasonix(npx reasonix code) 完整版见《VibeCoding省钱指南-保姆级教程.md》· 2026-07-14