Token 成本控制:用量跟踪与省钱配置
自托管省掉了「平台溢价」,但模型调用本身还是要钱。OpenClaw 给足了观测与调节的手柄。
先看得见,才管得住
- Token 用量:官方文档有专门的「令牌用量和成本」参考页;Control UI 概览里也有用量数字(手机 App 的 Overview 页同样显示 Tokens),各模型提供商自己的控制台里也能看到账单明细。
- 会话级排查:
/context list看上下文占用——上下文越长,每轮越贵。 - 仪表板:多会话并行时在 Control UI 里横向对比谁的消耗大。
四个省钱配置
- 智能体分工:闲聊智能体用性价比模型,重活智能体才用旗舰——
agents配置里逐个指定。 - 子智能体降档:
agents.defaults.subagents.model给跑长任务的子智能体配便宜模型(官方 FAQ 原文建议)。 - 记忆刷新降档:压缩前的记忆整理轮次单独指定本地小模型,示例见记忆搜索。
- 思考档位:简单任务把思考级别调低或关掉,推理开销立减。
上下文也是钱
习惯层面
- 先小后大:新自动化先跑小样本,看单次成本再放量。
- 媒体生成单独记账:图像、视频、音乐生成走的是各提供商的计费,和文本模型分开看。
- 订阅额度当免费池:轻任务吃订阅额度(见订阅登录),API 只留给真正需要的地方。
故障转移的性价比用法
把「主力旗舰 + 备用性价比」配成回退链:平时体验旗舰,限流高峰自动降档不中断——省钱和可用性两头都要。
发动机选好了,给整套系统上保险:安全设计。