笔记用量与成本
错峰用模型能省钱,但例外要想全
我们用的模型厂商,在我写这篇时(2026 年 9 月)空闲时段按高峰价的一半计费。为了让同事的额度也跟着便宜,我让 AI 写了一个自动切换脚本:每 5 分钟对照一次当前时段,把网关的计价系数调到对应档位。另有一个独立的监控,每分钟检查一次,档位不对或者切换脚本很久没运行,就发邮件告警。
脚本的几条设计
- 每次都做完整对账,不是「到点才切」。哪一次漏跑了,下一次会自动补上。
- 读到任何不认识的数值,整轮中止,什么都不改。
- 修改前备份旧值,修改后读回来比对。
- 停用要两步。只删掉定时任务,档位会冻在当时那一档;如果冻在便宜档,进入高峰后就一直按半价记账。所以删掉定时任务之后,必须马上手动写回高峰档。
漏掉的例外
时区。厂商的时段按北京时间写,服务器用的是 UTC 时间。判断「现在是不是高峰」时,我们看错了参照的时钟,连着错了两次。后来约定:一律按服务器的 UTC 时间判断,不看电脑上的本地时间。
节假日。厂商的规则写着:「其余时段,包括周末及中国法定节假日全天均为空闲时段。」而脚本只认星期几和钟点。结果是,工作日赶上法定节假日时,按厂商公布的规则,高峰那几个小时应该按空闲价计费,网关却仍按高峰价给同事记账,多记了一倍。监控用的是同一套判断逻辑,所以没有报警。这个问题是让另一个 AI 审稿时才发现的。
还有一个问题我到现在也没完全解决:监控本身停了,由谁来发现?