单次很便宜,按小时不便宜
每一次模型调用单看都小到不值一提,四个智能体跑一下午就不是了。预算正是安静地消失在这两个事实的差距里。
为什么它在变大之前都看不见#
按单次算,智能体便宜得没人会去查。按小时算,几个智能体各自反复读文件、重试、带着很长的上下文,就不便宜了。这两个数字都不算被藏起来——只是被放在你从不会去看的地方,而且单位对不上你真正想问的问题。「这周贵不贵?」这个问题,是没法从一串 API 调用记录里读出来的。
供应商后台也补不上这个缺口。它知道你的账号花了多少,但不知道是哪个智能体、哪个仓库、哪条会话花掉的。而账单超预期时,你需要的恰恰就是这个分解——也恰恰是没人手上有的那一份。
一份账目,在你自己的机器上#
既然每一次模型调用本来就要经过本机的代理,那它就可以在发生的地方被记下来。Mirasim 为每一次调用维护同一份账目——token、缓存命中、成本估算——解算与计算都在你自己的机器上完成,不在别处。选一个时间范围(今天、7 天、30 天或 90 天),它会先给出直接回答问题的那几个数字。
- 调用次数、总 token、输出 token、缓存命中率与成本估算——每一项都与上一周期对比,于是「比平时多」是一个事实,而不是一种感觉。
- 同一时间范围内,按智能体、模型、账号、工作区、会话分解。这一部分是供应商后台给不了的。
- 有多少工作是走了额度兜底、而不是你自己的订阅。这个占比高的话,瓶颈在你的套餐,不在你的提示词。
它在实际使用中改变了什么#
有用的结果不是省钱,而是归因。一旦花费能按模型、按会话分解,那些贵的习惯就变得可见而且具体:某个长上下文的循环每轮都把同一棵目录树重读一遍;某个任务上推理档位一直开得很高,而它根本不需要;缓存命中率掉了下来,因为某段提示词现在每次调用都在变。
它也让选模型变成一个经验问题,而不是感觉问题。会话各自带着自己的模型与推理档位,所以换成便宜的那个只差一次切换——一周之后,你可以翻账目看看:便宜那个到底有没有让结果变差。

