用量与成本
每一次模型调用都记入同一份本机账目,包含 token、缓存命中和成本估算,全部在你的机器上计算。
流量账本#
智能体按单次调用计算成本很低,按小时计算则不低,预算往往消失在这两者的差距之间。流量账本把每一次模型调用记入同一份账目,因此「本周花了多少、花在哪里」是一个可以查到答案的问题。
选择一个时间范围,可选今天、7 天、30 天或 90 天。页面顶部给出几个关键数字:调用次数、总 token、输出 token、缓存命中率和成本估算,并逐项与上一周期对比。
完整账目所选时间范围内的调用次数、token、缓存命中率和成本估算,下方是按智能体、模型、账号、工作区和会话的分摊。(该控件不在当前这一屏上)
这块面板上的按钮可以直接点,点着看看。
全部在本机计算,页面也展示了完整链路#
这一页上的内容都不来自云端分析服务。页面本身会说明数据来源,以及渲染它使用了多少次云端请求。
- 转发本机代理原样转发模型流量,并留存一份副本
仅在 127.0.0.1 上进行,不改写、不解析,也不会阻塞正在运行的会话。
- 落盘原始报文写入磁盘
认证头在写入磁盘的同时即被替换为指纹。
- 解算离线把记录解算为 token、缓存和模型相关数据
这就是本机的用量账目。原始报文被回收之后,它仍然保留。
- 渲染本页对账目进行汇总并绘制
仅读取本机磁盘。
查明成本的去向#
趋势图按类型、智能体或模型,把 token 用量随时间展开。看过一次你就会了解关于智能体成本最有用的一点:缓存读取通常占绝大部分,因此真正值得关注的是它下方的那条曲线。点击图例中的某一项可以隐藏它,查看其余部分。
分摊表按五个维度给出明细:智能体、模型、账号、工作区和会话。每行包含 token 占比、调用次数、输入、输出、缓存读取、命中率、成本估算和最后活跃时间。点击任意一行会把它加入整页筛选条件,因此只需点两下就能从「30 天」缩小到某一个会话上的某一个模型。
- 按工作区:查看哪个项目实际消耗了预算。
- 按会话:找出那次长时间运行的对话,它的成本超过了当天其余全部。
- 按账号:了解花费在各订阅与密钥之间如何分布。
- 按模型:判断成本较高的模型是否值得使用。
细化到单次调用#
调用列表按时间倒序排列,包含时间、智能体、模型、状态、耗时和工作区。选中某一条后,详情面板给出它的供应商、耗时与大小、token 明细、推理 token、缓存命中率和成本估算,以及原始请求与响应正文(前提是它们仍保存在磁盘上)。原始报文被留存策略回收后,详情面板会说明这一点,统计数据仍然完整。
需要在别处使用时,可以把当前视图导出为 CSV;想确认磁盘上究竟保存了什么,可以在 Finder 中显示账目文件和录制文件。
mirasim ui-cli --port 4970 traffic stats --days 30 --group-by model
mirasim ui-cli --port 4970 traffic calls --hours 24 --limit 50
mirasim ui-cli --port 4970 traffic meta # footprint + export disclosure这一页有错或缺了什么? 告诉我们