按时段计价的模型上,61% 的花费落在高峰时段,同样的 token 最多要贵一倍。
不需要盯着的任务——测试生成、迁移、文档整理——排到非高峰时段跑。
开源 · 在你自己的机器上运行
编程 Agent 已经把每一轮对话写进了日志。本工具读取这些日志,告诉你少数几件值得改的事——每一件都带一个数字。
# 60 天示例数据,直接生成完整看板
$ git clone https://github.com/jxxyx-bloop/ai-observatory
$ cd ai-observatory/observatory
$ python3 observe.py demo digest report
仅用 Python 3 标准库。无需安装、无依赖、无构建步骤。
输出结果
按时段计价的模型上,61% 的花费落在高峰时段,同样的 token 最多要贵一倍。
不需要盯着的任务——测试生成、迁移、文档整理——排到非高峰时段跑。
缓存复用率只有 38%。重建上下文的成本约为读回它的 12 倍。
相关任务放在同一个会话里做,不要反复重开。这个差距比换任何模型都值钱。
如果按量计费,同样的工作要花 412 美元。这里没有需要改的地方。
继续用这个套餐。等每月轮次跌破 400 再重新评估。
十五项检测。每月价值低于 15 美元的会被降级,所以排在最前面的一定值得看——用得健康时,它也会照实说健康。
工作方式
Agent 已经把日志写好了。我们就地读取这些文件——无需安装,也不用开启任何东西。
token、缓存、时段与成本——按任务实际运行时生效的价格计算。
一份排好序的改进清单,每条都附证据,以及每月值多少钱。
无需 API key、无代理、无账号、不联网。采集本身消耗零 token。
有何不同
DeepSeek 与 GLM 按时段计价。在 UTC+7 到 +9,它们的高峰时段正好是你的工作下午。
在 18 美元的套餐上,“你花了 412 美元”是虚构的,“23 倍回报”不是。
0.1× 是 Anthropic 的惯例,不是定律。算错它,页面上最重要的那个数字就错了。
IDR、VND、THB、PHP、MYR 等——并对照当地日薪,因为 412 美元在各地的分量并不一样。
此处所有金额均为公开 API 标价——即价格上限。企业合同与订阅套餐的实际成本更低。
隐私
除非你亲手改配置文件,否则没有任何数据离开本机。
保持最新
仪表板是一个文件,不是服务器。渲染时会打上时间戳,页面自己完成时间差计算——离线运行,无需向任何服务查询。
什么都不显示。始终亮着的横幅没有人会看。
提示上次构建的时间,并说明此后的新会话尚未计入这些数字。
直接说明它已过期,并附上刷新命令和一键复制按钮。
示例数据始终会标明身份,无论刚刚生成与否。
One line. It checks your setup, reads what your coding agents already wrote on this disk, builds your dashboard, puts an icon in your Dock and opens it.
git clone https://github.com/jxxyx-bloop/ai-observatory.git && cd ai-observatory/observatory && python3 observe.py setup
What that command does, step by step →
Still stuck? Run python3 observe.py doctor — it checks every step and prints the exact fix for whichever one failed.