AI 编程的本质是什么?是用 Token 换生产力。每一轮补全、每一次对话,背后都是实打实的成本。但市面上绝大多数 AI 编程工具,要么不提供用量统计,要么数据分散在各家平台,根本没法统一查看。对于追求效率的开发者来说,这种"信息黑洞"是不可接受的。Token Monitor 用一套本地化的监控方案解决了这个问题。

Token Monitor 简介
Token Monitor 是一款桌面小部件,能实时展示各 AI 编程工具的 Token 消耗与 API 剩余额度。功能上,它支持按工具、设备、模型、Session 多维度分项显示,同时具备多设备实时同步和历史用量趋势分析,兼容 Windows / Linux / macOS 三大系统。
当前版本下,Token Monitor 已覆盖 20 款 AI 编程工具的 Token 统计、10 家 AI 平台的额度监控,并可单独查看 Claude Code、CodeX、OpenCode 的 Session 用量明细。具体支持列表,请参考 GitHub 仓库的 README 文档。
核心功能
实时 Token 追踪:覆盖 20 余款主流 AI 编程工具,每轮对话后数秒内刷新用量
多维度分组统计:可按工具、设备、模型、Session 或账户额度拆分查看
Session 级别明细:针对 Claude Code、Codex、OpenCode,可展开查看每轮提问及回复的 Token 消耗详情
缓存命中统计:点击任意工具,可查看输入 Token 的缓存命中率与输出 Token 明细
成本自动换算:Token 用量旁附带成本统计,支持 USD / TWD / HKD / CNY,汇率每日自动更新
用量趋势可视化:主页提供热力图与趋势图,独立仪表板支持柱状图 / K 线图切换,展示跨设备、按工具 / 模型的用量历史
数据导出:支持导出 CSV + JSON 格式,方便接入表格、Obsidian 或自建监控系统
AI 额度监控:覆盖 10 家 AI 平台的 API 剩余额度,支持 session、周、账单等多维度额度窗口
灵活外观与交互:支持主题切换、工具列表拖拽排序、菜单栏 / 系统托盘快捷弹窗、悬浮小窗模式
本地优先,隐私安全:单设备使用无需服务器,只有汇总数字会离开本地
界面展示



Token Monitor 启动后会自动采集大部分 AI 编程工具的 Token 使用数据,并在主页汇总展示总用量及各模型用量。部分工具默认未启用采集,需到设置中手动开启;你也可以关闭不需要的工具来提升采集速度。
用量支持按天、按月或总计查看,并可分别筛选各模型及 AI 工具的具体消耗,还会按照模型的官方价格进行价格计算(这么一看国产模型价格是真的便宜啊)。
软件有主页、工具、状态、设备、模型、会话、额度、趋势这8个页面。直接点击左下角的按钮会按照列表顺序向下切换页面,也可以点击按钮旁的箭头选择切换到哪个页面。
使用体验
在实际使用中,Token Monitor 给我最大的感受就是"省心"。过去我要查看 AI 编程的用量,得分别登录各个 API 中转站的后台,一个页面一个页面地翻,费时又费力。现在打开 Token Monitor 的主页,所有工具的 Token 消耗就一览无余了——总用量、各模型占比、不同工具的消耗分布,全都聚合在同一个界面里,省去了来回切换页面的麻烦。
用量统计的维度也很灵活,可以按天、按月或查看总计,每个模型、每个 AI 工具的具体消耗都能单独筛出来看。比如我发现某个月用量特别高,点进去一看,原来是某个工具的项目对话特别长,很快就定位到了问题源头。
价格自动计算也是个很实用的功能。Token 用量旁直接附带对应成本,支持 人民币、美元等多种币种,汇率每天自动更新。这样一来,不用自己再去算"XX 万 Token 到底花了多少钱",账单上的每一笔都和具体的操作对应上了,心里特别有底。
最让我惊喜的是单个 Session 的 Token 明细。点进 Claude Code、Codex 或 OpenCode 的某次对话,可以看到每一轮提问消耗了多少 Token,甚至能展开查看每次回复的 Token 拆分与用到的工具。这对于优化 Prompt 很有帮助——我能清楚地知道哪些提问特别"贵",从而调整自己的提问方式,把成本降下来。