惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

IT之家
IT之家
Y
Y Combinator Blog
T
Tailwind CSS Blog
G
Google Developers Blog
博客园 - Franky
Google DeepMind News
Google DeepMind News
阮一峰的网络日志
阮一峰的网络日志
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 聂微东
爱范儿
爱范儿
博客园 - 【当耐特】
腾讯CDC
T
The Blog of Author Tim Ferriss
MongoDB | Blog
MongoDB | Blog
H
Help Net Security
C
Check Point Blog
大猫的无限游戏
大猫的无限游戏
M
MIT News - Artificial intelligence
博客园_首页
Stack Overflow Blog
Stack Overflow Blog
The GitHub Blog
The GitHub Blog
Engineering at Meta
Engineering at Meta
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报

博客园 - AlfredZhao

sed 一条命令批量替换 SQL 文件路径 执行新项目 python 脚本前,先用 conda 建一个独立环境 Git 提交代码:从报错到 SSH 免密推送 GitHub 克隆他人私有仓库:从授权到下载 理解Oracle Property Graph:以账户转账示例完成图特性最小测试 APEX 无法分配 SH 用户?一个存储过程轻松解决 SH 中文化样例数据使用手册 Oracle 排除非业务表:一份能直接抄的“全量过滤”SQL 进程都杀了,为什么 `netstat` 还能看到端口? MAC 空间告急?Codex 的 156GB 缓存垃圾,这样清! 人工清理问题数据:先查准,再删除 TK(Trusted Knowledge)为何而生? 使用快捷键快速切换 Mac 外接显示器模式 客户环境 Nginx 配置:流式报表与超时排查要点 Security Central:数据库安全的统一控制与运营平台 Palantir 眼中的一次“订单可能延期”,如何成为实时决策的起点? 从一条订单消息到 Bronze、Silver、Gold:我的第一次 Kafka + Lakehouse 实验 UUID v4 与 v7:同样是唯一 ID,为什么数据库表现可能完全不同? 用 crontab 给 LLM 使用量装上“监控眼” DeepSeek 与 GPT API 价格调整:该关注什么? 查看 Oracle 数据库中的定时任务执行情况 Codex 专用用户登录后自动进入默认项目目录 Mac 小技巧:用方向键优雅处理超长网址 Oracle GDD 与 Raft:别把共识机制和数据主权混为一谈 在 Oracle APEX 中用 BGE_BASE 生成向量:从模型导入到历史数据更新 行业人+AI:真正有价值的四个关键要素 知识库文件解析失败:一次由 Domain Index 引发的定位记录 Unicode 码位数、UTF-8 字节数、中英文差异和 Oracle 长度别再混淆了 Skill 的使用:从路径到能力边界 切换 Embedding 模型时,千万别忽略历史向量维度
AI编程系列01:裸 API 账单场景下,如何自建 LLM 用量可视化看板
AlfredZhao · 2026-06-03 · via 博客园 - AlfredZhao

很多开发者接入聚合型 LLM API 后,会遇到一个很现实的问题:服务商只给账单接口,不提供 Web 管理后台。Token 消耗、扣费明细、成本趋势都藏在 JSON 里,看得见数据,却看不清变化。

02-api-window

按照上篇文章《氛围编程实战系列:先规划清楚学习路径》这个规划路径,我们今天就来用 AI 先开发一个 LLM 使用量监控功能。

01 | 先看清使用场景

这类场景可以叫“中转代理式裸 API 计费场景”。

开发者通过 LiteLLM 模型网关接入多家大模型厂商 API,服务商负责统一转发和统一计费,但没有配套 Web 可视化控制台。用户只能通过 curl 调用账单接口,拿到原始 JSON 文本。

问题也随之出现:数据是有的,但缺少折线图、饼图这类直观报表,模型费用占比、每日扣费变化都需要自己整理。

01-json-fog

因为使用AI编程消耗的token量还是很多的,而笔者目前计划可用的配额又非常有限,所以能有一个可视化监控界面就非常必要,这样能更直观看到账户余额消耗情况,做到心中有数,从而更合理地安排本周的AI编程任务。

02 | 自建看板的基本思路

一个轻量方案是:定时拉取账单接口 JSON,清洗字段后入库,再用图表组件展示 Token 消耗和费用趋势。

03-dashboard-loop

把定期的数据先落到 CSV,使用 Oracle 外部表定义直接访问,再基于视图做报表或图表,让Vibe Coding直接基于这些数据,开发一个前端界面展示。

03 | 自建看板的具体实现

Oracle外部表需要创建一个directory,例如:/u01/media/xxxx,赋予该目录高权限,便于其他OS层面的普通开发用户可访问此目录。

同时数据库层面内部对具体开发用户赋予该目录读写权限,外部表的具体创建语句,直接让Codex调用Oracle的skill给出即可,这种底层数据相关的,建议还是要人工确认下是否符合自己的预期后再创建。

假设LLM提供商给的API查询余额方法usage.sh,这个脚本查询结果是一整串原始json信息。

我们可以这样把该json串信息加工,只取其中想关注的值,直接让Codex来做就OK,这里给出一个笔者实际使用的示例如下:

[alfred@xxxx-dev1 ~]$ cat /home/alfred/scripts/llm_usage.sh
#/bin/bash

  usage_json=$(/home/alfred/scripts/usage.sh)

  printf '"%s",%.6f,%.6f,%.6f,"%s","%s"\n' \
    "$(date '+%Y-%m-%d %H:%M:%S')" \
    "$(jq -r '.info.spend' <<< "$usage_json")" \
    "$(jq -r '.info.max_budget' <<< "$usage_json")" \
    "$(jq -r '.info.max_budget - .info.spend' <<< "$usage_json")" \
    "$(jq -r '.info.budget_duration' <<< "$usage_json")" \
    "$(jq -r '.info.budget_reset_at' <<< "$usage_json")" \
    >> /u01/media/xxxx/llm_usage_alfred.csv 

然后设置os定时调用该脚本,多长时间调用一次取决于你对观测颗粒度的需求,笔者这里设置每半小时追加写入csv文件:

*/30 * * * * /home/alfred/scripts/llm_usage.sh

Oracle数据库层面直接使用外部表加载这个csv文件。

然后Vibe Coding帮解决前端界面开发和展现工作,哪里不满意,直接对话给指令让它微调即可。

这样就自定义出一个LLM使用情况的监控界面,PC端效果如下:

同时,也可以使用手机移动端进行查询(支持 PWA),起初移动端显示有些bug,但没关系,直接告诉Codex,让它帮忙修改好就OK:

笔者注:PWA 的全称是 Progressive Web App,中文通常翻译为“渐进式 Web 应用”。

04 | 这套方案补齐了什么

它补齐的不是模型能力,而是用量可观测能力。

对个人开发者、小团队 AI 项目、初创 AI 产品来说,裸 JSON 账单很难长期人工阅读。把它变成私有化用量看板后,每日消耗、剩余额度、模型费用占比才更容易被持续跟踪。

这就是“自研 API 账单采集 + 可视化看板方案”的核心价值:在没有商用管理后台的情况下,用低成本方式把账单数据变成可理解、可追踪的成本信息。

关注我,和AI一起成长~