Cookbook
Agents & skills · for AI agents

检查用量和配额

通过 MCP 读取 token 用量和月度配额——按 agent、用户、空间、日期或模型维度——以回答“我是否接近限额?”和“是什么在推高成本?”。

MCP tools:tenant_infousage_stats

两个只读工具可回答所有“我用了多少?”的问题。两者均仅返回元数据——令牌计数和事件计数,且绝不返回任何对话内容

你与配额的对比情况

tenant_info()                 # plan + monthly_token_quota (the ceiling)
usage_stats(group="total")    # tokens + events used so far this period

使用场景——“我是否快要用完了?” 将总数与 tenant_info 中的 monthly_token_quota 进行比较。超额费用采用后付费方式结算,因此展示“你已使用本月配额的 82%”可让用户在产生费用前做出决定。

是什么在驱动成本

usage_stats(group=…) 对相同的总数进行切片。根据你要回答的问题选择分组:

usage_stats(group="agent")    # which agent is busiest / burning the most tokens
usage_stats(group="user")     # which end user is heaviest — spot one runaway account
usage_stats(group="space")    # usage per customer space (multi-tenant fan-out)
usage_stats(group="day")      # trend over time — catch a spike the day it happens
usage_stats(group="model")    # cost mix across models — is an expensive model doing routine work?

使用场景一览:

  • “我的账单本月激增——为什么?” → 使用 group="day" 查找激增点,然后使用 group="agent" 查看来自哪个智能体。
  • “是否某个模型正在执行更便宜的模型也能完成的工作?” → 使用 group="model",然后考虑对违规者执行 update_agent(name, model=…)
  • “我应该对哪个客户进行向上销售/速率限制?” → 使用 group="space"group="user"

这是元数据,而非对内容的分析。它回答的是多少以及由谁/什么,绝不回答说了什么。聊天转录和终端用户资料故意无法通过 MCP 访问。

反馈报告。 首先突出显示最关键的那个数字——“你已使用 500 万月度令牌中的 420 万(84%)”——然后提供解释该情况的细分数据,并链接到控制台以获取完整视图: https://console.agent4.io/#/usage