需要管理员会话才能查看服务用量。
集中查看请求规模、token 消耗、缓存命中和模型响应耗时。
按小时聚合输入、输出和缓存 token。
当前统计范围内的输入、输出与缓存占比。
比较不同模型的请求量、token 消耗和平均响应耗时。