计量口径与局限
2026/9/7大约 2 分钟使用指南
计量口径与局限
Token 不等于订阅额度
本地结算使用上游返回的 usage 和本站配置的计费倍率。模型、输入输出、缓存、思考 token、服务档位等都可能影响消耗,不能简单把“总 token 相同”视为“上游扣减相同”。
图片、PDF 和工具请求怎样计量取决于模型与接口;不是所有能力都仅按文本 token 计费。高思考强度或快速模式也不等于一个适用于所有模型的固定倍数。
当前能记录什么
新版会被动记录账号池请求的模型、请求/实际转发参数、上游报告的服务档位、usage 中存在的 token 明细、命中账号、尝试结果、耗时与本地结算,以及采集时的上游窗口观测。上游没有提供的字段记为未知,不填成 0。
标定记录不保存提示词、回答、工具参数或凭据。这里描述的是专用标定表,不是对全部代理访问日志和第三方平台的数据保留承诺。
记录数据不等于已经自动学出模型权重。 当前还没有自动拟合并应用模型/思考强度/快速模式倍率的流程,也不承诺固定 5–10% 的误差范围。
一起使用时的局限
- 上游百分比是账号汇总观测,更新有延迟和粒度限制,不能精确拆成每次请求的扣减。
- 网关能按用户和密钥记录本地结算,再与同时间段上游变化对比;并发时不能把某次百分比跳变全算给一个人。
- 绕过网关产生的上游消耗无法归属给某位成员。对账差额还可能来自周期、换算比例或统计延迟,不能单凭正差额认定有人绕过。
- 钱包、订阅计费、密钥额度与厂商份额是不同约束;钱包不足仍会拦截请求。
刚开始校准时应先观察,可信后再开启强制。管理员标定说明。
