分享
用量异常查询指南
输入“/”快速插入内容
用量异常查询指南
用户6813
用户6813
4月7日修改
核心即是缓存异常,主要有以下几种情况导致
1.客户端没有提供粘性会话参数,导致每次请求随机在号池中找个倒霉蛋发出去,而跨账号的缓存不是同步的,因此会导致缓存异常。常见场景在opencode
2.透传了某些不支持的参数,比如service_tier, 当前这个参数仅适用于openai的api,在codex中调用会报错,因此反复切号重试,codex desktop有过案例
3.某些场景会出现小概率异常情况,原因暂时不明,发生在codex模型使用claude code cli客户端,表现为似乎最大缓存读取数被限制,每次请求的读缓数量都是一样的。
发现异常时
1.尝试清除客户端的本地配置,然后使用api密钥-使用密钥中的推荐设置
2.联系客服协助排查
3.尝试切换到codex客户端
我们会每日检查token消耗情况,如果发现异常会邮件处理,但无法保证可以覆盖到所有异常情况
典型codex编程使用大概为7-12元/100M tokens,如果发现明显超出可以联系客服协助排查。
已知情况
1.Opencode没配置prompt key,缓存会有问题
2.Codex系客户端在显式配置了service_tier时,会出现频繁切号
3.Claude cli使用codex模型在小概率情况下,会出现缓存一直锁死在一个数值,具体原因暂不明确,推测是历史配置污染
4.一些小众的二次或多次分发会有问题
健康的缓存
在连续请求中,缓存读取递增,偶尔出现个别不对的情况可以接受
不健康的缓存