创建时间: 2026-08-05最后更新: 2026-08-05作者: yangbo(1f7c90a4b)
1. 厂商都返回 Usage,但口径并不相同
OpenAI、Anthropic 和 Gemini 的响应里都能找到 Token 用量,看起来只要改几个字段名就能统一。真正实现时会发现,最麻烦的不是命名,而是字段之间是否包含。
OpenAI 的 input_tokens 包含缓存读取量,output_tokens 又包含 reasoning token。Anthropic 把普通输入、缓存创建和缓存读取分成三个可以相加的桶。Gemini 的 promptTokenCount 包含缓存内容,thoughtsTokenCount 则单独参与总量。
如果适配器没有先弄清包含关系,就会把同一批 Token 放进两个计费桶。账单数值可能只多几厘,但调用量上来以后会形成稳定偏差。
订阅后可阅读剩余内容
AI 电子伴侣企业级项目实战
已发布239节计划发布120节目标已完成199%