不装新 SDK、不改业务代码、不用逐家申请 Key。
邮箱或第三方账号登录,建一把 Key 就能调用全部厂商的模型,不用绑卡。
sk-····a41f
保留现有 SDK 与代码,只改两个环境变量。
OPENAI_BASE_URL= https://compassapi.ai/v1
模型名换成统一 slug,同一份代码随时切模型。
model="glm-5.2"
降级、缓存与结算的处理方式,一屏看完。
全部厂商共用一个 base_url 和一把密钥,模型名统一 slug,不用逐家申请 Key,切换模型不改架构。
同一模型挂多条上游渠道,按权重分流;超时或限流自动重试下一条,调用方无感。
重复前缀的输入按两折计费,检索增强类应用平均省下三成成本。
所有模型同一套计价口径,统一美元结算,不用在多家帐单之间换算汇率与阶梯价。
只记模型、token、耗时与 request id,不落请求体与响应体,合规评审好过关。
每把密钥可单独设额度上限与可用模型,泄露或跑飞不会灼穿账户。
上游渠道、路由策略与计费日志收在同一个控制台,出问题不用逐家排查。
同一模型与官方同价,省下的部分来自缓存命中折扣与失败重试的浪费。拖动看你的月度账单。
估算按公开单价与平台平均缓存折扣计算,实际以消费日志为准。
USD / 每百万 token,缓存命中的输入按两折计。
凡是支持自定义 OpenAI base_url 的客户端与框架,填地址和密钥即可。
未列出的字段原样透传给上游,不做改写。
不用。上游渠道由平台维护,你只需要本站的一把密钥和一个接入地址,就能调用所有已接入厂商的模型;新厂商上线后也无需任何改动,直接换个模型名即可使用。
每个模型有自己的折扣价,定价表里划线的是上游官方价,右侧就是你实际付的价格,不分账号等级。省下的部分还来自缓存命中折扣与失败重试不再由你承担。
前缀缓存由平台自动判定,命中部分的输入按标准价两折结算,缓存创建按 1.25× 结算。消费日志里 cached_tokens 单列展示,请求详情能看到完整计费公式。
只改两个环境变量:base_url 换成本站接入地址,api_key 换成你的令牌。流式、function calling、视觉输入等字段与 OpenAI 完全一致。
同一模型挂多条上游渠道,超时或限流自动重试下一条,调用方无感;边缘节点故障时请求自动转到同区备用节点。
只记模型、token 数、耗时与 request id,不落请求体与响应体,合规评审好过关。
不用。邮箱或第三方账号登录即可开始调用,额度用完再按需充值。