OpenAI 兼容 API——一行换 base_url,接入两个模型生态。
每一次调用可审计、可计费、可管控。
两个生态一个货架,按成本 / 延迟 / 能力自动路由,自动 fallback,不锁定任一厂商。
每次调用记录模型、token、成本、延迟、发起人、策略命中——审计不是日志,是产品。
权限、配额、内容策略在网关层执行——治理不靠模型自觉,靠网关。
按团队 / 项目计费分账,预算上限与告警,token 级计量。
我们不做货架页——接上之后 GET /v1/models 实时返回全部 119 个模型,横跨两个模型生态(国际目录为 AWS 云与模型产品授权代理)。全部按成本价直通,我们不加价、不赚差价——模型调用是改造服务的配套,不是我们的生意。
落地服务的每一笔账,都从这一层的审计链开始。网关已在生产环境运行,每天处理真实流量——这是我们「敢按结果收费」的技术底气。