模型 API 聚合与中转
买方要的是兼容接口和按 token 或次数计费,卖方通常不拥有 GPU,只做路由、账本和加价。
开发者或产品团队往往要同时用多家模型:有的任务走国产旗舰,有的走海外编码模型。每家开一个账号、改一套 SDK,成本主要花在对接和账单对不上。聚合与中转把多家上游收成一条 OpenAI 兼容接口,按 token、按次或按套餐向下游收费。
先给答案
这是一门转售调用权的生意。买方买的不是机柜,是「用一个 key 打到多个模型」。收入来自进销差价、套餐溢价或企业承诺消费额。它和专有机房算力相邻,但货不同:一边卖 token,一边卖 GPU 小时。
这个项目是什么
典型产品是一层网关:鉴权、路由、限流、日志、余额。请求进来后,按价格、延迟或可用性选上游,失败则换一家。对应用来说,接口长得像官方 SDK,换模型只改 model 字段。
国内常见形态还包括「中转站」:站长从上游拿额度,再以更低或更灵活的套餐卖给个人开发者和小团队。国际侧有独立路由商,把上百个模型收在一个控制台里。2026 年 8 月,支付公司 Stripe 宣布收购模型路由服务 OpenRouter(交易对价为媒体报道,官方未逐条确认),说明「谁经手推理流量」已经成为基础设施层的资产。
谁付钱,如何盈利
- 个人与小团队:预充值、按量扣费,或按周/月买「可调用次数」的 Coding Plan。
- 企业:承诺月消费、按账号分级、发票与审计日志。自带官方 key 只走路由时,有的平台免抽成或设免费额度。
- 利润:上游牌价与下游售价之差;套餐里把贵模型与便宜模型捆在一起;企业支持费。
毛利率取决于能否拿到稳定上游、以及用户是否把高耗 token 的智能体循环打满。账单对不齐、上游突然断供,是这门生意的日常故障。
怎么发展起来
大模型 API 按 token 公开标价之后,出现两层需求:一是「一个接口打全球模型」,二是「绕过官网排队或支付限制」。前者长成合规路由与企业网关;后者在部分地区长成灰色中转,伴随账号共享、服务条款和出口管制风险。产品形态从「换一个 base URL」演进到负载均衡、缓存、内容审核和按团队分账。
时间线上的背景见发展纪 · 成本塌陷:开源与国产模型把「必须绑一家官方 API」打破之后,聚合才有货可转。
常见变体与边界
| 变体 | 还算不算本篇 |
|---|---|
| 企业自建网关,只服务内部应用 | 算同一技术,但买方是自己,通常不叫「中转站」 |
| 把 GPU 小时租出去 | 见案例·02、案例·03 |
| 在技能商店卖一个包装好的机器人 | 见案例·18 |
私域里用「内部渠道、日返、算力份额」拉人入金,与「可登录的 API 控制台」不是同一交易,见案例·02 的边界说明。
三句话总结
- 中转卖的是模型调用权,不是机房资产。
- 收费按 token、次数或承诺消费,利润在差价和套餐。
- 上游稳定性和账单可审计,决定这门生意能否从个人站长做到企业网关。
延伸阅读
- 下一篇:专有机房算力出售
- 账单机制:三十讲 · 缓存与计费
- 导读:本库怎么用