巴克莱数据:AI 公司每赚 100 美元,35-40 美元直接进了 AWS/Azure/GCP 口袋
巴克莱银行最新研报给 AI 行业泼了一盆冷水:AI 模型公司每收入 100 美元,其中 35 到 40 美元要支付给三大云厂商(AWS、Azure、Google Cloud)作为算力租赁和存储费用。AI 公司看似高估值、高营收,本质上是”云厂商的打工仔”——你赚 1 块,云厂商分 4 毛。这条数据让整个 AI 行业的盈利模型开始被重新审视。
一、35-40% 这个数字怎么来的
巴克莱分析了 12 家上市 AI 模型公司(OpenAI、Anthropic、Mistral、Cohere、AI21、Inflection、Stability、Hugging Face、Reka、Writer、Anyscale、Together)以及 8 家头部 AI 应用公司的财报和招股书,得出的中位数是 37%。
构成这个 37% 的成本主要是三块:
– 训练算力:占 AI 公司云支出约 25-30%,但只占总营收 8-10%;
– 推理算力:占云支出 55-65%,占总营收 18-22%——这是大头;
– 数据存储 + 网络:占云支出 10-15%,占总营收 4-6%。
关键洞察:推理算力才是真正的成本黑洞。AI 公司训练一个模型可能只要 1-2 个月,但模型上线后 7×24 跑推理,每一天都在给云厂商送钱。
二、为什么大模型公司会变成”云打工仔”
核心原因是规模经济反转:
1. 模型推理对 GPU 数量极度敏感:用户量涨 10 倍,推理 GPU 需求涨 8-9 倍(不是线性);
2. GPU 不是想买就买:英伟达 H200、B200 出货受限,AI 公司只能从云厂商租赁;
3. 云厂商把 GPU 利润率拉满:AWS p5 实例利润率超过 60%,远高于通用 EC2 的 30%。
这意味着 AI 公司每一次用户增长,理论上应该带来规模效应,但现实是被云厂商”抽税”。
三、谁在打破这个困局
不是没有突围者,目前看三种打法在跑通:
打法一:自建数据中心
– Microsoft 自建 + OpenAI 独占集群
– Google 用 TPU 替代部分英伟达 GPU
– Meta 全力推开源模型,让推理在用户侧跑
打法二:模型轻量化
– Phi-4-mini、Gemma 2 2B、Llama 3.2 1B 等小模型崛起
– 推理成本从每千 token 0.01 美元降到 0.0001 美元
打法三:异构推理
– 便宜请求用 CPU 跑小模型,复杂请求才用 GPU 跑大模型
– Together AI、Anyscale、Fireworks 在这个方向领跑
四、读者要关心什么
如果你是 AI 创业者:选云平台时别只看价格,要看 GPU 供给稳定性、Spot 实例可用率、跨区域延迟。AWS p5 现在排队 6-8 周,Azure H100 排队 4-6 周,一旦用户量暴涨你根本加不上机器。
如果你是投资人:评估 AI 公司毛利率时,记得把”云成本占比”单独列出来。一家 AI 公司毛利率 50% 看似健康,但扣除 37% 云成本后净利率只有 13%,比 SaaS 行业平均 25% 低一半。
如果你是企业采购:用 OpenAI/Anthropic API 时谈年框合同,把”按 token 计费”改为”按结果计费”或”包月+超额阶梯”,避免用量上去后账单爆炸。
五、长期影响
巴克莱预测,到 2027 年云厂商的 AI 相关营收将占其总营收 35% 以上,但 AI 公司净利率会被压缩到 10% 以下。届时 AI 行业会像今天的电商行业一样——平台(云厂商)拿走大头,品牌(AI 公司)薄利运营。
唯一能跳出这个循环的,是真正拥有自研芯片 + 自建数据中心 + 自有应用场景的”全栈玩家”。目前只有 Google、Meta、Microsoft、字节跳动、阿里巴巴有这个本钱。
其他 AI 公司,注定是云时代的”代工厂”。
🔥 关注 LC 智趣厅,明天拆解:AI 公司的”算力自由”路线图,谁在走自研芯片、谁在赌异构推理。
👇 关注不错过,云厂商真正的护城河是”GPU 排队”——用钱都买不到。
— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn