API 厂商定价的认知套利:52% 是 AI 推理自建与 API 的成本分水岭
API厂商定价的认知套利:“割”GPU利用率盲区用户,52%是AI推理成本分水岭
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
分析指出,自建 GPU 推理要便宜过 API,GPU 利用率必须超过 52% 这一临界点,而多数 AI 创业公司利用率仅 30%-50%,实际在亏钱。以 4×H100 跑 70B 模型为例,利用率从 80% 降到 30%,每千 Token 成本从 $0.011 涨到 $0.045。API 厂商靠 90%+ 利用率摊薄折旧,赚的是客户算不清利用率的信息差。
来源:AI前线 · 微信公众号 · mp.weixin.qq.com