大模型价格战之后:AI商业化进入按结果付费时代
一个 10 人客服团队,2024 年用 GPT-4o mini 把每月 API 账单压到几千元。2026 年老板问的是:AI 预算涨了,投诉率没降,省下来的人时在哪?采购对话从“每百万 token 多少钱”换成“每解决一个问题多少钱”。
1. API 降价与免费策略回顾
先看价格战的公开节点,用来判断厂商为什么后来不愿只卖 token。下表是 2023—2024 年的典型动作,2026 年实际价格以各厂商控制台和合同为准。
| 时间 | 厂商/模型 | 公开价格 | 动作 | 来源 |
|---|---|---|---|---|
| 2023-03 | OpenAI gpt-3.5-turbo | $0.002/1K tokens | 比原有 GPT-3.5 便宜 90% | OpenAI 官方博客 |
| 2024-05-13 | OpenAI GPT-4o | $5/1M 输入,$15/1M 输出 | 比 GPT-4 Turbo 便宜 50% | OpenAI 官方博客 |
| 2024-07-18 | OpenAI GPT-4o mini | $0.15/1M 输入,$0.60/1M 输出 | 取代 GPT-3.5 Turbo | OpenAI 官方博客 |
| 2024-03-13 | Anthropic Claude 3 Haiku | $0.25/1M 输入,$1.25/1M 输出 | 小模型低价线 | Anthropic 发布页 |
| 2024-05 | 阿里云通义千问 Qwen-Long | 输入 0.0005 元/千 tokens,输出 0.002 元/千 tokens | 降价 97% | 阿里云官方发布 |
| 2024-05 | 百度 ERNIE Speed、ERNIE Lite | 免费 | 拉开发者使用 | 百度智能云发布 |
| 2024-05 | 字节豆包 Pro-32k | 0.0008 元/千 tokens 级 | 低价抢企业客户 | 火山引擎发布 |
| 2024-05 | 腾讯混元 lite | 免费 | 降低调用门槛 | 腾讯云发布 |
2. 厂商盈利压力:降价后钱从哪里来
推理成本没有跟着 API 单价同比例下降。GPU 折旧、电力、带宽、工程团队、合规审计都要现金。免费策略能拉来注册,但注册不等于收入。
2026 年看厂商财报和产品页,能观察三个动作:
- 企业版收固定坐席费,把个人用户和公司采购分开。
- Agent 平台收订阅费,再按工具调用、知识库容量、运行时长加价。
- 行业方案收项目费或按结果费,把模型藏进客服、销售、法务、医疗等流程。
3. 行业解决方案与 Agent 订阅:合同怎么写
把 AI 从 API 接进业务,常见五种计费方式。
| 模式 | 计费单位 | 适合场景 | 主要风险 |
|---|---|---|---|
| API 按量 | token、调用次数 | 开发测试、内部工具 | 客户算不出 ROI |
| 坐席订阅 | 元/坐席/月 | 客服、销售 | 用得少也付费 |
| Agent 订阅 | 元/Agent/月 + 用量 | 固定流程自动化 | 结果定义模糊 |
| 按结果 | 元/解决工单、元/预约、元/成交 | 客服、外呼、预约 | 归因和退款争议 |
| 混合 | 底费 + 按结果 | 企业采购 | 底费过高会削弱激励 |
- 把流程拆成可计数事件:工单关闭、预约到店、合同生成、回款。
- 定义有效结果:客服 7 天内未 reopen、预约实际到店、线索通过人工复核。
- 写清排除项:垃圾工单、重复提交、测试数据、客户主动关闭。
- 保存审计日志:输入、模型版本、工具调用、输出、人工修改记录。
- 设月度封顶和退款条款:结果不达标怎么退,争议几天内处理。
- 先跑 2 周影子模式:不改变人工流程,只记录 Agent 结果,和人工结果对比。
4. 按效果付费案例:公开定价能拆出什么
Intercom Fin 采用按 resolution 收费。2024 年公开价是 $0.99 per resolution。它不对每条回复收费,只对“解决”收费。采购要问:resolution 由谁判定?客户未 reopen 算不算?人工接手后还算不算?
Salesforce Agentforce 在 2024 年 Dreamforce 公布按对话收费,公开起步价 $2 per conversation。它嵌在 CRM 流程里,适合销售和客服。采购要问:conversation 怎么起止?有效对话和无效对话怎么区分?转人工后是否计费?
这两个案例的共同点:计费单位不是模型输出,而是业务流程里的一个状态变化。对厂商来说,必须把产品接进工单、CRM、预约系统;对客户来说,必须能导出日志和对账。
来源:Intercom 官网 Fin 定价页;Salesforce 官方 Agentforce 发布与定价页。价格随合同和地区变化,采购前看当前报价。
5. 客户留存与 ROI 衡量:把节省算成会计认的账
按结果付费降低采购阻力,但如果算不出账,续费仍会掉。先固定三个公式:
- 单次结果成本 =(平台费 + 模型费 + 实施摊销 + 人工复核成本)/ 有效结果数
- ROI =(节省人力成本 + 增量收入 - 总成本)/ 总成本
- 回收期 = 总投入 / 月度净收益
| 指标 | 怎么取数 | 常见坑 |
|---|---|---|
| 有效结果数 | 工单关闭原因、预约到店状态、CRM 阶段变化 | 把 AI 回复量当解决量 |
| 人工复核成本 | 抽检工时 × 时薪 | 漏算质检和纠错 |
| 模型成本 | 控制台账单按项目拆分 | 多轮和工具调用吃掉预算 |
| 留存 | 次月仍在用、结果数增长、人工干预率下降 | 只看登录数 |
6. 2026 年竞争格局:采购看什么
模型层会继续分层:小模型免费或接近免费,大模型按复杂推理、长上下文、多模态能力收溢价。应用层的竞争点转到四件事:
- 结果定义权:谁能定义有效结果,并让客户和厂商都认。
- 工作流嵌入:Agent 能不能直接改工单、CRM、预约系统。
- 数据回流:错误案例能否自动进入评测集,提升下一版解决率。
- 结算能力:封顶、退款、对账、发票、审计日志是否齐全。
免责声明:本文引用的价格和定价模式来自厂商公开页面,价格随版本、地域、合同变化;采购前以当前报价和合同为准。本文不构成投资或采购建议。