大模型价格战之后:AI商业化进入按结果付费时代

商业分析大模型API按结果付费AI商业化AgentROI2026-09-27

大模型价格战之后:AI商业化进入按结果付费时代

一个 10 人客服团队,2024 年用 GPT-4o mini 把每月 API 账单压到几千元。2026 年老板问的是:AI 预算涨了,投诉率没降,省下来的人时在哪?采购对话从“每百万 token 多少钱”换成“每解决一个问题多少钱”。

1. API 降价与免费策略回顾

先看价格战的公开节点,用来判断厂商为什么后来不愿只卖 token。下表是 2023—2024 年的典型动作,2026 年实际价格以各厂商控制台和合同为准。

时间厂商/模型公开价格动作来源
2023-03OpenAI gpt-3.5-turbo$0.002/1K tokens比原有 GPT-3.5 便宜 90%OpenAI 官方博客
2024-05-13OpenAI GPT-4o$5/1M 输入,$15/1M 输出比 GPT-4 Turbo 便宜 50%OpenAI 官方博客
2024-07-18OpenAI GPT-4o mini$0.15/1M 输入,$0.60/1M 输出取代 GPT-3.5 TurboOpenAI 官方博客
2024-03-13Anthropic Claude 3 Haiku$0.25/1M 输入,$1.25/1M 输出小模型低价线Anthropic 发布页
2024-05阿里云通义千问 Qwen-Long输入 0.0005 元/千 tokens,输出 0.002 元/千 tokens降价 97%阿里云官方发布
2024-05百度 ERNIE Speed、ERNIE Lite免费拉开发者使用百度智能云发布
2024-05字节豆包 Pro-32k0.0008 元/千 tokens 级低价抢企业客户火山引擎发布
2024-05腾讯混元 lite免费降低调用门槛腾讯云发布
价格表能解释一件事:token 单价被打下来后,客户不会再为“模型很大”付溢价。厂商要继续收钱,得把计费单位换成业务结果。

2. 厂商盈利压力:降价后钱从哪里来

推理成本没有跟着 API 单价同比例下降。GPU 折旧、电力、带宽、工程团队、合规审计都要现金。免费策略能拉来注册,但注册不等于收入。

2026 年看厂商财报和产品页,能观察三个动作:

  • 企业版收固定坐席费,把个人用户和公司采购分开。
  • Agent 平台收订阅费,再按工具调用、知识库容量、运行时长加价。
  • 行业方案收项目费或按结果费,把模型藏进客服、销售、法务、医疗等流程。
API 按 token 卖,客户会拿三家报价压单价。按结果卖,厂商要对“有没有解决问题”负责,定价锚点变成客户节省的人力、增加的预约或成交。风险也转移了:结果定义不清,后面就是退款和扯皮。

3. 行业解决方案与 Agent 订阅:合同怎么写

把 AI 从 API 接进业务,常见五种计费方式。

模式计费单位适合场景主要风险
API 按量token、调用次数开发测试、内部工具客户算不出 ROI
坐席订阅元/坐席/月客服、销售用得少也付费
Agent 订阅元/Agent/月 + 用量固定流程自动化结果定义模糊
按结果元/解决工单、元/预约、元/成交客服、外呼、预约归因和退款争议
混合底费 + 按结果企业采购底费过高会削弱激励
一个可执行的签约前清单:
  • 把流程拆成可计数事件:工单关闭、预约到店、合同生成、回款。
  • 定义有效结果:客服 7 天内未 reopen、预约实际到店、线索通过人工复核。
  • 写清排除项:垃圾工单、重复提交、测试数据、客户主动关闭。
  • 保存审计日志:输入、模型版本、工具调用、输出、人工修改记录。
  • 设月度封顶和退款条款:结果不达标怎么退,争议几天内处理。
  • 先跑 2 周影子模式:不改变人工流程,只记录 Agent 结果,和人工结果对比。
影子模式能避免一种常见亏损:上线前按 demo 估算,上线后发现 Agent 把简单问题转给人工,账单却按调用量涨。

4. 按效果付费案例:公开定价能拆出什么

Intercom Fin 采用按 resolution 收费。2024 年公开价是 $0.99 per resolution。它不对每条回复收费,只对“解决”收费。采购要问:resolution 由谁判定?客户未 reopen 算不算?人工接手后还算不算?

Salesforce Agentforce 在 2024 年 Dreamforce 公布按对话收费,公开起步价 $2 per conversation。它嵌在 CRM 流程里,适合销售和客服。采购要问:conversation 怎么起止?有效对话和无效对话怎么区分?转人工后是否计费?

这两个案例的共同点:计费单位不是模型输出,而是业务流程里的一个状态变化。对厂商来说,必须把产品接进工单、CRM、预约系统;对客户来说,必须能导出日志和对账。

来源:Intercom 官网 Fin 定价页;Salesforce 官方 Agentforce 发布与定价页。价格随合同和地区变化,采购前看当前报价。

5. 客户留存与 ROI 衡量:把节省算成会计认的账

按结果付费降低采购阻力,但如果算不出账,续费仍会掉。先固定三个公式:

  • 单次结果成本 =(平台费 + 模型费 + 实施摊销 + 人工复核成本)/ 有效结果数
  • ROI =(节省人力成本 + 增量收入 - 总成本)/ 总成本
  • 回收期 = 总投入 / 月度净收益
取数时盯住四个指标:

指标怎么取数常见坑
有效结果数工单关闭原因、预约到店状态、CRM 阶段变化把 AI 回复量当解决量
人工复核成本抽检工时 × 时薪漏算质检和纠错
模型成本控制台账单按项目拆分多轮和工具调用吃掉预算
留存次月仍在用、结果数增长、人工干预率下降只看登录数
举一个假设账:某客服团队每月 10000 张工单,月人工成本 8 万元,单张工单人工成本约 8 元。Agent 处理 30% 工单,有效解决率 70%,月有效结果 2100 单。按 $0.99/单、汇率 7.2 算,结果费约 15120 元;节省人工约 16800 元。毛利只有 1680 元,还没算实施和质检。这个假设账说明:按结果付费不是自动划算,解决率低于 70% 或人工成本低于 8 元/单时,合同很容易亏。

6. 2026 年竞争格局:采购看什么

模型层会继续分层:小模型免费或接近免费,大模型按复杂推理、长上下文、多模态能力收溢价。应用层的竞争点转到四件事:

  • 结果定义权:谁能定义有效结果,并让客户和厂商都认。
  • 工作流嵌入:Agent 能不能直接改工单、CRM、预约系统。
  • 数据回流:错误案例能否自动进入评测集,提升下一版解决率。
  • 结算能力:封顶、退款、对账、发票、审计日志是否齐全。
采购时别只比 token 单价。拿最近一个月的数据做一次小测:抽 50 张工单或 50 条线索,人工标出有效结果和无效结果,按上面的公式算单次结果成本。如果算不出,先别签按结果合同。

免责声明:本文引用的价格和定价模式来自厂商公开页面,价格随版本、地域、合同变化;采购前以当前报价和合同为准。本文不构成投资或采购建议。

PREMIUM

需要完整版教程?

包含详细步骤、视频演示、提示词模板和可下载资料包。微信支付即时获取。

购买完整版 ¥29.90