返回行业资讯
大模型降价潮来了:中小企业用AI的成本要重算了
📌 摘要
2026年7月底至8月初,国内外大模型集中降价,同等能力的调用成本被压到此前的几分之一。本文梳理华泰证券研报、国家数据局公开数据与OpenRouter调用量榜单等可查证信息,说明这轮降价对中小企业意味着什么,也指出模型调用费之外那些并没有变便宜的成本。
这一周的大模型降价,幅度大到有点不讲道理。中小企业老板可以先记住一个结论:过去说"AI 太贵用不起"的那套账,从这个月起要重算了;但重算的只是其中一项成本,另外几项一分没少。
降到什么程度了
先看能查证的数字。
2026 年 8 月 5 日《21 世纪经济报道》援引华泰证券研报:OpenAI 于 7 月 30 日将 Terra 和 Luna 价格分别下调 20% 和 80%;次日发布的 DeepSeek V4 Flash 0731 在 Artificial Analysis Intelligence Index 上拿到 50 分,仅比 Luna 低 1 分,而混合价格约 0.06 美元/百万 Token、平均任务成本约 0.03 美元,较 Luna 分别低约 65% 和 57%。华泰在研报里的判断是,大模型竞争已经从"能力排名"转向"同等智能成本"。
同一天,科技媒体转载的行业消息里,OpenAI、谷歌、Anthropic 集体开启降价迎战:谷歌推平价轻量化 Gemini 新品,Anthropic 选择同价升级性能。理由不复杂——被逼的。
调用量这一侧的数据更直观。据 ZAKER 报道,全球最大 AI 模型聚合平台 OpenRouter 的周报显示,7 月 27 日至 8 月 2 日,DeepSeek-V4-Flash 单周调用量达 7.22 万亿 Token;该平台聚合超 400 款模型、拥有 800 万用户,榜单前五均为国产模型,国产模型总调用量已连续 14 周超越美国模型。
往前追一段更能看出斜率。中央广播电视总台央视新闻 2026 年 3 月 25 日的报道提到,截至 3 月 22 日中国 AI 大模型在 OpenRouter 的周调用量为 6.44 万亿词元,连续第三周超越美国。四个多月过去,单个模型一周的量就顶上了当时全国的总量。
这个降价,跟你的账本什么关系
国家数据局局长刘烈宏在 2026 年 3 月 24 日国新办新闻发布会上说,到今年 3 月,我国日均词元(Token)调用量已经超过 140 万亿,相比 2024 年初的 1000 亿增长了 1000 多倍,相比 2025 年底的 100 万亿,三个月又增长了 40% 多。同一场合,Token 的中文译名被正式定为"词元"。国家数据局官网 6 月发布的专家解读进一步给出:截至 2026 年第一季度,全国已建成高质量数据集超过 11.6 万个,总体量超过 960PB。
调用量暴涨、单价暴跌,这两件事同时发生,对中小企业意味着三个具体变化。
第一,智能体真的能跑了。 以前做一个能自主规划、多步骤调用工具的智能体,光 API 账单就能把小公司的现金流烧穿,因为多轮调用是把 Token 消耗乘上好几倍。单价掉一个数量级之后,这类应用第一次进入了小公司预算能覆盖的区间。
第二,试错成本降下来了。 过去做一个 AI 客服或者文档助手,老板最怕的是"投了钱不知道有没有用"。现在跑一轮真实业务数据的验证,花的钱可能只是一顿饭钱,先试再决定,比听服务商 PPT 靠谱得多。
第三,别急着签长约。 价格还在往下走的时候锁定一年期的固定套餐,是最亏的操作。
榜单打架,恰好说明一件事
值得提一句的是,同一周的调用量榜单,不同来源说法并不一致。自媒体"码农财经"在 8 月初的文章里称小米 MiMo-V2.5 以单周 10.5 万亿 Token 登顶,而前面提到的 ZAKER 报道说 DeepSeek-V4-Flash 拿了第一。统计口径、榜单版本、抓取时间不同,结论就能对不上。
所以榜单看看热闹就行。老板真要选模型,只有一个办法:拿自己公司的真实数据、真实问题跑一轮,看输出能不能用。谁家排第一跟你的合同评审能不能自动化,关系不大。
给老板算一笔小账
举个能落地的例子。一家做外贸的小厂,想让 AI 帮着把客户询盘分类、提取关键信息、生成回复初稿。假设一天处理 200 封询盘,每封连输入带输出算 3000 个词元,一天 60 万词元,一个月 1800 万。
按前面提到的那个价位量级折算,这一个月的模型调用费不过是几十块人民币,还不够请客户吃顿饭。而同样这件事,找人做外包开发,报价通常从五位数起步。
差价花在哪儿了?花在把询盘分类规则说清楚、把历史邮件整理成可用样本、把生成的初稿接进现有邮箱流程、以及有人盯着它别把报价发错。这些活儿,服务商收的是这部分的钱,不是词元的钱。
老板真该问服务商的问题也就变了:不是"你们用的什么模型",而是"这些梳理和对接的活儿,你们做到哪一步、按什么标准验收"。
没降价的是这些
Token 便宜了,AI 落地这件事并没有跟着变便宜。
模型调用费在一个 AI 项目的总成本里,通常不是大头。真正花钱的是:把业务流程梳理清楚的人、把散在微信和 Excel 里的数据整理成可用格式的工时、让员工愿意用起来的培训和磨合、以及出了错谁来兜底的机制。这几项没有任何一项因为 Luna 降价 80% 而减少。
坦白说,降价这轮红利,最先吃到的是那些已经把流程和数据理顺的公司——他们只需要把成本参数改一改,规模立刻能放大。而流程一团乱的公司,模型免费送也用不起来。
想看具体怎么从流程梳理开始起步,可以翻企脉AI「上手实操」栏目的相关内容。
💡 企脉观点
降价这事,最怕老板理解成“AI变便宜了,可以上了”。便宜的是词元,不是落地。企脉两条判断。第一,这轮降价对已经跑通流程的公司是放大器,对流程一团乱的公司几乎没用——模型白送也照样用不起来,卡住你的从来不是调用费,是没人说得清这活儿到底该怎么干、谁来验收、错了算谁的。第二,趁便宜多试,别趁便宜多买。眼下最划算的动作是拿真实业务数据跑几轮验证,几十块钱能试出服务商PPT里三个月都试不出来的事;最亏的动作是被“限时优惠”推着签一年长约,价格还在往下掉,锁死就是自己吃亏。再补一句得罪人的:谁再拿榜单第一当卖点,你就回一句——用我的数据测过吗。
❓ 常见问题(FAQ)
这轮大模型降价,中小企业最该抓住的机会是什么?
是低成本试错。过去验证一个AI场景,光API账单就让人犹豫,现在拿自己公司的真实业务数据跑几轮验证,花费可能只相当于一顿饭钱。与其听服务商讲三个月方案,不如先花小钱把“这个场景到底跑不跑得通”测出来。另一个变化是多步骤智能体开始进入小公司的预算区间,因为这类应用要反复调用模型,单价下降对它的成本影响是成倍的。
价格还在降,现在签一年期的AI套餐合适吗?
在价格明显处于下行通道的阶段锁定长约,通常不划算。更稳妥的做法是先按量付费或选择短周期,把长约留到用量稳定、场景确定之后再谈。如果服务商用“限时优惠”催促签长约,可以要求把降价保护条款写进合同,比如约定期内若官方指导价下调则同步调整,或者允许按新价格重新结算剩余期限。
调用价格降了,AI项目的总成本会跟着降吗?
不会同比例下降。在多数中小企业的AI项目里,模型调用费本来就不是大头。真正的成本集中在业务流程梳理、把散落在微信和表格里的数据整理成可用格式、员工培训与使用习惯磨合,以及出错后的兜底机制。这几项不会因为某个模型降价而减少。已经把流程和数据理顺的公司,这轮降价是放大器;流程还乱着的公司,降价带来的实际收益很有限。
📚 资料来源
- 《21世纪经济报道》2026年8月5日援引华泰证券研报:OpenAI于7月30日将Terra和Luna价格分别下调20%和80%;DeepSeek V4 Flash 0731在Artificial Analysis Intelligence Index达50分,混合价格约0.06美元/百万Token、平均任务成本约0.03美元,较Luna分别低约65%和57%。
- 国家数据局局长刘烈宏2026年3月24日在国新办新闻发布会上表示:到2026年3月,我国日均词元(Token)调用量已超过140万亿,相比2024年初的1000亿增长了1000多倍,相比2025年底的100万亿三个月增长超40%;Token中文译名定为“词元”。
- 国家数据局官网2026年6月专家解读:截至2026年第一季度,全国已建成高质量数据集超过11.6万个,总体量超过960PB。
- ZAKER报道OpenRouter周报:2026年7月27日至8月2日,DeepSeek-V4-Flash单周调用量达7.22万亿Token,平台聚合超400款模型、拥有800万用户,榜单前五均为国产模型,国产模型总调用量连续14周超越美国模型。
- 中央广播电视总台央视新闻2026年3月25日报道:截至3月22日,中国AI大模型在OpenRouter的周调用量达6.44万亿词元,连续第三周超越美国。