返回行业资讯
大模型API开始错峰计价:中小企业的AI账单要重算了
📌 摘要
2026年8月17日起DeepSeek API启用峰谷分时计价,空闲时段价格为高峰时段一半。本文梳理这轮定价机制变化的具体数字、可挪与不可挪任务的分界线,并结合旗舰模型开源、轻量化单卡部署、北京智能体十条与广东Token贷等最新动态,给出中小企业本周可执行的三个动作。
企业用大模型的账单算法变了。8月17日零点起,DeepSeek API 正式启用峰谷分时计价,同一个模型、同一段任务,白天和夜里的价格差一倍。大模型API错峰计价第一次摆到明面上,中小企业的AI成本表得跟着重算一遍。
这次到底改了什么
据中国金融信息网2026年8月20日报道,DeepSeek于8月13日正式发布调价公告,对API价格采用峰谷定价:高峰时段为北京时间9:00-12:00和14:00-18:00,其余为空闲时段,空闲时段价格是高峰时段的一半,新规则2026年8月17日起生效。
IT时报2026年8月21日的报道把账算得更细。每天7个小时高峰、17个小时空闲。以旗舰模型V4 Pro为例:输出价格从原先6元/百万Tokens调到高峰时段27元、空闲时段13.5元;输入(缓存未命中)从3元涨到高峰9元、空闲4.5元;输入(缓存命中)从0.025元涨到高峰0.3元,涨幅达1100%。轻量模型V4 Flash同样适用这套规则,高峰输出9元、空闲4.5元。
中国经济网8月17日的报道点出一个关键边界:此次调价仅针对API调用,网页端、App的普通免费用户不受影响。真正要重算成本的,是那些接了API跑Agent、跑批量任务的企业。
哪些活能挪到夜里,哪些挪不了
分界线只有一句话:这件事要不要有人等着看结果。
能挪的,都是「机器自己慢慢跑」的活:批量数据清洗、月度报表汇总、几百条商品文案批量生成、客服会话质检、合同批量抽取要素、夜里跑模型评测。这些挪到晚上或凌晨排队执行,成本直接对半砍。
挪不了的,是「人在等」的活:客服实时应答、销售现场问答、线上表单即时处理。这部分必须占白天高峰,成本硬扛,没有取巧空间。
据51CTO技术社区对官方规则的整理,8月23日DeepSeek又做了一次优化:周末两天全天不再区分峰谷,统一按空闲时段价格计费。以V4-Pro输出为例,周末按13.5元/百万Tokens结算,相比工作日高峰27元直接减半(具体以官方最新公告为准)。
所以中小企业最实际的动作,可能只是改一个定时任务的执行时间——把非实时的那部分活,从工作日白天挪到夜里和周末。不用换模型,不用改系统。
用量摆在这,说明这不是少数人的账
据顶端新闻《科创微报》2026年8月17日梳理,8月3日至9日当周,全球AI模型调用总量达69万亿Token,其中中国模型贡献34.25万亿,连续十五周位居全球第一,OpenRouter平台调用量前四名均为中国模型。
这组数字的意义在于:企业侧的调用是真实发生的,不是发布会上的概念。用量涨、白天算力紧、价格开始按时段分层——这套逻辑跟工业峰谷电价一模一样。老板们对峰谷电价一点都不陌生,那就用管电的思路去管Token。
另一条降本路径:旗舰开源加单卡部署
据云易创智整理的2026年8月国内大模型行业周报,阿里云8月3日发布新一代基座大模型Qwen3.8,旗舰Max版本总参数达2.4万亿、支持100万Token超长上下文,官方确认Max级权重将开源,这是千问系列首次开放Max级旗舰模型。同一份周报还提到,本月多家厂商集中发布轻量化优化模型,普通单张消费级或工业级显卡即可完成本地部署与推理。
这对哪类企业有意义?数据不能出内网的那一类——医疗、律所、财税、制造工艺。过去私有化部署是百万级门槛,现在一张卡起步就能试。
有句话必须说清楚:单卡能跑的是轻量模型,能力比云端旗舰差一档。它适合做固定流程里的信息抽取、分类、标准问答,不适合指望它写方案、做决策。谁跟你说单卡跑出来的效果等于云端旗舰,那是在卖硬件。
钱和政策也在往这个方向走
据今日头条《每周AI热闻》2026年8月9日整理,北京市发布智能体专项政策,提出十条举措推动AI智能体规模化落地,重点支持「一人公司」(OPC)创新创业模式,鼓励发展Token经济及专用推理芯片,探索Token即服务(TaaS)、智能体即服务(AaaS)等新商业模式;资金上对算力部署和模型首方案最高给予3000万元支持,技术攻关最高1亿元。
更贴近小企业的信号出在融资端。据顶端新闻《科创微报》2026年8月17日报道,广东省首个词元经济专项金融产品「Token贷」在广州海珠正式发布。以中国银行广州分行为例,针对海珠算力中小微企业研发的算力Token贷,按合同或Token消耗额度核定授信额度,担保方式以信用、应收账款质押、订单融资为主,也可组合保证、抵押扩大额度。
Token消耗额度能当授信依据,这个变化比补贴本身更有意思:你的AI用量,开始被银行当成经营数据看了。反过来说,那些API账单一片空白的企业,将来在这类产品上是没材料可交的。
这周能动手的三件事
一,拉一份近30天的API账单,按小时看调用分布,搞清楚自己有多少调用压在9到12点、14到18点。这一步不做,后面全是猜。
二,把非实时任务改成夜间或周末执行。改一个定时任务的成本几乎为零,省下的是真金白银。
三,数据敏感的业务,查一下本地单卡能不能跑轻量模型;同时看看注册地所在省市有没有算力券、贴息这类政策可以叠加。
各地补贴的具体额度和申报口径,可以翻企脉AI的「政策红利」栏目对号入座。
💡 企脉观点
这轮调价,很多人只看到「DeepSeek涨价了」,我看到的是另一件事:AI开始像水电一样,按供需分时段卖了。企脉的判断很直接。第一,别再把AI成本当固定开支,它现在是可调度的,一份30天的API账单按小时拉一遍,比听十场发布会有用;第二,把公司的AI任务分成人在等和机器自己跑两类,后者全部推到夜里和周末,这是眼下最不费力的降本动作;第三,广东那个按Token消耗额度核定授信的Token贷值得盯——你的AI用量正在变成银行认的经营数据,账单一片空白的企业,将来连材料都递不上去。别嫌麻烦,这些账迟早要算,早算一天早省一天钱。
❓ 常见问题(FAQ)
错峰计价对只用网页版的企业有影响吗?
没有。据中国经济网2026年8月17日报道,此次调价仅针对API调用,网页端和App普通免费用户不受影响。真正需要重算成本的是接了API跑Agent、跑批量任务的企业。
哪些AI任务适合挪到空闲时段?
判断标准是有没有人在等结果。批量数据清洗、月度报表汇总、商品文案批量生成、客服会话质检、合同批量抽取要素这类机器自己跑的活都能挪;客服实时应答、销售现场问答挪不了,只能硬扛高峰价。
单卡部署轻量模型能替代云端旗舰吗?
不能。单卡能跑的是轻量模型,能力比云端旗舰差一档,适合固定流程里的信息抽取、分类、标准问答,不适合让它写方案做决策。它的价值在于数据不出内网,而不是效果对等。
📚 资料来源
- 据中国金融信息网2026年8月20日报道,DeepSeek于8月13日发布调价公告,采用峰谷定价,高峰时段为北京时间9:00-12:00和14:00-18:00,空闲时段价格为高峰时段的一半,新规则8月17日起生效。
- 据IT时报2026年8月21日报道,V4 Pro输出价格从6元/百万Tokens调整为高峰27元、空闲13.5元,缓存命中输入从0.025元涨至高峰0.3元。
- 据顶端新闻《科创微报》2026年8月17日报道,8月3日至9日当周全球AI模型调用总量达69万亿Token,中国模型贡献34.25万亿,连续十五周全球第一;广东省首个词元经济专项金融产品「Token贷」在广州海珠发布。