核验清单

  • 自己的批量数据处理、模型微调、离线报表这类不要求即时返回的任务,是否可以直接设置成北京时间凌晨/非高峰时段调度执行
  • 调用脚本里判断"是否高峰时段"时,用的是不是准确的北京时间而不是服务器所在地时区或UTC,避免算错档位反而多付钱
  • 任务如果会跨越高峰/空闲时段的分界点,账单是按请求发起时间还是实际处理时间计价,有没有留出安全余量而不是卡着分界点提交
  • 申请更高并发额度前,是否已经把企业营业执照、对公银行账户等实名/资质材料准备好,而不是误以为多付钱就能自动获得更高并发
  • 账单明细里这次调用落在哪个时段档位,是否跟官方定价页当前公示的价格对得上,而不是凭旧印象心算

1. 现象:同一个模型,白天调用和凌晨调用不是一个价

如果你最近在用DeepSeek等国内大模型的API,可能已经注意到账单上出现了两套单价:北京时间工作日白天(比如上午9点到12点、下午2点到6点这类高峰时段)调用同一个模型,单价会明显高于深夜或非高峰时段调用。这不是系统故障,也不是临时促销,而是厂商正式切换到的"峰谷定价"(也叫错峰定价)计费模式——同一个接口、同一个模型,价格会随时段自动切换。

2. 本质:算力白天紧张,价格是用来引导流量的杠杆

错峰定价的底层逻辑并不复杂:模型推理需要的GPU算力是有限资源,白天是企业和开发者调用最密集的时段,算力池最容易被打满;而凌晨到清晨这段时间,调用量明显下降,大量算力处于空闲状态。厂商与其让这部分空闲算力白白闲置,不如用更低的价格吸引那些"不着急拿结果"的任务主动挪过来——本质上是用价格这根杠杆做流量调度,而不是单纯让利。这也是为什么高峰时段的价格不只是"没有折扣",很多厂商的新定价方案里,高峰时段的价格本身也在同步上调,空闲时段的低价才是新方案里真正划算的部分。

3. 具体规则:以DeepSeek为例,时段怎么划分、价差有多大

以DeepSeek官方定价文档公示的规则为例:高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余时间(含全部周末)都算空闲时段,空闲时段价格固定为高峰时段价格的一半。具体到金额,以其中一档模型为例,缓存未命中的输入价格空闲时段约为每百万token 1.5元,高峰时段约为3元;输出价格空闲时段约为每百万token 4.5元,高峰时段约为9元。不同模型档位的具体数字会不一样,且厂商公示的价格本身也会调整,调用前建议直接查官方定价页确认当前生效的数字,不要凭这篇文章里的示例数字心算账单。

4. 跟海外批量API折扣像不像:触发条件是关键差异

本站另一篇文章《按官方单价心算的AI API账单,为什么总是差着一截》里提到,OpenAI、Anthropic等海外服务商也有类似的"用低价换取灵活性"的机制——批量API(batch API),把不要求实时返回的任务打包提交,通常能拿到明显低于同步调用的折扣价。这跟国内大模型的错峰定价背后是同一套经济学原理:都是用价格换取"厂商能更灵活地安排算力资源"。但两者的触发条件完全不同:海外批量API的折扣看你调的是哪个接口(批量提交 vs 同步请求),跟具体几点钟提交没有关系,任务本身也不需要实时返回;国内错峰定价的折扣看你调用发生在哪个时间段,接口本身还是普通的同步调用接口,只是价格随时钟自动切换。简单说:一个是"选对接口",一个是"选对时间",不能拿同一套优化思路套两边。

5. 实名认证/企业资质核验,跟错峰定价是两件独立的事

这里有一个很容易被搞混的地方:不少开发者以为只要账户完成了实名认证或者充值够多,就能自动解锁更高的并发/速率限制,进而误以为错峰定价和账号等级是绑在一起的同一套体系。实际上这是两套完全独立的机制——错峰定价只跟"你在什么时段调用"有关,跟账户是不是企业认证、并发额度多高完全无关;而更高的并发额度、更高的速率限制层级,通常需要单独走企业资质核验流程,跟本站《DeepSeek、豆包、Kimi怎么开通:国内AI大模型入门》里提到的手机号实名认证也不是一回事——手机号实名是开通账号的基本门槛,企业资质核验是申请更高并发额度时的进阶门槛,三件事分属三个不同层级,不要因为完成了其中一件就默认另外两件也自动搞定。

6. 哪些任务适合迁移到低峰时段,脚本里怎么做错峰调度

适合迁移到低峰时段的任务有一个共同特征:不要求秒级甚至分钟级的实时响应。典型的有:批量数据清洗与结构化处理(比如把历史客服记录批量打标签)、模型微调/继续训练任务、定时生成的日报周报月报、大批量文档的摘要与翻译、离线的语料标注与质量评估。这类任务本身跑起来通常要几分钟到几小时,用户对"几点钟开始跑"并不敏感,天然适合挪到夜间。落地到调用脚本层面,最简单的做法是用系统自带的定时任务工具(Linux下用cron,Windows下用任务计划程序,Python生态也可以用APScheduler这类库)把任务的启动时间设定在北京时间0点到8点这个窗口内,同时在代码里对当前时间做一次校验(务必按北京时间UTC+8计算,不要直接用服务器本地时区),如果发现任务快要拖到高峰时段分界点还没跑完,提前预留出半小时到一小时的缓冲,避免账单被算到刚好卡在分界线上的那次请求。

7. 申请更高并发额度前,实名材料通常要准备什么

如果业务量上来了需要申请更高的并发/速率限制额度,大多数国内大模型厂商的企业资质核验流程会要求准备这几类材料:企业营业执照(三证合一后的统一社会信用代码证)扫描件或照片、对公银行账户信息(部分平台要求先完成对公账户打款验证)、企业经办人的身份证明以及必要时的授权委托书、部分场景还会要求提供业务使用场景说明。这些材料通常在平台的开放者控制台里有专门的"企业认证"或"资质升级"入口提交,审核周期从几个工作日到两周不等,具体以你使用的平台官方说明为准——建议在业务量真正逼近现有并发上限之前就提前准备,避免临时申请卡住线上任务。

8. 小结

国内大模型API"白天贵、深夜打折"的错峰定价,本质是厂商用价格杠杆引导开发者把非实时任务挪到算力空闲的夜间时段,跟海外批量API折扣是相似的经济学逻辑,但触发条件一个按时段一个按接口类型,不能混用同一套优化思路。实名认证、企业资质核验与并发额度申请是另一套独立的合规/额度体系,跟错峰定价没有直接关系,把批量处理类任务迁移到低峰时段、并提前准备好企业资质材料,是两件可以分别落地的具体动作。