DeepSeek推API峰谷计价,高峰期价格翻倍
来源:李智衍发布时间:2026-07-01181浏览
询问 AI据DeepSeek官方公告,该平台计划在7月中旬发布V4正式版本,并同步引入API接口的高峰与低谷分时计费模式。在这一新机制下,高峰期的API调用费用将上调至非高峰期的两倍。此举标志着人工智能算力服务正逐渐打破传统的固定收费模式,向类似云计算和电力市场的动态资源调度方向演进。
公告显示,北京时间每天的9点至12点以及14点至18点被设定为高峰时段。在此期间,V4 Pro版本的缓存命中输入费用为每百万Token 0.05元人民币(单位下同),缓存未命中输入和输出费用分别为6元和12元;而V4 Flash版本的这三项指标则分别定为0.04元、2元和4元。相比之下,非高峰时段的计费标准依然延续了今年5月份降价后的水平。具体而言,V4 Pro的缓存未命中输入与输出单价分别为每百万Token 3元和6元,V4 Flash对应的价格则是1元和2元。由此可见,此次调整并非整体涨价,而是专门针对高负载时段增加了收费。
从企业运营的角度来看,这种分时定价策略旨在解决大模型服务商面临的GPU算力利用率问题。由于大语言模型推理的主要成本源于GPU资源,且企业级客户的调用需求多集中在白天的常规工作时间,导致算力负荷呈现出明显的波峰特征。如果实行全天候统一收费,服务商就需要储备充足的GPU来应对瞬时高并发,这会造成非高峰时段的设备闲置,进而拉低整体利用率并增加运营成本。因此,引入峰谷计费机制实质上是一种需求管理手段。通过价格杠杆,可以引导那些对实时性要求不高的批量推理、数据分析、模型测试以及智能体工作流等任务转移到非高峰期执行,从而确保GPU在全天都能保持较高的运转效率。这种模式与公有云及电力市场的分时电价理念十分相似,属于首次在大语言模型API服务中进行较为完整的应用。
针对时段划分,有部分开发者指出,设定的高峰期基本覆盖了国内企业的核心办公时间,而欧美用户受时差影响,其调用时段多处于非高峰期,能够享受更低廉的价格。不过,许多业内人士对此持积极态度,认为DeepSeek现有的API基础定价在市场中本就处于较低水平,即便高峰期费用翻倍,其综合成本依然具备较强的市场竞争力。此次计费规则的优化,也折射出国内大模型市场正在从早期的价格竞争,逐渐向算力运营效率管理阶段过渡。预计未来会有更多国内大模型企业效仿这种分时计费模式,推动API服务从单一的统一定价向更加灵活的资源调度方向发展。
新闻来源:李智衍,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。