深度求索推出的 DeepSeek V4 基座模型持续推行行业首创算力分时计费规则,每日 9:00-21:00 业务高峰时段 API 算力单价上浮 100%,凌晨低峰时段下调 60%,引导企业批量微调、离线词元生产任务错峰运行,落地后集群整体算力利用率提升 31%。
过往行业统一固定算力定价模式下,日间推理算力拥堵、夜间硬件闲置浪费,单位 Token 生产成本居高不下;分时定价工具搭配自研稀疏算力调度算法,可自动分配异构国产、海外算力资源,同等词元产出功耗下降 28%。
该运营模式快速被国内十余家主流开源大模型厂商跟进落地,Token 算力行业从单纯硬件资源出租,转向精细化算力调度、分时定价、词元成本优化综合服务模式,算力运营精细化成为核心竞争力。
分时算力定价模式行业普及,精细化调度大幅提升算力集群资产回报率。


发表评论 取消回复