7 月中旬深度求索正式发布新一代基座大模型 DeepSeek V4,同步推出行业首创算力峰谷分级定价规则,每日早 9 点至晚 21 点业务高峰时段,API 调用算力单价翻倍;凌晨低峰时段算力价格下调 60%,引导客户错峰消耗 Token 算力。此前行业普遍采用统一固定算力定价,日间企业批量调用、C 端用户集中访问极易造成算力集群拥堵,首 Token 响应延迟大幅攀升,算力资源日间严重紧张、夜间闲置浪费。分时定价落地后,客户主动将数据批量处理、模型微调任务转移至夜间低峰,集群整体算力利用率提升 31%。模型深度适配国产异构算力集群,支持混合调度昇腾、海光、英伟达多品牌加速卡,自研 MoE 稀疏算力调度算法,大幅降低超大模型推理硬件消耗;分时算力定价模式快速被国内多家大模型厂商跟进落地,成为 Token 算力运营标准化工具。大模型分时算力定价落地调节供需,算力精细化运营成为行业核心竞争力。
发表评论 取消回复