7 月中旬深度求索正式发布新一代基座大模型 DeepSeek V4,同步推出行业首创算力峰谷分级定价规则,每日早 9 点至晚 21 点业务高峰时段,API 调用算力单价翻倍;凌晨低峰时段算力价格下调 60%,引导客户错峰消耗 Token 算力。
此前行业普遍采用统一固定算力定价,日间企业批量调用、C 端用户集中访问极易造成算力集群拥堵,首 Token 响应延迟大幅攀升,算力资源日间严重紧张、夜间闲置浪费。
分时定价落地后,客户主动将数据批量处理、模型微调任务转移至夜间低峰,集群整体算力利用率提升 31%。
模型深度适配国产异构算力集群,支持混合调度昇腾、海光、英伟达多品牌加速卡,自研 MoE 稀疏算力调度算法,大幅降低超大模型推理硬件消耗;分时算力定价模式快速被国内多家大模型厂商跟进落地,成为 Token 算力运营标准化工具。
大模型分时算力定价落地调节供需,算力精细化运营成为行业核心竞争力。

点赞(0) 打赏

评论列表 共有 0 条评论

暂无评论

微信小程序

微信扫一扫体验

立即
投稿

微信公众账号

微信扫一扫加关注

发表
评论
返回
顶部