7 月 6 日英伟达正式发布全新 Vera 专用 CPU 架构,核心面向 AI 智能体时代算力需求设计,解决传统通用多核 CPU 在智能体多轮调度、工具高频调用场景下延迟高、资源利用率不足的行业痛点。传统算力架构仅侧重 GPU 并行计算性能,AI 智能体自主规划、多工具交互、长记忆推理等任务高度依赖单线程 CPU 性能,长期存在算力瓶颈;Vera 架构大幅提升单线程运算速度,原生适配英伟达 DSX
2026 年下半年以来,国内主流算力服务商全面推进 Token 标准化计费模式,统一 API 接口适配全品类大模型调用,逐步替代传统按机柜、按卡时租赁的老旧商业模式,行业商业化逻辑完成根本性升级。传统算力租赁模式存在资源浪费严重、计费模糊、适配性差等问题,中小 AI 企业无需全天占用显卡资源,仅在模型推理、内容生成、智能体运行时消耗算力。