国际

海外高端 GPU 一机难求,租赁价格年内涨近 40%,企业扎堆签订多年长单锁资源

全球高端训练 GPU 供需失衡问题持续加剧,海外算力硬件整机、算力租赁价格同步大幅上涨。市场行情数据显示,B300 整机单价从年初 400 万元冲高至 900-1000 万元区间,H200 服务器单机价格由 240 万元上涨至 420 万元;国内高端训练算力租赁单价年内累计涨幅接近 40%。

AMD 服务器 CPU 市占逼近五成,MI 系列 AI 卡拿下 Meta、微软大额采购订单

芯片市场格局大变,AMD 服务器 CPU 份额持续走高,AI 加速卡生态完成大模型全覆盖,成为英伟达最强竞争对手。全球服务器芯片市场份额迎来结构性变化,最新行业统计数据显示,2026 年一季度 AMD x86 架构服务器 CPU 收入市场份额达到 46.2%,持续挤压其他厂商市场空间。

Meta 敲定 2 年百亿算力租赁大单,向 Anthropic 开放闲置 AI 训练集群资源

7 月 18 日海外科技媒体披露,Meta 与 AI 独角兽 Anthropic 正式达成两年期算力租赁合作协议,合约总金额上限达 100 亿美元,按月结算算力服务费,双方均保留合约提前终止权限。Meta 将开放自有万卡级高端训练 GPU 集群资源,专供 Anthropic 新一代 Claude 系列大模型迭代、多智能体并发推理使用。

Meta 自研 Iris AI 芯片 9 月量产,2nm 代工大单锁定三星,全年算力投入 1450 亿美元

7 月 9 日路透社获取 Meta 内部研发备忘录,公司第四代自研 AI 加速器 Iris 芯片定于 2026 年 9 月正式量产,由三星 2nm GAA 工艺代工,六周完成全流程缺陷验证,研发进度大幅超预期。Iris 定位为 GPU 补充算力,承接平台日常推理、智能体调度、多模态内容生成任务,不完全替代英伟达高端训练 GPU。

英伟达发布 Vera CPU 架构,专为 AI 智能体高并发调度场景定制优化

7 月 6 日英伟达正式发布全新 Vera 专用 CPU 架构,核心面向 AI 智能体时代算力需求设计,解决传统通用多核 CPU 在智能体多轮调度、工具高频调用场景下延迟高、资源利用率不足的行业痛点。传统算力架构仅侧重 GPU 并行计算性能,AI 智能体自主规划、多工具交互、长记忆推理等任务高度依赖单线程 CPU 性能,长期存在算力瓶颈;Vera 架构大幅提升单线程运算速度,原生适配英伟达 DSX