海外高端 GPU 一机难求,租赁价格年内涨近 40%,企业扎堆签订多年长单锁资源 全球高端训练 GPU 供需失衡问题持续加剧,海外算力硬件整机、算力租赁价格同步大幅上涨。市场行情数据显示,B300 整机单价从年初 400 万元冲高至 900-1000 万元区间,H200 服务器单机价格由 240 万元上涨至 420 万元;国内高端训练算力租赁单价年内累计涨幅接近 40%。 国际 2026年06月24日 225 点赞 0 评论 6861 浏览
AMD 服务器 CPU 市占逼近五成,MI 系列 AI 卡拿下 Meta、微软大额采购订单 芯片市场格局大变,AMD 服务器 CPU 份额持续走高,AI 加速卡生态完成大模型全覆盖,成为英伟达最强竞争对手。全球服务器芯片市场份额迎来结构性变化,最新行业统计数据显示,2026 年一季度 AMD x86 架构服务器 CPU 收入市场份额达到 46.2%,持续挤压其他厂商市场空间。 国际 2026年06月23日 128 点赞 0 评论 2456 浏览
Anthropic 启动自研 AI 芯片研发,联合三星 2nm 工艺摆脱外部 GPU 算力依赖 7 月行业供应链消息确认,Claude 大模型开发企业 Anthropic 正式启动自研 AI 加速芯片项目,与三星电子达成 2nm GAA 先进制程代工合作,规划专属芯片匹配自身多模态大模型架构,减少对英伟达高端 GPU 长期采购依赖。 国际 2026年07月25日 0 点赞 0 评论 1155 浏览
Meta 敲定 2 年百亿算力租赁大单,向 Anthropic 开放闲置 AI 训练集群资源 7 月 18 日海外科技媒体披露,Meta 与 AI 独角兽 Anthropic 正式达成两年期算力租赁合作协议,合约总金额上限达 100 亿美元,按月结算算力服务费,双方均保留合约提前终止权限。Meta 将开放自有万卡级高端训练 GPU 集群资源,专供 Anthropic 新一代 Claude 系列大模型迭代、多智能体并发推理使用。 国际 2026年07月21日 0 点赞 0 评论 1146 浏览
国产大模型全球周调用量连续 11 周领跑,海外企业批量采购国产推理算力服务 海外创投机构 7 月最新统计数据显示,国产开源大模型全球单周 Token 调用量已连续 11 周超越美国闭源模型,周度词元消耗规模为海外头部模型四倍以上,全球 80% 海外 AI 创业企业选择国产开源基座搭建自有业务系统。 数据 2026年07月25日 0 点赞 0 评论 797 浏览
英伟达推出 Jetson Thor 边缘算力模组,端侧可本地运行完整通用大模型 7 月 15 日英伟达正式发布新一代 Jetson Thor 全系列边缘 AI 算力模组,面向人形机器人、自动驾驶、工业终端、便携智能设备打造,40W 超低功耗硬件可实现 400TFLOPS FP4 超高算力,无需依赖云端远程算力,终端本地即可部署、运行完整通用大模型。 国际 2026年07月21日 0 点赞 0 评论 707 浏览
Meta 自研 Iris AI 芯片 9 月量产,2nm 代工大单锁定三星,全年算力投入 1450 亿美元 7 月 9 日路透社获取 Meta 内部研发备忘录,公司第四代自研 AI 加速器 Iris 芯片定于 2026 年 9 月正式量产,由三星 2nm GAA 工艺代工,六周完成全流程缺陷验证,研发进度大幅超预期。Iris 定位为 GPU 补充算力,承接平台日常推理、智能体调度、多模态内容生成任务,不完全替代英伟达高端训练 GPU。 国际 2026年07月19日 0 点赞 0 评论 593 浏览
SK 海力士纳斯达克上市创半导体 IPO 纪录,CEO 预判芯片紧缺周期延续至 2030 年后 7 月 10 日 SK 海力士正式登陆纳斯达克,ADR 发行价 149 美元,收盘涨幅 12.76%,总市值突破 1.22 万亿美元,募资总额 265 亿美元,创下全球半导体行业有史以来最大 IPO 融资纪录。 国际 2026年07月19日 0 点赞 0 评论 228 浏览
谷歌 NotebookLM 更名 Gemini Notebook,全面打通 Gemini 大模型专属企业算力池 7 月 17 日谷歌官宣旗下 AI 研发工具 NotebookLM 正式更名为 Gemini Notebook,产品全面并入 Gemini 大模型完整生态,打通谷歌云专属隔离企业算力池,面向政企客户提供独立、加密的模型训练、文档推理算力资源。 国际 2026年07月22日 2 点赞 0 评论 165 浏览
英伟达发布 Vera CPU 架构,专为 AI 智能体高并发调度场景定制优化 7 月 6 日英伟达正式发布全新 Vera 专用 CPU 架构,核心面向 AI 智能体时代算力需求设计,解决传统通用多核 CPU 在智能体多轮调度、工具高频调用场景下延迟高、资源利用率不足的行业痛点。传统算力架构仅侧重 GPU 并行计算性能,AI 智能体自主规划、多工具交互、长记忆推理等任务高度依赖单线程 CPU 性能,长期存在算力瓶颈;Vera 架构大幅提升单线程运算速度,原生适配英伟达 DSX 国际 2026年07月15日 12 点赞 0 评论 153 浏览