news 2026/7/24 23:25:07

AI 芯片简报 07.21-07.24:NVIDIA Vera 亮剑、AMD 2nm GPU、Google 叛逃 CoWoS

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
AI 芯片简报 07.21-07.24:NVIDIA Vera 亮剑、AMD 2nm GPU、Google 叛逃 CoWoS

每期覆盖 3-4 天的 AI 芯片动态。个人视角,不追求面面俱到——只讲我认为重要的。周二、五更新。

7 月 21 日到 24 日这四天,AI 芯片行业发生的事,放在任何一个正常的年份,都够写一个季度的头条。NVIDIA、AMD、Intel 三巨头在 72 小时内密集出牌,不是巧合——是所有人都看到了同一个信号:CPU 在 AI 系统中的角色正在从配角变主角。


NVIDIA 摊牌了:Vera CPU 一年卖 130 万颗,$5,000 一颗

NVIDIA 选在 AMD Advancing AI 大会前一天放出 Vera CPU 的完整规格。这时间点,摆明了就是要抢风头。

Vera 的数据确实够硬:88 核 ARM v9.2(Olympus 核),1.2 TB/s 内存带宽,CXL 3.1 原生支持。在 AI Agent 任务中比 x86 快 50% 到 1.9 倍,延迟只有 x86 的六分之一。6 月已经交付 OpenAI、Anthropic、SpaceX 做样品测试。

更狠的一个数字:CoreWeave 在 Vera Rubin NVL72 上跑 DeepSeek-R1,每兆瓦产出 10 倍于 Grace Blackwell NVL72 的 token。10 倍。不是 10%。

Wolfe Research 估 Vera 今年出货 130 万颗、单颗 $5,000。算一下,这就是 $65 亿的年收入——而且这还只是 CPU 部分,不算配套的 Rubin GPU 机架。NVIDIA 有超过 300 家合作伙伴在部署 Vera Rubin,供应链铺到 30 个国家 350 多家工厂。

我判断:Vera 不是来「试试」服务器 CPU 市场的。$5,000 的 ASP、「300 家合作伙伴」的规模、「从芯片到机架到网络」的垂直整合——NVIDIA 是在用 GPU 市场赚来的钱,建一座 CPU 市场的护城河。

有一个细节值得单拎出来说:Rubin 架构是全球第一个 100% 液冷、零水消耗的 AI 平台。冷却剂工作温度 45°C——这个数字意味着在加州、德州、中国的多数数据中心,可以直接用室外干式冷却器散热,不需要冷水机。一个 50MW 设施每年省 $400 万以上的冷却电费。能效比,正在变成比绝对算力更硬的购买理由。


AMD 掀桌了:全球第一款 2nm GPU,不是 NVIDIA

AMD 在 7 月 23 日的 Advancing AI 大会上亮出了 MI455X。我坦白讲,看到 2nm GPU 来自 AMD 而不是 NVIDIA,我是意外的。

MI455X 的核心数据:TSMC 2nm 工艺(比 NVIDIA Rubin 的 3nm 领先整整一代),CDNA 5 架构,3200 亿晶体管,12 个计算 chiplet,432GB HBM4(Samsung 12 层堆叠),2048-bit I/O 跑出 23.3 TB/s 带宽。同期发布的 Venice CPU 是 2nm 512 线程 + PCIe 6.0,Helios 机架方案单柜 72 颗 MI455X,31TB 总 HBM4,1.7 PB/s 带宽。

AMD 同步宣布了 Anthropic 2GW MI450 采购协议和 $50 亿投资。上一次 AMD 敢在发布会上同时对标 NVIDIA 的 GPU、CPU 和整机架方案——我没有印象。

但那句话怎么说来着——硬件跑分是发布会的事,生产部署是客户的事。AMD 的 ROCm 软件栈与 NVIDIA CUDA 之间的差距,不是一个 MI455X 能填平的。上周 SemiAnalysis 发了篇报告,讲 NVIDIA 的 vLLM + Dynamo 在 MoE 模型 Kimi K2.5 上跑出 12,000+ tok/s/GPU,AMD 同样跑 vLLM 但缺少 MoE 专项优化。软件生态这个事,三年前大家觉得可以慢慢追,现在市场不给时间了。

我还是看好 AMD 在推理侧吃掉一部分份额——尤其是那些不想把全部筹码压在 NVIDIA 一家身上的云厂商。但训练侧的主战场,2026 年 AMD 还打不进去。


Intel:CPU 不够卖了

Intel Q2 财报 7 月 24 日盘后发。$161 亿收入,+25% YoY——15 年来最快的季度增速。数据中心的数字更吓人:DCAI 业务 $63 亿,+59% YoY。AI 相关业务增长 70%+,占总收入大概七成。

CEO Lip-Bu Tan 原话:CPU 需求「超过当前供给能力」。已经签了 10 份长期服务器 CPU 供货合同。2026 年资本支出拉到 $200 亿以上,2027 年还要再往上加。

盘后涨 11%。市场买账了。

我的一个观察:这三家同时在喊「CPU 不够卖」——不是营销话术。Agentic AI 在把 CPU:GPU 的配比从 1:8 往 1:1 推。Bernstein 预计 AI 工作负载中 CPU 的算力占比会从 14% 跳到 ~50%。SemiAnalysis 的 Dylan Patel 直接说「CPU 严重短缺,4 倍需求暴增」。这是结构性的,不是周期性的。


Google 叛逃 CoWoS:一个迟早会来的时刻

SemiAnalysis 7 月报告爆了一个料:Google 下一代 TPU(代号 Humufish)已经从 TSMC CoWoS 切换到了 Intel EMIB-T。

怎么理解这件事?

TSMC 的 CoWoS 产能,NVIDIA 自己就吃了 56%。剩下 44% 分给 AMD、Broadcom、Google、AWS、MediaTek……排期 52 到 78 周。Google 不是不想用 CoWoS——是用不起也等不起。

Intel EMIB-T 的优势在纸面上很清楚:硅用量只要 CoWoS 的三分之一到五分之一,单颗成本低 30-50%,支持 8 到 12 倍光罩尺寸(CoWoS 才 3.3 倍),后端良率已经超过 90%。Meta 在评估 EMIB 给 2028 年的 CPU,NVIDIA 据传在考虑 Feynman 世代 GPU 用 EMIB——但这个 NVIDIA 内部的讨论还没定论,先当传闻看。

我说一个判断:CoWoS 不会被打败,但垄断结束了。2027 年 CoWoS 需求翻到 268 万片的时候,Intel EMIB 可能有 5 万片月产能。不多,但够撬动了。


一句话速览

Kimi K3 48 小时自主设计芯片:Moonshot AI 用纯开源 EDA 工具让 Kimi K3 在两天内画了一颗 4mm² 45nm 芯片,Cadence 和 Synopsys 股价当天跌 9%(Needham 说别慌——45nm 和 3nm 之间的工程鸿沟 LLM 现在还跨不过去)。

CXMT $98 亿 IPO:中国最大 DRAM 厂 7 月 27 日敲钟,HBM 晶圆产能目标 2026-2027 年 3-5.5 万片/月(逻辑芯片下饺子,高带宽内存才是最粗的瓶颈)。

国产 AI 芯片出货占比破 60%:600 万+张等效算力卡,华为昇腾单品牌接近 30%。超节点从 PPT 变成了产能——华为在 WAIC 展出了 1024 卡超节点,1 EFLOPS FP8(我好奇的是这么多卡的实际互联效率,不是峰值算力)。

HBM 不再是唯一答案:FMS 2026 的核心主题——HBM 太贵了,大规模推理烧不起。LPDDR6 是第一个专门为数据中心设计的低功耗内存(不是从手机端改的),CXMT 已经出了 12.8 Gbps 工程样品。混合内存管理(HBM + LPDDR + HBF + CXL 分级编排)会是个值得追的新方向。

ASML 的 MATCH Act 威胁:DUV 比 EUV 更危险——如果 MATCH Act 通过,ASML 不仅要停止卖 DUV 给中国,还得切断数百台已装设备的维保。中国占 ASML 2026 年收入约 20%,大部分是 DUV。


本周趋势

基于 topic-index 累计数据,反映各主题关注度变化。


我的判断

这是一轮 CPU 军备竞赛的开幕,不是闭幕。NVIDIA Vera、AMD Venice、Intel Xeon 6 三家同时在拼 CPU——不是因为 CPU 本身的市场在扩大,是因为 Agentic AI 在把 CPU 从「够用就行」变成「不够用就是瓶颈」。谁先拿出 Agent 场景下能效比最高的 CPU,谁就拿走了下一轮 AI 基础设施采购的定价权。

下周看两件事:7 月 27 日 Kimi K3 技术报告发布,如果它能证明 EDA 工具链不只是 45nm 玩具,那 Cadence 和 Synopsys 的 9% 跌幅就不是恐慌而是先兆;同一天 Cadence Q2 财报,管理层怎么回应 Kimi K3 的竞争威胁,比财报数字本身更值得听。


AI 辅助调研,人工视角解读。数据来源公开,分析仅代表个人判断。每周二、五更新。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/7/24 23:24:37

如何快速掌握CTF流量分析:5分钟上手CTF-NetA终极指南

如何快速掌握CTF流量分析:5分钟上手CTF-NetA终极指南 【免费下载链接】CTF-NetA CTF-NetA是一款专门针对CTF比赛的网络流量分析工具,可以对常见的网络流量进行分析,快速自动获取flag。 项目地址: https://gitcode.com/gh_mirrors/ct/CTF-Ne…

作者头像 李华
网站建设 2026/7/24 23:22:20

宿舍投影仪测评:哪款宿舍投影仪值得买?2026宿舍投影仪推荐

上大学那几年,宿舍生活占据了大部分时间,除了上课、写作业、备考,晚上的时间怎么打发,大概是每个大学生都想过的问题。刷手机刷到脖子酸,趴床上看剧看到手麻,想一群人看个电影还得凑电脑屏幕……后来我发现…

作者头像 李华
网站建设 2026/7/24 23:22:03

魔兽争霸3终极助手:WarcraftHelper完整配置与性能优化指南

魔兽争霸3终极助手:WarcraftHelper完整配置与性能优化指南 【免费下载链接】WarcraftHelper Warcraft III Helper , support 1.20e, 1.24e, 1.26a, 1.27a, 1.27b 项目地址: https://gitcode.com/gh_mirrors/wa/WarcraftHelper 你是否还在为魔兽争霸3在现代系…

作者头像 李华
网站建设 2026/7/24 23:21:02

AI论文写作工具:提升学术效率的智能解决方案

1. 为什么我们需要AI论文写作工具作为一名在学术圈摸爬滚打多年的研究者,我深知论文写作的痛苦。从选题构思到文献综述,从实验设计到结果分析,每个环节都需要耗费大量时间和精力。最让人头疼的是,当你终于完成初稿后,还…

作者头像 李华
网站建设 2026/7/24 23:20:55

单细胞测序AI注释:大语言模型革新生物医学研究

1. 项目背景与核心价值单细胞测序技术近年来在生物医学领域掀起了一场革命,但海量数据的人工注释一直是制约研究效率的瓶颈。这个项目通过整合11个高质量数据集和构建1,226个标准化任务,为单细胞注释领域建立了首个基于大语言模型(LLM&#x…

作者头像 李华
网站建设 2026/7/24 23:19:40

深入解析ADS892xB系列ADC:转换器模块、接口协议与高速数据采集实战

1. 深入解析ADS892xB系列ADC的转换器模块与接口协议在精密测量和数据采集领域,模数转换器(ADC)扮演着将现实世界连续的模拟信号转换为数字系统可处理的离散代码的关键角色。对于从事嵌入式系统、工业自动化或测试测量设备开发的工程师而言&am…

作者头像 李华