|
|
哈喽大家好!各位每天泡在数据中心里盯着成千上万台服务器的CPU利用率曲线和内存带宽占用率、一听说有新架构发布就赶紧掏出计算器盘算现有设备还能再撑几个季度才需要大规模汰换的基础设施运维负责人和IT资产管理专员,正在为即将上线的AI Agent调度平台挑选服务器硬件、在AMD EPYC和Intel Xeon之间反复比较核心数量、内存带宽和PCIe代数比到头昏脑涨、连Excel对比表格都做了好几个版本的系统架构师和企业IT采购决策者,买了AMD股票之后每个季度都盯着他们的服务器CPU市场份额从0.2%一路飙升到46%的爬坡过程、看到这个数字就忍不住嘴角上扬、恨不得截图发朋友圈的美股散户投资者和中长期价值持有者,一直觉得在AI时代CPU早就退居二线当配角了、没想到这回AMD愣是把CPU重新拉回了舞台中央、甚至让它成了决定AI工作流效率的关键变量的NVIDIA和Intel生态长期关注者,还有那些纯粹是因为看到“2nm芯片量产”和“性能是NVIDIA Vera两倍多”这种标题就觉得血脉偾张、迫不及待想点进来看看到底AMD又放了什么惊天大招的硬件发烧友和科技新闻吃瓜网友——今天咱们要好好掰扯掰扯的这个事儿,可以说是这个礼拜在旧金山举行的AMD Advancing AI 2026大会上最具爆炸性、最让人坐不住、最值得反复回味的一条消息了,因为它直接关系到未来数据中心里AI工作负载到底谁来指挥、谁来调度、谁来跑那些GPU干不了或者不适合干的活儿,也关系到你明年采购服务器的时候到底该把钱花在谁家身上。
事情发生在当地时间7月22日,也就是这个礼拜的星期三。AMD在美国加利福尼亚州旧金山市的莫斯康展览中心西馆,继续推进他们的年度盛会“AMD Advancing AI 2026”。就在前一天,他们刚刚发布了基于HBM4的新一代AI加速器Instinct MI455X,把内存带宽推到了一个前所未有的新高度,让整个行业都为之侧目。而到了这一天,AMD又把火力瞄准了服务器CPU这个同样重要、甚至从某些角度来看更加基础的战场,正式宣布其第六代服务器中央处理器——代号“Venice”的EPYC系列——已经进入量产阶段。这颗芯片采用的是2纳米制造工艺,是目前整个服务器CPU行业里工艺最先进、晶体管密度最高的产品之一,没有之一,连Intel和NVIDIA目前在售的产品在工艺上都还没有追上这个水平。
AMD在这场发布会上不仅公布了Venice的详细产品线规划和各个型号的具体定位,还直接甩出了一组让全场倒吸一口凉气、让竞争对手脸色不太好看、让台下观众忍不住掏出手机拍照的基准测试对比数据。在完全相同的运行条件下,Venice的计算吞吐量达到了NVIDIA刚刚发布的新一代CPU“Vera”的2.2倍,而在Token处理速度上,Venice比Intel的第六代Xeon快了1.8倍。这几个数字一出来,现场的气氛一下子就变了——因为在很多人的固有印象里,AI时代的主角应该是GPU,CPU不过是负责打杂、跑跑操作系统和调度任务的配角,但AMD这一轮操作,等于是在告诉整个行业:你们搞错了,CPU才是那个真正决定AI工作流效率的关键变量,尤其是在AI正在从“一问一答”向“自主执行”演变的当下,CPU的重要性只会越来越高。
为什么这么说呢?因为AI跟人互动的方式正在发生剧烈的变化,这个变化的速度可能比大多数人意识到的要快得多,甚至快到有些企业还没来得及调整自己的基础设施架构就已经落后了。过去大家习惯了那种“用户问一个问题,AI给出一个答案”的一次性问答模式,就跟你去百度或者Google敲个关键词然后得到一堆链接差不多,问完就完事了,对话结束,不需要后续的跟踪和执行。但最近一两年,一种叫做“Agentic AI”的新范式正在快速扩散开来,而且势头越来越猛,几乎成了各大AI公司竞相布局的方向。在这种模式下,AI不再只是被动地回答单个问题,而是能够自主地决定要执行哪几个步骤、调用哪些外部工具、持续不断地推进一项复杂的任务,直到完成为止。比如说,你让它帮你订机票、订酒店、安排行程、同步到日历、发邮件通知参会人员——它不会只回答你一句“好的,我明白了”,而是会一步一步地去操作这些外部工具,把整件事从头到尾给你办妥,中间遇到问题还会自己想办法解决,比如航班取消了它会自动帮你改签。而这种多步骤、多工具的自主执行过程,背后就需要大量的编排、调度和实时控制工作,复杂度比单一问答高了不止一个数量级。这时候,CPU的作用就凸显出来了。因为GPU虽然擅长并行计算、擅长跑矩阵乘法、擅长处理大规模的张量运算,但它不擅长做决策、不擅长管理流程、不擅长实时控制那些相互隔离的执行环境——而这些恰恰是CPU最拿手、最擅长的领域。AMD在会上明确指出,他们对Agentic工作流进行了深入分析之后确认,有相当大一部分细粒度的任务直接依赖于CPU的计算性能,而不是GPU。换句话说,如果你想让AI Agent跑得又快又稳、不出岔子,你需要的不仅仅是一块好显卡,更需要一颗足够强大的服务器CPU来指挥全局、协调各方、处理那些GPU顾不过来的琐碎但关键的调度任务。
AMD负责计算和企业AI解决方案的高级副总裁拉维·库普斯瓦米在发布会现场的发言,很好地概括了这个趋势背后的逻辑。他是这么说的:“在聊天机器人时代,整个架构是线性的——用户输入一句话,模型返回一个答案,完事儿,就这么简单直接。但现在的Agentic AI时代完全不同了,它是一个多个Agent和多种工具有机协作的结构,复杂度呈指数级上升,每一个环节都需要CPU参与决策和调度。”他还补充道,AMD通过对真实的Agentic工作流进行逐层分解和分析之后确认,这里面的大量细粒度任务,都跟CPU的计算性能直接挂钩,CPU的好坏直接决定了整个AI Agent系统的响应速度和执行效率,容不得半点马虎。如果你用的CPU不够强,Agent在执行多步骤任务的时候就容易出现卡顿、延迟甚至超时失败的情况。
那么这次正式发布的Venice到底有多强呢?咱们来详细拆解一下,把每个关键信息都掰开揉碎了讲清楚,确保你读完心里有个完整的画面。Venice是基于AMD下一代“Zen 6”和“Zen 6c”两种架构打造的,根据客户的不同使用场景和预算需求,AMD会陆续推出四个不同的产品线,覆盖从云端到边缘的各种场景。最先登场的旗舰型号叫“EPYC 9006 SP7”,主要面向大型数据中心运营商和云计算厂商,是一款追求极致性能、不惜工本的产品。它采用Zen 6c架构,最高支持256个核心和512个线程,这个核心数量在服务器CPU领域可以说是遥遥领先,把竞争对手甩开了一大截。这还没完,它还是整个服务器CPU行业里第一款支持PCI Express Gen 6标准的产品,同时配备了高达1.6TB/s的超高内存带宽。这个数字是什么概念呢?相当于每秒可以传输大约1600GB的数据,比目前主流的服务器CPU带宽高出好几倍,意味着CPU可以更快地从内存中读取和写入数据,大大减少等待时间,提升整体工作效率。SP7现在已经进入量产阶段,预计从今年第四季度开始向客户出货,到时候我们就可以看到实际的产品表现了。
除了旗舰SP7之外,AMD还规划了另外三条产品线来覆盖不同的市场需求,可以说是布下了一张密不透风的网。主打性价比、面向成本敏感型客户的“SP8”预计在2027年上半年推出;专门为高性能计算和数据预处理场景深度优化的“Venice-X”,以及面向低功耗AI服务器和边缘计算场景的“Verano”,则预计在2027年下半年出货。整个产品阵容从高端到低端、从通用计算到专用加速,覆盖了从云端到边缘、从高性能计算到能效优先的各种场景,可以说AMD是想用这一代Venice把服务器CPU市场的各个细分领域都吃透、都拿下,不给竞争对手留下太多的喘息空间。
说到市场份额,AMD还公布了一组很有意思的历史数据,让人不得不感慨这家公司的逆袭之路走得有多坚决、有多漂亮。自从2017年第一代EPYC Naples问世以来,AMD在服务器CPU市场的收入份额从当年微不足道的区区0.2%,一路攀升到了2026年第一季度的46%。这个增长速度,在整个半导体行业的历史上都是极为罕见的,几乎可以说是教科书级别的逆袭案例,完全可以写进商学院的教材里。从一个几乎可以忽略不计的玩家,到跟Intel平分秋色、甚至在某些季度实现超越,AMD只用了不到十年的时间。而Venice的发布,显然是要在这个基础上更进一步,向着超过50%的市场份额发起冲击,真正坐上服务器CPU的头把交椅。
在发布会上,AMD还直接放出了跟NVIDIA最新CPU“Vera”以及Intel第六代Xeon的正面对比数据,可以说是毫不留情、刀刀见血。在完全相同的运行条件下,Venice(256核心、600瓦功耗)实现了NVIDIA Vera(88核心、450瓦功耗)2.2倍的计算吞吐量。即便是按每个核心的性能来算,Venice也比Vera领先了20%,这说明Venice不仅在核心数量上有绝对优势,单个核心的效率也很能打,不是那种靠堆核心数量来充门面的货色。在机架级别,一个基于Venice的机架最多可以容纳49152个核心,而基于NVIDIA Vera的机架只能容纳22528个核心,核心密度是后者的2.2倍。在GPU宿主节点的环境中,Venice的Token处理速度比Intel第六代Xeon快了1.8倍。这些数字意味着什么?意味着如果你现在正在搭建一个大规模的AI集群,用Venice做CPU节点,你可以在更少的机架空间里塞进更多的计算能力,从而节省机房面积、降低散热成本和电力开销,最终体现在总拥有成本的显著下降上。这对于那些正在扩建数据中心的企业来说,诱惑力是相当大的。
AMD还给出了一个更直观、更震撼的替换案例,让在场的观众直接感受到了Venice带来的降本增效潜力到底有多恐怖、多离谱。他们说,五年前部署的、基于Intel Xeon Gold处理器的1000台老旧服务器所能承担的计算工作量,现在只需要82台搭载Venice(具体型号EPYC 9996)的服务器就能完全替代。你没看错,是82台替代1000台,比例超过了12比1。这82台新服务器不仅能干完原来1000台老服务器的活儿,而且数据中心的整体功耗可以降低高达77%,五年期的总体拥有成本可以减少40%。这个数字一出来,估计不少正在为老旧服务器扩容和电费账单头疼的数据中心经理已经开始拿起计算器算账了——82台新机器替换1000台旧机器,省下来的机房空间、电力消耗和运维人力成本,加起来可不是一笔小数目,足够让CFO笑出声来。
库普斯瓦米在发布会的最后总结道:“第六代EPYC‘Venice’是我们迄今为止打造的最全面的CPU产品组合,它被精心设计用来全面支持AI数据中心每一个细分领域的需求,无论是训练、推理还是数据预处理,都能找到合适的型号来匹配。凭借压倒性的处理速度和超高内存带宽,Venice将进一步巩固我们在下一代AI基础设施市场上的领导地位。”
这番话听起来可能有点官方、有点像是在念稿子,但从今天公布的这些数据和产品规划来看,AMD确实有底气这么说,也确实拿出了实实在在的成绩单来支撑自己的主张。当整个行业都在疯狂追逐GPU算力、把所有的注意力和资金都集中在显卡上的时候,AMD选择了一条不一样的路线——他们提醒整个行业:CPU依然是数据中心里不可或缺的大脑,尤其是在Agentic AI时代,CPU的重要性不但没有下降,反而在上升,因为你需要一个足够强大、足够聪明的大脑来指挥那些越来越多、越来越聪明的AI Agent,让它们协同工作而不是各自为战。而Venice这颗2纳米工艺、256核心、支持PCIe Gen 6和1.6TB/s内存带宽的怪兽级处理器,就是AMD在这个方向上投下的最重的一枚棋子,也是他们向竞争对手发出的最响亮、最不容忽视的宣战信号。接下来就看Intel和NVIDIA怎么接招、怎么回应了,这场服务器CPU的战争,远未到落幕的时候,好戏还在后头。
|
本帖子中包含更多资源
您需要 登录 才可以下载或查看,没有账号?立即注册
x
|