一场英伟达GTC,黄仁勋释放出3大信号

“我只想让大家知道,此刻站在这里,全凭临场发挥。”北京时间3月19日凌晨1点,英伟达CEO黄仁勋迎着台下上万名观众的欢呼声,开启了2025年度GTC大会的主题演讲。

没有预备发言稿,也没有提词器,但黄仁勋在两个多小时的演讲可谓“信息量爆炸”:Blackwell进展、AI市场判断、机器人、光电共封装CPO新品(pǐn)……这(zhè)些(xiē)备(bèi)受业界关注的焦点,英伟达一件不落地给出了最新官方回应。

显然,临场发挥的黄仁勋必须“有备而来”,抓住这一令全球目光聚焦的时刻,不仅亟需证明英伟达本身,更要证明英伟达对AI押下的赌注是正确的。

GTC现场,黄仁勋与小机器人同台互动

信号一:Agentic AI时代,计算需求或将暴增

拨开GTC演讲的大幕,黄仁勋最先也最想释放出的信号与AI市场直接相关。

人工智能真正进入全球公众视野,大约是在十年前。在这十年光景里,人工智能经历了不同阶段的变化。一开始是感知人工智能,包括计算机视觉、语音识别;接着是过去五年逐渐受到关注的生成式人工智能:在一个模态与另一个模态之间进行转换,例如文生图、图生文、文生视频。

“生成式人工智能从根本上改变了计算的方式,从检索式计算模型(xíng)转(zhuǎn)变(biàn)为(wèi)生(shēng)成(chéng)式(shì)计(jì)算(suàn)模(mó)型(xíng)。”黄(huáng)仁(rén)勋(xūn)表(biǎo)示(shì)。

此(cǐ)次(cì)GTC大(dà)会(huì),“Agentic AI”(代(dài)理(lǐ)式(shì)AI)成(chéng)为(wèi)英(yīng)伟(wěi)达(dá)频(pín)频(pín)提(tí)及(jí)的(de)关键词。黄(huáng)仁(rén)勋(xūn)对(duì)其(qí)进(jìn)行(xíng)了(le)解(jiě)释(shì):“Agentic AI”从(cóng)根(gēn)本(běn)上(shàng)说(shuō),是(shì)指(zhǐ)具(jù)备(bèi)“自(zì)主性(xìng)”(agency)的(de)AI,它(tā)能(néng)够(gòu)感(gǎn)知(zhī)和(hé)理(lǐ)解(jiě)环(huán)境(jìng)的(de)上(shàng)下(xià)文,很(hěn)重(zhòng)要(yào)的(de)一(yī)点(diǎn)是(shì)它(tā)能(néng)进(jìn)行(xíng)推(tuī)理(lǐ),思(sī)考(kǎo)如何回答或解决问题,制定并执行计划,还能使用工具。黄仁勋认为,Agentic AI 的基础是推理。

英伟达Dynamo 开源库加速并扩展 AI 推理模型

“今年的GTC被称为(wèi)AI界(jiè)的(de)‘超(chāo)级(jí)碗’。唯一的区别在于,在这场‘超级碗’里,每个人都是赢家。”黄仁勋做出如此比喻,透露出其对AI前景的乐观态度。

以DeepSeek为代表的开源推理大模型的问世,曾一度令英伟达遭受资本市场的质疑。今年2月,黄仁勋首次正(zhèng)面(miàn)表(biǎo)达(dá)了(le)对(duì)于(yú)DeepSeek问(wèn)世(shì)将(jiāng)利(lì)好(hǎo)英(yīng)伟(wěi)达(dá)未(wèi)来(lái)的(de)信(xìn)心(xīn)。在(zài)本(běn)次(cì)GTC大(dà)会上,黄仁勋再次对AI需(xū)求(qiú)问(wèn)题(tí)作(zuò)出(chū)回(huí)应(yīng):

“过(guò)去(qù)这(zhè)一(yī)年(nián),几(jǐ)乎(hu)整(zhěng)个(gè)世(shì)界(jiè)在(zài)这(zhè)方(fāng)面(miàn)都(dōu)看(kàn)走(zǒu)眼(yǎn)了(le)。AI的(de)计(jì)算(suàn)需(xū)求(qiú)及(jí)其(qí)扩(kuò)展(zhǎn)定(dìng)律(lǜ)其(qí)实(shí)更(gèng)具(jù)韧(rèn)性(xìng),甚(shén)至(zhì)可(kě)以(yǐ)说(shuō)是超加速。由于Agentic AI、推理的出现,如今我们所需的计算量比一年前的预期至少高出100倍。”

上述判断如何得出?答案藏在被英伟达视为人工智能基本构成单元的“token”身上。

黄仁勋表示,现在我们有了能逐步推理的AI,它利用“Chain of Thought”(思维链)、取多种解法里最优和一致性检查等多种技术,一步一步地分解问题,进行推理。由此可以想见,AI所生成的token数量会急剧增多。

那么,前文的“100倍”具体意味着什么?黄仁勋用数字给出解释:这也许是生成了100倍的token数量;又(yòu)或(huò)者(zhě),模(mó)型(xíng)本(běn)身更复杂,只生成10倍的token,但若想让模型具备交(jiāo)互(hù)性(xìng)、实(shí)时(shí)性,就要把计算速度再提高10倍。这样一来,10倍的token、10倍的速度,就相当于需要100倍的计算量。因此,推理所需的计算量远超以往。

信号二:芯片路线图按节奏推进

如果AI计算需求持续呈倍数级增长,英伟达如何应对?

“英伟达未来几年的路线图,大约保持一年一次的迭(dié)代(dài)节(jié)奏(zòu),就(jiù)像(xiàng)时(shí)钟(zhōng)滴(dī)答(dá)一(yī)样(yàng)稳(wěn)定(dìng)。”黄(huáng)仁(rén)勋(xūn)表(biǎo)示(shì)。

借(jiè)助(zhù)今(jīn)年(nián)GTC大(dà)会(huì),黄(huáng)仁(rén)勋(xūn)提(tí)前(qián)透(tòu)露(lù)了(le)一(yī)张(zhāng)涉(shè)及(jí)未(wèi)来几年的芯片架构路线图,将每年升级全栈AI系统、发布一条新产品线:2025年下半年推出Blackwell Ultra,2026年下半年推出Rubin,2027年下半年推出Rubin Ultra,预计2028年推出采用下一代HBM的Feynman平台。



Blackwell 系列工作站和服务器GPU

具体来看,英伟达于去年3月发布了AI芯片与超级计算平台Blackwell架构,并推出GB200芯片。此次黄仁勋表示,目前Blackwell已经全面投产。今年,Blackwell新一代芯片的(de)正(zhèng)式(shì)名字(zì)为(wèi)Blakwell Ultra。据(jù)悉(xī),Blackwell Ultra由(yóu)台(tái)积(jī)电(diàn)N4P工(gōng)艺(yì)的(de)Blackwell GPU+Grace CPU+更(gèng)大(dà)容(róng)量(liàng)的(de)HBM封(fēng)装(zhuāng)而(ér)来(lái)。英(yīng)伟(wěi)达(dá)表(biǎo)示(shì),Blackwell Ultra也(yě)适(shì)用(yòng)于(yú)AI智(zhì)能(néng)体(tǐ),以(yǐ)及(jí)用(yòng)于(yú)训(xun)练(liàn)机(jī)器(qì)人(rén)和(hé)汽(qì)车(chē)自(zì)动驾驶的“物理AI”。

此外(wài),英(yīng)伟(wěi)达(dá)公(gōng)布(bù)了(le)继(jì)Hopper、Blackwell之(zhī)后(hòu)的(de)下(xià)一(yī)代(dài)GPU架(jià)构(gòu)Rubin——以(yǐ)在(zài)暗(àn)物(wù)质(zhì)研(yán)究(jiū)领(lǐng)域取(qǔ)得(de)突(tū)破(pò)性(xìng)进(jìn)展(zhǎn)的(de)天(tiān)文学(xué)家(jiā)Vera Rubin命(mìng)名,以(yǐ)及(jí)Rubin Ultra的(de)计(jì)划(huà)配(pèi)置(zhì)。据(jù)悉(xī),Rubin平(píng)台(tái)拥(yōng)有(yǒu)全新(xīn)的(de)CPU和(hé)网(wǎng)络(luò)架(jià)构(gòu),性(xìng)能(néng)将(jiāng)是(shì)Hopper的(de)两(liǎng)倍(bèi),且(qiě)内(nèi)存(cún)更(gèng)大(dà),将(jiāng)为(wèi)AI应(yīng)用(yòng)提(tí)供(gōng)更(gèng)强(qiáng)大(dà)的(de)支(zhī)持(chí)。Rubin Ultra系(xì)统(tǒng)由(yóu)Rubin Ultra GPU和(hé)Vera CPU组成。Rubin Ultra由4块掩模尺寸的GPU组成,拥有1TB HBM4e内存,FP4峰值推理能力可达100PFLOPS。

值得一提的是,此次黄仁勋还宣布了Rubin之后的下一代AI芯片架构“Feynman”。该名称源自对量子计算领域有着重要贡献的科学家Richard Phillips Feynman。

提前公布未来三年路线图的原因何在?黄仁勋给出的解释是,现在要建的是AI工厂,这需要多年规划。

“这可不是买台笔记本电(diàn)脑(nǎo)那(nà)么(me)简(jiǎn)单(dān),也(yě)不(bù)是(shì)一(yī)笔(bǐ)随(suí)心(xīn)所(suǒ)欲(yù)的(de)支(zhī)出(chū),而(ér)是(shì)必(bì)须(xū)经(jīng)过(guò)对(duì)土(tǔ)地(de)、电(diàn)力(lì)、资(zī)金(jīn)、工(gōng)程(chéng)团(tuán)队(duì)等(děng)各(gè)方(fāng)面(miàn)的(de)长(zhǎng)远计划。”黄仁勋在演讲中说道, “所以我们必须给出一个2—3年的预告,而不是等到某个月份突然说‘嘿,下个月又有一个超棒的新系统’”。

信号三:关于未来还有更多“宏大叙事”

AI行业并非一个单点,而是从技术到设施再到应用的一个立体面。因此,作为AI行业走在前面的那一批,英伟达的故事只讲“芯片”还远远不够。此次,黄仁勋从一些侧面传达出(chū)英(yīng)伟(wěi)达(dá)在(zài)整(zhěng)个(gè)AI产(chǎn)业(yè)链(liàn)的(de)布(bù)局(jú)。



英伟达正式发布硅光网络交换机

从上游技术层面来看,AI光通信时代背景下,数据中心规模持续扩大,带宽容量与高速数据传输速率的需求明显增加。光电共封装(Co-Packaged Optics,CPO)作为一种新型的光电子集成技术,受到产业界众多头部企业关注。此次,英伟达正式发布硅光子网络交换机Spectrum-X和Quantum-X,目的是推动AI工厂扩展到数百万GPU级别。值得关注的是,英伟达的硅光生态系统伙伴包括了台积电、康宁、Browave、Coherent等(děng)知(zhī)名公(gōng)司(sī)。

“AI工(gōng)厂(chǎng)是(shì)一(yī)种(zhǒng)超(chāo)大(dà)规(guī)模(mó)的(de)新(xīn)型(xíng)数(shù)据(jù)中(zhōng)心(xīn),必(bì)须(xū)采用(yòng)全新(xīn)的(de)网(wǎng)络(luò)基(jī)础(chǔ)设(shè)施(shī)才(cái)能(néng)跟(gēn)上(shàng)它(tā)的(de)发(fā)展(zhǎn)步(bù)伐(fá)。”黄(huáng)仁(rén)勋(xūn)表(biǎo)示(shì),英(yīng)伟(wěi)达(dá)将(jiāng)硅(guī)光(guāng)直(zhí)接(jiē)集成(chéng)到(dào)交(jiāo)换(huàn)机(jī)中(zhōng),打(dǎ)破(pò)了(le)超(chāo)大(dà)规(guī)模(mó)和(hé)企(qǐ)业(yè)网(wǎng)络(luò)的(de)旧(jiù)有(yǒu)限(xiàn)制(zhì),为(wèi)百(bǎi)万(wàn)GPU AI工(gōng)厂(chǎng)打(dǎ)开(kāi)大(dà)门(mén)。”据(jù)悉(xī),英(yīng)伟(wěi)达(dá)的(de)硅(guī)光(guāng)交(jiāo)换(huàn)机(jī)创(chuàng)新(xīn)地(de)集成(chéng)了(le)光(guāng)器(qì)件(jiàn),减(jiǎn)少(shǎo)了(le)4倍(bèi)的(de)激(jī)光(guāng)器(qì)数(shù)量(liàng),与(yǔ)传(chuán)统(tǒng)方(fāng)法(fǎ)相(xiāng)比(bǐ),能(néng)源(yuán)效(xiào)率(lǜ)提(tí)高(gāo)到3.5倍,信号完整性提高到63倍,大规模组网可靠性提高到10倍,部署速度提高到1.3倍。

在下游应用层面,机器人赛道是当前人工智能应用中最受关注的领域之一。此次的GTC大会,英伟达发布了全球首个开源且完全可定制的人形机器人基础模型Isaac GR00T N1,并推出加速机器人开发的仿真框架。其中,英伟达、谷歌DeepMind和迪士尼合作开发新一代开源物理引擎Newton,旨在加速人形机器人学习与开发。

“物理AI和机器人正在飞速发展,可能会成为规模最大的产业。”黄仁勋表示,一切的核心挑战跟之前类似:数据从哪来、模型架构是什么、以及如何做扩展(scaling)。在机器人领域,同样需要能大量生成或获取数据,需要强大的算力来训练模型,以及让AI越训越强的扩展性。

邮箱:sales@sannengdianqi.com

电话:021-2658 3069

友情链接 集成电路有限公司 - 官方网站入口