久操免费资源,久久伦理一区,国产又黄又爽视频,情草av网,日本久久久在线免费,精品人妻互换一区三区,熟妇女一区二区三区,亚洲AV三区视频免费,老司机在线精品

本文整理了黃仁勛在GTC 2026演講中對(duì)未來(lái)十年AI計(jì)算的核心判斷,涵蓋軟硬產(chǎn)品與未來(lái)趨勢(shì)。 ## 1. 重新定義AI PC:本地可運(yùn)行Agent 黃仁勛聯(lián)合微軟推出AI PC產(chǎn)品RTX Spark筆記本,由英偉達(dá)與聯(lián)發(fā)科定制N1X芯片,臺(tái)積電3nm工藝,含Blackwell RTX GPU、20核定制Grace CPU,配128GB統(tǒng)一內(nèi)存,共700億個(gè)晶體管。 和傳統(tǒng)PC最大的區(qū)別是可在本地運(yùn)行Agent,用戶(hù)只需口述需求,Agent就能自主調(diào)用各類(lèi)軟件完成任務(wù),無(wú)需手動(dòng)操作;同時(shí)支持大模型運(yùn)行、專(zhuān)業(yè)創(chuàng)作與高幀游戲,兼顧實(shí)用性。 英偉達(dá)還推出桌面工作站版本DGX Spark,配備768GB內(nèi)存,可本地跑萬(wàn)億參數(shù)大模型,提供20 petaflops算力、每秒8TB內(nèi)存帶寬,供開(kāi)發(fā)者本地調(diào)試模型。多家廠(chǎng)商今年秋季將推出相關(guān)產(chǎn)品。 ## 2. 打造Agent專(zhuān)屬超級(jí)計(jì)算機(jī)Vera Rubin,構(gòu)建AI工廠(chǎng)基礎(chǔ)設(shè)施 Vera Rubin是專(zhuān)為Agent設(shè)計(jì)的五機(jī)架AI超級(jí)計(jì)算機(jī),由NVL72計(jì)算單元、Vera CPU機(jī)架、Groq 3 LPU機(jī)架、存儲(chǔ)機(jī)架和共封裝光學(xué)網(wǎng)絡(luò)機(jī)架構(gòu)成,處理Agent任務(wù)吞吐量較上一代Grace Blackwell提升10倍,組裝效率提升24倍,生產(chǎn)出貨將于今年秋季啟動(dòng)。 Vera Rubin集成全球首個(gè)投產(chǎn)的共封裝光學(xué)網(wǎng)絡(luò)交換機(jī),能效提升5倍、AI正常運(yùn)行時(shí)間延長(zhǎng)5倍、部署時(shí)間縮短三分之一,為百萬(wàn)GPU AI工廠(chǎng)打下基礎(chǔ);同時(shí)搭載全棧機(jī)密計(jì)算與DOCA安全軟件,不占用主機(jī)CPU即可實(shí)現(xiàn)端到端安全防護(hù)。 英偉達(dá)推出DSX平臺(tái)作為AI工廠(chǎng)的整體參考設(shè)計(jì),包含可預(yù)先模擬驗(yàn)證的DSX Sim、運(yùn)營(yíng)系統(tǒng)DSX OS、優(yōu)化電力利用的DSX Max-Q,可在相同電力預(yù)算下部署更多GPU,還能協(xié)同電網(wǎng)動(dòng)態(tài)調(diào)整功耗;黃仁勛預(yù)計(jì)本十年末將有100GW AI工廠(chǎng)上線(xiàn),英偉達(dá)通過(guò)提供完整驗(yàn)證的端到端基礎(chǔ)設(shè)施,幫客戶(hù)控制成本、提升資產(chǎn)壽命。 ## 3. 發(fā)布面向Agent的開(kāi)源大模型Nemotron 3 Ultra Nemotron 3 Ultra是專(zhuān)為Agent工作負(fù)載設(shè)計(jì)的開(kāi)源大模型,完整開(kāi)放模型、訓(xùn)練腳本與訓(xùn)練數(shù)據(jù),用戶(hù)可二次訓(xùn)練定制。 它采用狀態(tài)空間模型+專(zhuān)家混合的混合架構(gòu),速度比同類(lèi)模型快近五倍,可降低約30%運(yùn)行成本,支持長(zhǎng)時(shí)程推理與工具調(diào)用,目前已被用于英偉達(dá)芯片設(shè)計(jì)驗(yàn)證,可將驗(yàn)證周期從幾周壓縮至幾小時(shí)。 ## 4. 推出物理AI Cosmos 3與人形機(jī)器人參考套件Isaac GR00T Cosmos 3是英偉達(dá)推出的前沿物理AI世界模型,可通過(guò)轉(zhuǎn)換第三人稱(chēng)視頻、虛擬仿真生成符合物理規(guī)律的機(jī)器人訓(xùn)練數(shù)據(jù),解決機(jī)器人訓(xùn)練數(shù)據(jù)不足的痛點(diǎn),實(shí)現(xiàn)“計(jì)算就是數(shù)據(jù)”。 英偉達(dá)推出人形機(jī)器人參考套件Isaac GR00T,涵蓋機(jī)器人本體、計(jì)算平臺(tái)、AI模型、仿真工具、數(shù)據(jù)生成工具全棧,提供接近真人尺寸的參考設(shè)計(jì),研究者無(wú)需從零搭建基礎(chǔ)設(shè)施,可直接開(kāi)展任務(wù)訓(xùn)練。
黃仁勛對(duì)未來(lái)十年的完整判斷,今天都講明白了
2026-06-01 21:15

黃仁勛對(duì)未來(lái)十年的完整判斷,今天都講明白了

本文來(lái)自微信公眾號(hào):字母AI,作者:苗正,題圖來(lái)自:視覺(jué)中國(guó)


“計(jì)算就是收入、瓦特就是收入、每一個(gè)token都是收入!”


以上言論,均出自黃仁勛在GTC 2026上的演講。其內(nèi)容堪稱(chēng)AI時(shí)代的“時(shí)間就是金錢(qián)”。


黃仁勛表示,每瓦特產(chǎn)生的token越多,收入就越多。


他展示了一組數(shù)據(jù),GitHub上的代碼提交量在2026年前幾個(gè)月增加了近三倍,全球3000萬(wàn)軟件開(kāi)發(fā)者創(chuàng)造的3萬(wàn)億美元薪酬價(jià)值正在產(chǎn)生接近9萬(wàn)億美元的生產(chǎn)力。



在這場(chǎng)GTC大會(huì)上,黃仁勛帶來(lái)了許多新玩意。


最重磅的無(wú)疑是英偉達(dá)與微軟聯(lián)手設(shè)計(jì)的AI PC,第二樣是為Agent時(shí)代打造的Vera及其完整生態(tài),第三樣是開(kāi)源大模型Nemotron 3 Ultra,第四樣是物理AI Cosmos 3以及基于它而誕生的參考人形機(jī)器人Isaac。


這些東西串起來(lái),拼成了黃仁勛對(duì)未來(lái)十年計(jì)算模式的完整判斷。


重新定義AI PC


黃仁勛說(shuō),微軟與英偉達(dá)的合作將會(huì)重新定義AI PC這個(gè)概念。


黃仁勛在臺(tái)上展示了RTX Spark。


RTX Spark是一臺(tái)筆記本電腦,芯片叫N1X,英偉達(dá)和聯(lián)發(fā)科一起做的。里面有Blackwell RTX GPU,6144個(gè)CUDA核心,第五代Tensor Core,支持FP4精度。還有定制的20核Grace CPU,通過(guò)NVLink-C2C芯片互聯(lián)連接,配128GB統(tǒng)一內(nèi)存,臺(tái)積電3nm工藝,700億個(gè)晶體管。


數(shù)字生物學(xué)、地震處理、天體物理等應(yīng)用都可以運(yùn)行。所有與CUDA相關(guān)的物理、生物學(xué)、基因組學(xué)、AI、計(jì)算機(jī)圖形應(yīng)用,以及Windows的應(yīng)用,都可以運(yùn)行。



這臺(tái)電腦和傳統(tǒng)筆記本最大的區(qū)別是,它能在本地跑Agent。黃仁勛說(shuō)的Agent,就是能理解你說(shuō)的話(huà)、能看屏幕、能讀文件、能幫你干活的AI助手。以前這些AI都要連到云端才能用,現(xiàn)在可以直接在你的筆記本上跑。


黃仁勛說(shuō),過(guò)去40年你用電腦是啟動(dòng)應(yīng)用、點(diǎn)擊、輸入?,F(xiàn)在有了RTX Spark和Windows,你只需要問(wèn),電腦就會(huì)幫你完成工作。RTX Spark把英偉達(dá)30年積累的所有技術(shù),CUDA、RTX、AI平臺(tái),都放進(jìn)了一顆芯片。本地Agent、前沿模型、創(chuàng)意工作流、RTX游戲,全都能在一臺(tái)筆記本上跑。


這就是黃仁勛手中的個(gè)人AI電腦。


微軟為RTX Spark做了深度平臺(tái)優(yōu)化。


實(shí)現(xiàn)了工作負(fù)載配置文件調(diào)度,讓W(xué)indows調(diào)度器更高效地在所有20個(gè)核心上擴(kuò)展工作負(fù)載。無(wú)論你是在查看郵件還是在本地運(yùn)行Agent調(diào)試代碼,Windows調(diào)度器都會(huì)確保你從CPU獲得最佳性能和效率。


他們還啟用了微軟電源和熱管理框架,在保持涼爽的同時(shí)最大化性能和功率。


為了實(shí)現(xiàn)RTX Spark上高達(dá)128GB的內(nèi)存,微軟提高了GPU可訪(fǎng)問(wèn)的系統(tǒng)內(nèi)存上限,讓高內(nèi)存系統(tǒng)上的GPU可用內(nèi)存增加,從而能夠加載更大的本地AI模型或渲染更復(fù)雜的項(xiàng)目。


他們還增強(qiáng)了Windows在統(tǒng)一內(nèi)存系統(tǒng)上管理共享內(nèi)存區(qū)域頁(yè)面大小的方式,確保在重負(fù)載工作負(fù)載下有更大的內(nèi)存頁(yè)面可用,同時(shí)讓開(kāi)發(fā)者能夠靈活優(yōu)化CPU和GPU之間的內(nèi)存工作負(fù)載需求。


微軟CEO薩提亞·納德拉說(shuō),他們的目標(biāo)是用Windows把無(wú)限的智能送到每個(gè)家庭、每張辦公桌......


OpenClaw和Hermes Agent這些開(kāi)源Agent項(xiàng)目在GitHub和OpenRouter上的數(shù)據(jù)已經(jīng)創(chuàng)了紀(jì)錄,但一直沒(méi)能大規(guī)模普及,原因是沒(méi)法在用戶(hù)的主力電腦上安全、私密地跑Agent。


英偉達(dá)和微軟合作解決了這個(gè)問(wèn)題。他們做了新的Windows安全原語(yǔ)和英偉達(dá) OpenShell運(yùn)行時(shí),確保Agent在用戶(hù)完全掌控下安全運(yùn)行。


新的Windows提供身份、隔離、策略和端到端安全能力,用來(lái)原生構(gòu)建和運(yùn)行Agent。


英偉達(dá)OpenShell提供了一些自定義功能,比如讓用戶(hù)限制Agent能做什么,以及不能做什么,根據(jù)用戶(hù)的隱私策略智能地把查詢(xún)路由到本地模型,在發(fā)送到云端模型的查詢(xún)中隱藏個(gè)人信息。


Hermes Agent和OpenClaw在他們的新Windows應(yīng)用里用了這套安全和隱私層。這些應(yīng)用讓用戶(hù)可以輕松安全地訪(fǎng)問(wèn)設(shè)備端Agent,這些Agent能在Windows應(yīng)用里執(zhí)行任務(wù),推理跨應(yīng)用工作流,生成圖像和視頻,寫(xiě)插件和應(yīng)用代碼,語(yǔ)義搜索本地文件。


黃仁勛現(xiàn)場(chǎng)演示了一個(gè)在RTX Spark上本地運(yùn)行的Agent怎么幫他設(shè)計(jì)房子。Agent運(yùn)行Open Shell沙盒,連接Hermes編排系統(tǒng)和云端Claude Sonnet。


它選地點(diǎn),讀概念草圖、風(fēng)格情緒板、文字需求和設(shè)計(jì)意圖。Agent用筆記本上的工具,打開(kāi)Rhino為場(chǎng)地建模,塑造地形、退界和建筑外殼,提出建筑形式,針對(duì)成本、舒適性和質(zhì)量?jī)?yōu)化。


形式定好后,Agent生成內(nèi)部布局、墻體和流線(xiàn),房間成形。它隨時(shí)調(diào)整,自動(dòng)放置門(mén)窗和結(jié)構(gòu)元素,自己發(fā)現(xiàn)和修正錯(cuò)誤。批準(zhǔn)后,Agent從Rhino導(dǎo)出模型,導(dǎo)入Blender,材質(zhì)和對(duì)象屬性完整轉(zhuǎn)移。


它調(diào)材質(zhì),選鏡頭,Blender渲染房子。Agent用Flux模型生成多個(gè)視角和光照條件。


整個(gè)過(guò)程全部都由Agent自己完成。


這就是黃仁勛說(shuō)的“新的PC”。以前你用電腦是打開(kāi)軟件、點(diǎn)鼠標(biāo)、敲鍵盤(pán)?,F(xiàn)在你可以直接告訴Agent你要干什么,它自己去操作各種軟件完成任務(wù)。


RTX Spark不只是為Agent設(shè)計(jì)的,它也是一臺(tái)完整的創(chuàng)作和游戲電腦。


你可以在上面通過(guò)OptiX和DLSS渲染超大的90GB 3D場(chǎng)景,用Blackwell解碼器編輯12K 4:2:2視頻,跑1200億參數(shù)、100萬(wàn)token上下文的大語(yǔ)言模型,玩1440p分辨率、超過(guò)100幀的AAA游戲,支持光線(xiàn)追蹤、DLSS和Reflex。


RTX Spark還會(huì)支持新的RTX能力,包括DLSS 4.5光線(xiàn)重建,用第二代transformer模型,會(huì)出現(xiàn)在Blender 5.3和幾十款游戲里。還有RTX Video 4倍幀生成,會(huì)出現(xiàn)在ComfyUI里。


RTX Spark是筆記本。不過(guò)黃仁勛也宣布推出桌面和工作站版本DGX Spark。



768GB內(nèi)存,可以跑萬(wàn)億參數(shù)的大模型,20 petaflops算力,每秒8TB內(nèi)存帶寬,放在辦公桌上。如果你是大語(yǔ)言模型開(kāi)發(fā)者或Agent開(kāi)發(fā)者,可以在本地訓(xùn)練和測(cè)試模型,需要部署時(shí)再把模型放到云端。


黃仁勛說(shuō),想想15到20年前的電話(huà)。今天的手機(jī),打電話(huà)不是最常用的功能。手機(jī)的意義完全不同了。PC也會(huì)經(jīng)歷類(lèi)似變化。十年后的PC不會(huì)只是用來(lái)打開(kāi)軟件、點(diǎn)鼠標(biāo)的工具。


ASUS、Dell、HP、Lenovo、微軟Surface和MSI今年秋季會(huì)推出RTX Spark驅(qū)動(dòng)的超薄Windows筆記本和緊湊型臺(tái)式PC,全天候電池續(xù)航和優(yōu)質(zhì)顯示屏。Acer和GIGABYTE的型號(hào)隨后推出。黃仁勛沒(méi)說(shuō)具體價(jià)格。


Vera Rubin和AI工廠(chǎng)


隨后,黃仁勛宣布,Vera Rubin已經(jīng)全面投入生產(chǎn)。


Vera Rubin是一套五機(jī)架規(guī)模的AI超級(jí)計(jì)算機(jī)系統(tǒng),專(zhuān)門(mén)為跑Agent設(shè)計(jì)。



第一種是Vera Rubin NVL72,負(fù)責(zé)提示理解、上下文處理、推理和規(guī)劃,這是Agent的“大腦”。


第二種是Vera CPU機(jī)架,單個(gè)液冷機(jī)架里裝256顆Vera CPU,負(fù)責(zé)協(xié)調(diào)模型、管理內(nèi)存、調(diào)用工具。


第三種是Groq 3 LPX機(jī)架,256個(gè) Groq 3 LPU橫跨16個(gè)托架,每秒40PB的SRAM 帶寬,提供超低延遲的 Token 生成。NVL72負(fù)責(zé)高吞吐,Groq LPU負(fù)責(zé)低延遲。


第四種是Vera BlueField-4 STX 存儲(chǔ)機(jī)架,這是Agent保存記憶的地方,負(fù)責(zé)存儲(chǔ)處理、加速和片上安全。


第五種是 NVIDIA Spectrum-X Ethernet CPO 網(wǎng)絡(luò)機(jī)架,配備共封裝光學(xué)技術(shù)的以太網(wǎng)交換機(jī),200Gb/s SerDes,和臺(tái)積電合作做芯片級(jí)封裝和超高功率磷化銦激光模塊。


Vera Rubin由七顆新芯片組成。臺(tái)積電3nm制程,CoWoS-L封裝技術(shù),HBM內(nèi)存來(lái)自Micron、SK hynix和Samsung。一塊Vera Rubin計(jì)算板上有萬(wàn)億級(jí)晶體管和超過(guò)18000個(gè)元件。


整個(gè)機(jī)架包含18個(gè)計(jì)算托盤(pán)、9個(gè)熱插拔NVLink交換托盤(pán)、高效液冷歧管和匯流排。液冷匯流排可以承載超過(guò)5000安培電流,相當(dāng)于20臺(tái)電動(dòng)汽車(chē)全速加速時(shí)的電流。總共130萬(wàn)個(gè)元件構(gòu)成第三代MGX機(jī)架設(shè)計(jì)。


和上一代Grace Blackwell相比,Vera Rubin在處理Agent任務(wù)時(shí)的吞吐量提升了10倍。


黃仁勛說(shuō),他們?yōu)閂era Rubin創(chuàng)造的供應(yīng)鏈規(guī)模是Grace Blackwell的兩倍。


以前組裝一個(gè)Grace Blackwell機(jī)架需要兩小時(shí),現(xiàn)在Vera Rubin只需要五分鐘。原因是設(shè)計(jì)改了。過(guò)去機(jī)架里有很多線(xiàn)纜和軟管,現(xiàn)在用PCB中板直接連接兩側(cè),不再需要線(xiàn)纜、軟管和風(fēng)扇。全部液冷,模塊化設(shè)計(jì),熱插拔。


黃仁勛說(shuō),以前做Hopper時(shí),最重要的工作是預(yù)訓(xùn)練。到Grace Blackwell,重點(diǎn)是推理。


“很多人說(shuō)推理很簡(jiǎn)單,但推理就是錢(qián)。”


模型越來(lái)越復(fù)雜,要在高響應(yīng)速度、快速交互和高吞吐下同時(shí)完成推理很困難。這就是NVLink 72的意義。


黃仁勛說(shuō),今天英偉達(dá)的token成本比競(jìng)爭(zhēng)對(duì)手低一個(gè)數(shù)量級(jí),因?yàn)樗麄冏隽藚f(xié)同設(shè)計(jì),理解了推理的計(jì)算模式。


現(xiàn)在到了Agent時(shí)代,Agent不只是生成答案,它要觀(guān)察、推理、規(guī)劃、用工具,管理大量上下文,處理工作記憶和長(zhǎng)期記憶,衍生出專(zhuān)家子Agent。Vera Rubin就是為這種工作才誕生的。


Vera Rubin平臺(tái)引入了英偉達(dá) Spectrum-X以太網(wǎng)光子學(xué),這是世界上第一個(gè)基于共封裝光學(xué)技術(shù)的交換機(jī),有200Gb/s SerDes,如今已經(jīng)投產(chǎn)。


共封裝光學(xué)是什么?


傳統(tǒng)網(wǎng)絡(luò)交換機(jī)用可插拔收發(fā)器,收發(fā)器插在交換機(jī)外面,需要額外的功率、散熱和空間。共封裝光學(xué)把光學(xué)模塊直接封裝在交換機(jī)芯片上,和臺(tái)積電合作做芯片級(jí)封裝。


這帶來(lái)三個(gè)好處。第一是能效提升5倍,因?yàn)楣鈱W(xué)模塊和芯片之間的距離縮短了,信號(hào)損耗更小。第二是AI正常運(yùn)行時(shí)間延長(zhǎng)5倍,因?yàn)闇p少了可插拔部件的故障點(diǎn)。第三是部署時(shí)間縮短三分之一,因?yàn)楹?jiǎn)化了設(shè)計(jì),為計(jì)算釋放了更多功率。


CoreWeave、Lambda和Oracle Cloud Infrastructure是首批采用共封裝光學(xué)網(wǎng)絡(luò)的合作伙伴。Lambda在博客中展示了英偉達(dá)首批共封裝光學(xué)樣品的開(kāi)箱。黃仁勛說(shuō),通過(guò)簡(jiǎn)化設(shè)計(jì)為計(jì)算釋放更多功率,英偉達(dá)共封裝光學(xué)網(wǎng)絡(luò)為百萬(wàn)GPU AI工廠(chǎng)提供了基礎(chǔ)架構(gòu)。


Vera Rubin平臺(tái)還集成了英偉達(dá)BlueField-4 DPU。



BlueField-4有高達(dá)800Gb/s速度的軟件定義網(wǎng)絡(luò)和內(nèi)置多租戶(hù)隔離。借助英偉達(dá) BlueField-4 Advanced Secure Trusted Resource Architecture,客戶(hù)可以簡(jiǎn)化網(wǎng)絡(luò)操作,改善租戶(hù)隔離,在百萬(wàn)GPU AI集群中獲得更大控制。


AI工廠(chǎng)越來(lái)越多地在Agent工作流中處理專(zhuān)有數(shù)據(jù)、受監(jiān)管內(nèi)容和關(guān)鍵任務(wù)模型。這需要針對(duì)共享或云環(huán)境中自主Agent定制的基礎(chǔ)設(shè)施安全性,因?yàn)榛A(chǔ)設(shè)施不能被隱式信任。


Vera Rubin平臺(tái)設(shè)計(jì)了全棧英偉達(dá)機(jī)密計(jì)算,用于機(jī)架規(guī)模的可信執(zhí)行環(huán)境。Vera Rubin NVL72把Vera CPU、Rubin GPU、英偉達(dá) NVLink網(wǎng)絡(luò)和安全功能結(jié)合到統(tǒng)一平臺(tái)中,在高速互連之間加密數(shù)據(jù)。這提供硬件級(jí)認(rèn)證,確保系統(tǒng)防篡改。


在POD規(guī)模提供這種級(jí)別的保護(hù)還需要可編程軟件層,能在整個(gè)系統(tǒng)中執(zhí)行、編排和調(diào)整安全策略。英偉達(dá)DOCA軟件平臺(tái)在每個(gè)Vera Rubin平臺(tái)機(jī)架和AI工廠(chǎng)層提供安全性,通過(guò)直接在BlueField-4硅中執(zhí)行的能力保護(hù)數(shù)據(jù)、Agent、上下文內(nèi)存和AI推理。


DOCA能做什么。它實(shí)現(xiàn)多租戶(hù)網(wǎng)絡(luò)隔離、零信任策略執(zhí)行、運(yùn)行時(shí)威脅檢測(cè)和高達(dá)800Gb/s速度的端到端加密,這些都不占用主機(jī)CPU資源,所以企業(yè)可以放心擴(kuò)展AI工廠(chǎng)。


英偉達(dá)DSX平臺(tái)為Vera Rubin AI工廠(chǎng)提供完整的設(shè)計(jì)和運(yùn)營(yíng)基礎(chǔ)。DSX統(tǒng)一了參考設(shè)計(jì)、仿真、基礎(chǔ)設(shè)施軟件、設(shè)施和生態(tài)系統(tǒng)技術(shù),幫助構(gòu)建和運(yùn)營(yíng)針對(duì)最低token成本優(yōu)化的節(jié)能AI工廠(chǎng)。


DSX是什么。黃仁勛說(shuō),全球在建設(shè)AI工廠(chǎng),這是大規(guī)?;A(chǔ)設(shè)施建設(shè)。AI工廠(chǎng)復(fù)雜度高,芯片、機(jī)架、網(wǎng)絡(luò)、電力、冷卻、電網(wǎng),每一層都必須從端到端一起設(shè)計(jì),因?yàn)橛?jì)算就是收入。英偉達(dá) DSX就是藍(lán)圖,是建設(shè)和運(yùn)營(yíng)AI工廠(chǎng)的參考設(shè)計(jì),目標(biāo)是高效率和高盈利能力。


DSX為Vera Rubin POD架構(gòu)構(gòu)建,對(duì)齊堆棧的每一層,從硅和系統(tǒng)到生命周期管理和多租戶(hù)操作,加快部署,提高規(guī)模運(yùn)營(yíng)可靠性和彈性。


Dell Technologies、HPE、Lenovo和Supermicro以及ASUS、Foxconn、GIGABYTE、Pegatron、Quanta Cloud Technology、Wistron和Wiwynn在采用英偉達(dá) DSX來(lái)加速Vera Rubin的AI工廠(chǎng)建設(shè)。


DSX包含三個(gè)部分。第一是DSX Sim。Omniverse Blueprint合作伙伴可以在第一臺(tái)機(jī)架到場(chǎng)前就設(shè)計(jì)并驗(yàn)證一座英偉達(dá) Rubin AI工廠(chǎng)。他們可以規(guī)劃布局,模擬電力和冷卻,設(shè)計(jì)網(wǎng)絡(luò),在數(shù)字孿生中驗(yàn)證每次集成測(cè)試和每次變更。第二是DSX OS。工廠(chǎng)通電后,DSX OS接管運(yùn)營(yíng),提供監(jiān)控和修復(fù)基礎(chǔ)設(shè)施,把已安裝系統(tǒng)變成多租戶(hù)、彈性、AI就緒容量。第三是DSX Max-Q。


DSX Max-Q是什么。今天的AI工廠(chǎng)常常把電力過(guò)度配置40%,因?yàn)閾?dān)心峰值負(fù)載。DSX Max-Q可以讓運(yùn)營(yíng)商在相同電力預(yù)算下部署更多GPU。它有幾個(gè)技術(shù)。溫液冷卻可以在45攝氏度下運(yùn)行,用更少的水和能源,把更多能源留給計(jì)算。動(dòng)態(tài)電力分配可以把機(jī)架電力導(dǎo)向需要工作的地方,回收閑置瓦特。機(jī)架內(nèi)部的電力平滑機(jī)制可以削平峰值電流和電涌。


貫穿整座工廠(chǎng),AIAgent工作團(tuán)隊(duì)會(huì)通過(guò)DSX Max-Q持續(xù)協(xié)調(diào),平衡冷卻、電力和工作負(fù)載需求。DSX AI工廠(chǎng)還是彈性能量資產(chǎn),可以和電網(wǎng)協(xié)同工作。DSX Flex能讀實(shí)時(shí)電網(wǎng)信號(hào),在電網(wǎng)需要緩解壓力時(shí)動(dòng)態(tài)調(diào)整工廠(chǎng)電力。


黃仁勛說(shuō),到本十年結(jié)束前會(huì)有100GW的AI工廠(chǎng)上線(xiàn)。由英偉達(dá) DSX運(yùn)營(yíng)的AI工廠(chǎng)會(huì)以最高效率生產(chǎn)最低成本的token。


Vera Rubin什么時(shí)候可以買(mǎi)到。生產(chǎn)出貨從今年秋季開(kāi)始。


黃仁勛說(shuō),過(guò)去英偉達(dá)是一家GPU公司。這些年來(lái)他們演進(jìn)成系統(tǒng)公司?,F(xiàn)在看到的是英偉達(dá)最復(fù)雜的系統(tǒng)。


最終客戶(hù)和合作伙伴不是想買(mǎi)一臺(tái)計(jì)算機(jī),他們想建設(shè)AI工廠(chǎng)。


正因如此英偉達(dá)在再次轉(zhuǎn)型。技術(shù)現(xiàn)在延伸到基礎(chǔ)設(shè)施尺度。


合作伙伴包括發(fā)電、冷卻、電網(wǎng)供應(yīng)商和工業(yè)基礎(chǔ)設(shè)施公司。他們?cè)谂?gòu)建完整的堆棧,就像為GPU、Grace Blackwell、NVLink 72做的那樣。現(xiàn)在他們?cè)跇?gòu)建完整的基礎(chǔ)設(shè)施系統(tǒng),讓客戶(hù)可以建設(shè)AI基礎(chǔ)設(shè)施。


每個(gè)千兆瓦級(jí)AI工廠(chǎng)投入都從200億、300億美元開(kāi)始,很快會(huì)達(dá)到每千兆瓦800億到1000億美元。1000億美元投入AI工廠(chǎng),它必須第一次就能工作,而且必須立刻成功。


資本成本高,復(fù)雜度也高。就像設(shè)計(jì)芯片時(shí)會(huì)先在計(jì)算機(jī)里模擬芯片、再模擬整個(gè)系統(tǒng)一樣,現(xiàn)在也把AI工廠(chǎng)建在Omniverse里??梢栽跀?shù)字世界里建造這些系統(tǒng),在現(xiàn)實(shí)世界動(dòng)工前就完成驗(yàn)證。


RTX是GPU,DGX是系統(tǒng),現(xiàn)在DSX是基礎(chǔ)設(shè)施。


它包括系統(tǒng)和軟件,讓英偉達(dá)能和公司合作,把它們變成AI云。比如CoreWeave,最近它的價(jià)值已經(jīng)達(dá)到數(shù)百億美元,在增長(zhǎng)。


這些公司服務(wù)各自區(qū)域,也服務(wù)全球客戶(hù)。AI會(huì)無(wú)處不在,每家公司都會(huì)有AI驅(qū)動(dòng),每個(gè)地區(qū)都會(huì)建設(shè)自己的AI能力。它們需要完整的計(jì)算棧,硬件、軟件、庫(kù),還有和第三方生態(tài)、第三方開(kāi)發(fā)者連接的能力。


幫客戶(hù)建設(shè)和部署AI工廠(chǎng)很重要。原因是計(jì)算就是收入,現(xiàn)在計(jì)算就是利潤(rùn)。沒(méi)有收入、沒(méi)有利潤(rùn)就會(huì)變成虧損。黃仁勛說(shuō),這就是為什么英偉達(dá)是重要伙伴。他們創(chuàng)造完整基礎(chǔ)設(shè)施,把每件東西連接起來(lái),進(jìn)行了驗(yàn)證,確保正常運(yùn)轉(zhuǎn)。


time to first token更快,推理啟動(dòng)更快,從推理轉(zhuǎn)向訓(xùn)練也更快。每瓦產(chǎn)生的token比較多。因?yàn)榘岩磺卸颊掀饋?lái),從頭設(shè)計(jì)、模擬整個(gè)系統(tǒng),進(jìn)行協(xié)同設(shè)計(jì)??煽啃砸埠苤匾4笮蛿?shù)據(jù)中心有數(shù)百萬(wàn)條電纜和無(wú)數(shù)活動(dòng)部件,要讓這些計(jì)算機(jī)和諧工作很困難。英偉達(dá)長(zhǎng)期運(yùn)行超大規(guī)模系統(tǒng),這些經(jīng)驗(yàn)很重要。


最后是產(chǎn)品壽命。


幾年前Hopper時(shí)代的AI已經(jīng)和今天完全不同。六年前Ampere時(shí)代還在談CNN,后來(lái)談Transformer,再后來(lái)談專(zhuān)家混合,現(xiàn)在談Agent系統(tǒng)。每隔幾個(gè)月軟件行業(yè)就會(huì)出現(xiàn)新技術(shù)。


如果架構(gòu)不靈活,生態(tài)系統(tǒng)不豐富,資產(chǎn)壽命就不會(huì)長(zhǎng)。因?yàn)槿蜍浖_(kāi)發(fā)者都在用英偉達(dá) CUDA,所以英偉達(dá) CUDA生態(tài)的資產(chǎn)壽命會(huì)更長(zhǎng)。也可以從成本的另一面理解,如果資產(chǎn)壽命長(zhǎng),總擁有成本就低。這就是差異。


黃仁勛說(shuō),買(mǎi)得越多,賺得越多。


全球的工廠(chǎng)和員工都在拼命工作,因?yàn)槿澜缍枷胭嶅X(qián)。大家已經(jīng)意識(shí)到,有用的AI到來(lái)了,可盈利的AI到來(lái)了,計(jì)算需求高得驚人,需求本身就是限制。


各種大模型


黃仁勛今天還發(fā)布了開(kāi)源大模型Nemotron 3 Ultra。


Nemotron是英偉達(dá)為世界構(gòu)建的專(zhuān)用開(kāi)源模型,專(zhuān)門(mén)為Agent工作負(fù)載設(shè)計(jì)。


和其他開(kāi)源模型不同,Nemotron不只給你模型,還給你訓(xùn)練模型所用的數(shù)據(jù)。


Nemotron針對(duì)長(zhǎng)時(shí)間推理、長(zhǎng)時(shí)間運(yùn)行的工具任務(wù)、工具使用和任務(wù)解決進(jìn)行訓(xùn)練,是世界上最大的長(zhǎng)時(shí)程推理模型之一。模型、訓(xùn)練腳本和數(shù)據(jù)都對(duì)你開(kāi)源。黃仁勛說(shuō),這是開(kāi)源模型的最佳形態(tài),讓你可以拿走它,繼續(xù)添加數(shù)據(jù),讓它變得更好,并成為你自己的模型。


Nemotron 3 Ultra主要有三個(gè)優(yōu)勢(shì),第一是速度快近五倍。


它是世界上第一批基于混合架構(gòu)的模型之一,結(jié)合了狀態(tài)空間模型SSM與專(zhuān)家混合MoE。這種架構(gòu)速度極快。黃仁勛說(shuō),更快意味著你能用相同成本思考更久。


第二是降低約30%運(yùn)行成本。


第三是完全開(kāi)源,包括模型、訓(xùn)練腳本和數(shù)據(jù)。


那么Nemotron 3 Ultra到底是干嘛用的呢?黃仁勛說(shuō)了這么一個(gè)案例。


他說(shuō)英偉達(dá)現(xiàn)在做芯片太復(fù)雜了,要靠工程師一行行查、一輪輪跑驗(yàn)證,太慢也太貴。


因?yàn)槊款wAI芯片里有海量的晶體管,每條線(xiàn)路、每個(gè)邏輯門(mén)都必須嚴(yán)絲合縫,只要一個(gè)小錯(cuò)誤,就可能讓整顆芯片延期幾個(gè)月。


所以英偉達(dá)和Cadence做了一個(gè)“芯片設(shè)計(jì)AI助手團(tuán)隊(duì)”。


這個(gè)團(tuán)隊(duì)是一組會(huì)干活的Agent。


它能讀芯片設(shè)計(jì)規(guī)格,寫(xiě)或修改RTL代碼,自動(dòng)生成測(cè)試用例,調(diào)用Cadence的仿真工具Xcelium跑模擬,再用Jasper做形式化驗(yàn)證。發(fā)現(xiàn)Bug后,它還能定位問(wèn)題、改代碼、再跑一遍驗(yàn)證。


這里面大概是這樣分工:


Codex像項(xiàng)目經(jīng)理,負(fù)責(zé)調(diào)度整個(gè)流程。


Nemotron像技術(shù)大腦,負(fù)責(zé)推理、判斷、推進(jìn)驗(yàn)證循環(huán)。


Cadence工具棧像專(zhuān)業(yè)儀器,負(fù)責(zé)真正跑芯片仿真和驗(yàn)證。


Open Shell像安全沙箱,確保Agent在受控環(huán)境里工作,不亂改、不亂跑。


一堆專(zhuān)家子Agent則分別負(fù)責(zé)寫(xiě)RTL、建測(cè)試平臺(tái)、跑回歸測(cè)試、調(diào)試Bug。


以前芯片驗(yàn)證要工程師手動(dòng)反復(fù)做,周期可能是幾周;現(xiàn)在英偉達(dá)想讓AI Agent自動(dòng)接管一部分流程,把“寫(xiě)代碼、跑仿真、找Bug、修Bug、再驗(yàn)證”變成自動(dòng)循環(huán),把芯片設(shè)計(jì)驗(yàn)證從幾周壓到幾小時(shí)。


與此同時(shí),黃仁勛搬出了英偉達(dá)最前沿的物理AI Cosmos 3。



黃仁勛說(shuō),語(yǔ)言模型領(lǐng)域有很多人在做,而在物理AI方面,我們絕對(duì)是全球最強(qiáng)之一?!拔覟槲覀兊膱F(tuán)隊(duì)感到驕傲?!?/p>


黃仁勛說(shuō):“對(duì)于語(yǔ)言模型,我們可以使用互聯(lián)網(wǎng)上的英語(yǔ)和各種語(yǔ)言文本訓(xùn)練,因?yàn)檫@些內(nèi)容來(lái)自人類(lèi)寫(xiě)作和閱讀。但要為機(jī)器人構(gòu)建數(shù)據(jù),數(shù)據(jù)必須來(lái)自感知,來(lái)自機(jī)器人的視角。而世界上大多數(shù)視頻數(shù)據(jù)都是第三人稱(chēng)視角,不是第一人稱(chēng)視角。因此,對(duì)Agent系統(tǒng)、機(jī)器人系統(tǒng)、物理AI來(lái)說(shuō),數(shù)據(jù)是最難解決的問(wèn)題?!?/p>


英偉達(dá)想解決一個(gè)問(wèn)題:機(jī)器人太缺訓(xùn)練數(shù)據(jù)了。


訓(xùn)練語(yǔ)言模型,可以用互聯(lián)網(wǎng)上的文字;但訓(xùn)練機(jī)器人不一樣。機(jī)器人要學(xué)會(huì)走路、抓東西、開(kāi)車(chē)、避障、在工廠(chǎng)里干活,它需要理解真實(shí)世界里的空間、動(dòng)作、物體和物理規(guī)律。


可問(wèn)題是,真實(shí)世界的數(shù)據(jù)很難收集。你不可能讓機(jī)器人在現(xiàn)實(shí)里無(wú)限試錯(cuò),因?yàn)樘?、太貴,也可能有危險(xiǎn)。


所以黃仁勛的思路是,先讓人遠(yuǎn)程操控機(jī)器人,給它做示范。


再用Omniverse做仿真,在虛擬世界里生成更多訓(xùn)練場(chǎng)景。


再把普通視頻里的第三人稱(chēng)視角,轉(zhuǎn)換成機(jī)器人自己的第一人稱(chēng)視角。


最后,用Cosmos這種世界模型,讓AI自己理解和生成物理世界的數(shù)據(jù)。


Cosmos可以理解視頻里發(fā)生了什么,也可以根據(jù)文字、圖片、視頻生成符合物理規(guī)律的新視頻。比如你給它一個(gè)場(chǎng)景,它可以預(yù)測(cè)下一秒會(huì)發(fā)生什么;你讓它模擬機(jī)器人抓杯子,它可以生成這個(gè)動(dòng)作過(guò)程;你讓它訓(xùn)練自動(dòng)駕駛,它可以制造各種道路情況。


所以黃仁勛才說(shuō)“計(jì)算就是數(shù)據(jù)”,以前數(shù)據(jù)只能從現(xiàn)實(shí)世界采集,現(xiàn)在可以用計(jì)算生成。只要模型足夠強(qiáng),計(jì)算機(jī)就能模擬真實(shí)世界,給機(jī)器人制造大量訓(xùn)練材料。


這對(duì)物理AI很重要,因?yàn)闄C(jī)器人需要的不是會(huì)聊天的AI,而是懂現(xiàn)實(shí)世界怎么運(yùn)轉(zhuǎn)的AI。


基于此,英偉達(dá)做了一個(gè)“人形機(jī)器人標(biāo)準(zhǔn)套件”,叫Isaac GR00T。


為什么要做這個(gè)?因?yàn)樽鋈诵螜C(jī)器人太難了。一個(gè)機(jī)器人身上有很多電機(jī)、傳感器、控制系統(tǒng),還要有訓(xùn)練數(shù)據(jù)、仿真環(huán)境、操作系統(tǒng)、AI模型和部署工具。以前每個(gè)研究團(tuán)隊(duì)都要從零開(kāi)始拼這些東西,光搭環(huán)境就可能花幾個(gè)月,真正研究還沒(méi)開(kāi)始,人已經(jīng)累半死。


所以英偉達(dá)說(shuō):我們直接給大家做一個(gè)參考平臺(tái)。


這個(gè)平臺(tái)不只是一個(gè)機(jī)器人硬件,而是一整套東西:


有機(jī)器人本體;有運(yùn)行機(jī)器人的Jetson Thor計(jì)算平臺(tái);有AI模型;有仿真工具Isaac Lab;有遠(yuǎn)程操作工具Isaac Teleop;有Omniverse和Cosmos來(lái)生成合成數(shù)據(jù);有訓(xùn)練和評(píng)估環(huán)境;有Isaac ROS負(fù)責(zé)部署到真實(shí)機(jī)器人上。


你可以把它理解成機(jī)器人界的“開(kāi)發(fā)樣機(jī)+操作系統(tǒng)+訓(xùn)練工具包”。


研究者拿到GR00T之后,不用從零開(kāi)始造機(jī)器人、搭仿真、接傳感器、寫(xiě)底層系統(tǒng),而是可以直接開(kāi)始訓(xùn)練機(jī)器人做任務(wù)。比如讓機(jī)器人學(xué)會(huì)抓東西、搬運(yùn)、走路、在工廠(chǎng)里工作。你可以用英偉達(dá)的全套組件,也可以只用其中一部分,把自己的模型、傳感器或控制系統(tǒng)換進(jìn)去。


黃仁勛說(shuō)它有25個(gè)身體自由度,每只手31個(gè)自由度,身高大約6英尺,體重150磅,就是想說(shuō)明它是一個(gè)接近真人尺寸、能做復(fù)雜動(dòng)作的人形機(jī)器人參考設(shè)計(jì)。


本文來(lái)自微信公眾號(hào):字母AI,作者:苗正

AI原生產(chǎn)品日?qǐng)?bào)頻道: 前沿科技
本內(nèi)容由作者授權(quán)發(fā)布,觀(guān)點(diǎn)僅代表作者本人,不代表虎嗅立場(chǎng)。
如對(duì)本稿件有異議或投訴,請(qǐng)聯(lián)系 tougao@huxiu.com。
正在改變與想要改變世界的人,都在 虎嗅APP
宜兰市| 宜春市| 西华县| 株洲县| 富源县| 忻州市| 务川| 遂昌县| 永新县| 当阳市| 璧山县| 修武县| 成都市| 措勤县| 尼勒克县| 淮南市| 九龙城区| 蚌埠市| 伊金霍洛旗| 闽清县| 北川| 佛坪县| 镇坪县| 寻乌县| 饶河县| 桦甸市| 博白县| 临海市| 雷山县| 宝丰县| 林周县| 正阳县| 潼关县| 古蔺县| 兰州市| 藁城市| 乌拉特中旗| 专栏| 沂水县| 公安县| 习水县|