亚洲AⅤ中文无码,精品一区二区三区在线播放

最新加速器和網(wǎng)絡(luò)平臺(tái)提升高級(jí)模擬、AI、量子計(jì)算、數(shù)據(jù)分析等方面的性能。

從量子計(jì)算到新藥研發(fā)和聚變能源領(lǐng)域，隨著加速計(jì)算和 AI 的進(jìn)步，全球涌現(xiàn)了一項(xiàng)又一項(xiàng)重大突破，基于物理模擬的科學(xué)計(jì)算有望推進(jìn)造福人類的各個(gè)領(lǐng)域大幅進(jìn)步。

NVIDIA 在今年 3 月的 GTC 上發(fā)布了 NVIDIA Blackwell 平臺(tái)，該平臺(tái)可在萬(wàn)億參數(shù)級(jí)大語(yǔ)言模型（LLM）上實(shí)現(xiàn)生成式 AI，而且其成本和能耗相較于 NVIDIA Hopper 架構(gòu)最低可降至 1/25。

Blackwell 對(duì) AI 工作負(fù)載具有重大的意義，其技術(shù)能力還將有助于推進(jìn)包括傳統(tǒng)的數(shù)值模擬在內(nèi)的各類科學(xué)計(jì)算應(yīng)用的探索工作。

加速計(jì)算和 AI 通過(guò)降低能源成本推動(dòng)可持續(xù)計(jì)算。許多科學(xué)計(jì)算應(yīng)用已從中受益。相較于基于傳統(tǒng) CPU 的系統(tǒng)和其他系統(tǒng)，天氣模擬的成本和能耗分別降至其 1/200 和 1/300，數(shù)字孿生模擬的成本和能耗則分別降至其 1/65 和 1/58。

利用 Blackwell 實(shí)現(xiàn)科學(xué)計(jì)算模擬性能倍增

科學(xué)計(jì)算和基于物理的模擬通常依賴于所謂的雙精度格式或 FP64（浮點(diǎn)）來(lái)解決問(wèn)題。Blackwell GPU 的 FP64 和 FP32 FMA（融合乘加）性能比 Hopper 高出 30% 。

基于物理的模擬對(duì)產(chǎn)品設(shè)計(jì)和開(kāi)發(fā)至關(guān)重要。無(wú)論是飛機(jī)、火車，還是橋梁、半導(dǎo)體芯片和藥品，在模擬中對(duì)產(chǎn)品進(jìn)行測(cè)試和改進(jìn)能夠?yàn)檠芯咳藛T和開(kāi)發(fā)人員節(jié)省數(shù)十億美元。

現(xiàn)今的專用集成電路（ASIC）幾乎完全是在 CPU 上設(shè)計(jì)的，整個(gè)流程漫長(zhǎng)且復(fù)雜，包括進(jìn)行模擬分析以確定電壓和電流。

但這種情況正在發(fā)生改變。比如，Cadence SpectreX 模擬器就是一個(gè)典型的模擬電路設(shè)計(jì)求解器。SpectreX 電路模擬在 Grace Blackwell 超級(jí)芯片（由 Blackwell GPU 和 Grace CPU 連接而成）上的運(yùn)行速度預(yù)計(jì)可達(dá)到傳統(tǒng) CPU 的 13 倍。

此外，GPU 加速的計(jì)算流體動(dòng)力學(xué)（CFD）已成為一種重要工具。工程師和設(shè)備設(shè)計(jì)師用它來(lái)預(yù)測(cè)各種設(shè)計(jì)的行為。Cadence Fidelity 在 NVIDIA 的 Grace Blackwell 系統(tǒng)上運(yùn)行 CFD 模擬的速度預(yù)計(jì)比傳統(tǒng)基于 CPU 系統(tǒng)快 22 倍，前所未有的流動(dòng)細(xì)節(jié)都可被捕捉到。

在另一項(xiàng)應(yīng)用中，Cadence Reality 的數(shù)字孿生軟件被用于創(chuàng)建物理數(shù)據(jù)中心的虛擬復(fù)制品，包括其服務(wù)器、冷卻系統(tǒng)、電源在內(nèi)的所有組件。這種虛擬模型可以讓工程師在現(xiàn)實(shí)世界中進(jìn)行應(yīng)用之前，就能夠提前對(duì)各種配置和方案進(jìn)行測(cè)試，從而節(jié)省時(shí)間和成本。

Cadence Reality 的優(yōu)異之處在于其基于物理的算法可以模擬熱量、氣流和用電量對(duì)數(shù)據(jù)中心的影響。這有助于工程師和數(shù)據(jù)中心運(yùn)營(yíng)人員更有效地管理容量，預(yù)測(cè)潛在的運(yùn)行問(wèn)題，并做出明智的決策，通過(guò)優(yōu)化數(shù)據(jù)中心的布局和運(yùn)行，從而提高效率和容量利用率。借助 Blackwell GPU，這些模擬的運(yùn)行速度預(yù)計(jì)比 CPU 快高達(dá) 30 倍，從而加快了完成時(shí)間并提高了能效。

AI 在科學(xué)計(jì)算中的應(yīng)用

全新 Blackwell 加速器和網(wǎng)絡(luò)平臺(tái)將大幅提升模擬性能。

NVIDIA Grace Blackwell 開(kāi)啟了高性能計(jì)算（HPC）的新時(shí)代。其架構(gòu)采用第二代 Transformer 引擎，經(jīng)過(guò)優(yōu)化，可加速 LLM 推理工作負(fù)載。

與上一代 Hopper 架構(gòu) GPU 相比，Blackwell 架構(gòu)使資源密集型應(yīng)用如 1.8 萬(wàn)億參數(shù)的 GPT-MoE（生成式預(yù)訓(xùn)練轉(zhuǎn)換器-專家混合）模型實(shí)現(xiàn)了 30 倍的提速，為 HPC 開(kāi)辟了新的可能性。通過(guò)讓 LLM 處理和解讀海量科學(xué)數(shù)據(jù)，高性能計(jì)算應(yīng)用可以更快獲得有價(jià)值洞察，從而加速科學(xué)探索。

桑迪亞國(guó)家實(shí)驗(yàn)室正在構(gòu)建一個(gè)適用于并行編程的 LLM 智能助手。傳統(tǒng)的 AI 可以高效生成基本的串行計(jì)算代碼，但當(dāng)涉及到 HPC 應(yīng)用的并行計(jì)算代碼時(shí)，LLM 就會(huì)顯得力不從心。桑迪亞的研究人員正在通過(guò)一個(gè)雄心勃勃的項(xiàng)目解決這個(gè)問(wèn)題，他們準(zhǔn)備用 Kokkos 自動(dòng)生成并行代碼。Kokkos 是一種由多國(guó)實(shí)驗(yàn)室設(shè)計(jì)的編程語(yǔ)言，專門用于在全球最強(qiáng)大超級(jí)計(jì)算機(jī)的數(shù)萬(wàn)個(gè)處理器上運(yùn)行任務(wù)。

桑迪亞國(guó)家實(shí)驗(yàn)室正在使用一種被稱為檢索增強(qiáng)生成（RAG）的 AI 技術(shù)將信息檢索能力與語(yǔ)言生成模型相結(jié)合。該項(xiàng)目團(tuán)隊(duì)正在創(chuàng)建一個(gè) Kokkos 數(shù)據(jù)庫(kù)，并利用 RAG 將其與 AI 模型集成。

初步結(jié)果十分喜人。桑迪亞國(guó)家實(shí)驗(yàn)室采用的不同 RAG 方法已經(jīng)自主生成了用于并行計(jì)算應(yīng)用的 Kokkos 代碼。他們希望通過(guò)克服 AI 并行代碼生成中的障礙，為全球領(lǐng)先的超級(jí)計(jì)算設(shè)施提供新的 HPC 可能性。

其他示例包括可再生能源研究、氣候科學(xué)和新藥研發(fā)。

推動(dòng)量子計(jì)算的進(jìn)步

量子計(jì)算為聚變能、氣候研究、新藥研發(fā)等領(lǐng)域帶來(lái)了大幅加速。因此，研究人員正努力在基于 NVIDIA GPU 的系統(tǒng)和軟件上模擬未來(lái)的量子計(jì)算機(jī)，以前所未有的速度開(kāi)發(fā)和測(cè)試量子算法。

NVIDIA CUDA-Q 平臺(tái)通過(guò)一個(gè)實(shí)現(xiàn) CPU、GPU 和 QPU（量子處理器）協(xié)同工作的統(tǒng)一編程模型，實(shí)現(xiàn)量子計(jì)算機(jī)模擬和混合應(yīng)用開(kāi)發(fā)。

CUDA-Q 正在加快巴斯夫化學(xué)工作流、石溪大學(xué)高能和核物理學(xué)研究以及 NERSC 量子化學(xué)的模擬速度。

NVIDIA Blackwell 架構(gòu)將助推量子模擬達(dá)到新高度。通過(guò)最新的 NVIDIA NVLink 多節(jié)點(diǎn)互連技術(shù)，可以更快地打通數(shù)據(jù)以提高量子模擬速度。

加快數(shù)據(jù)分析以推動(dòng)科學(xué)突破

使用 RAPIDS 處理數(shù)據(jù)的方式在科學(xué)計(jì)算領(lǐng)域非常常見(jiàn)。Blackwell 加入了一個(gè)硬件解壓縮引擎，能夠?qū)嚎s數(shù)據(jù)進(jìn)行解壓縮，并加快在 RAPIDS 中的分析速度。

該解壓縮引擎可將性能提升至 800GB/s，使 NVIDIA Grace Blackwell 在查詢基準(zhǔn)測(cè)試中的性能較 CPU（在 Sapphire Rapids 上）快 18 倍，較 NVIDIA Hopper Tensor Core GPU 快 6 倍。

憑借 8TB/s 的高內(nèi)存帶寬和 Grace CPU 高速 NVLink 片間（C2C）互連技術(shù)，該引擎可大幅提高數(shù)據(jù)傳輸速度，進(jìn)而加快整個(gè)數(shù)據(jù)庫(kù)查詢過(guò)程。Blackwell 能夠在數(shù)據(jù)分析和數(shù)據(jù)科學(xué)用例中發(fā)揮出卓越性能，從而加快數(shù)據(jù)洞察速度并降低成本。

NVIDIA 網(wǎng)絡(luò)平臺(tái)為科學(xué)計(jì)算提供極致性能

NVIDIA Quantum-X800 InfiniBand 網(wǎng)絡(luò)平臺(tái)可為科學(xué)計(jì)算基礎(chǔ)設(shè)施提供最高吞吐量。

該平臺(tái)包含 NVIDIA Quantum Q3400 和 Q3200 交換機(jī), 以及 NVIDIA ConnectX-8 SuperNIC，二者組合在帶寬上可達(dá)上一代產(chǎn)品的兩倍。Q3400 平臺(tái)的帶寬容量提高了 5 倍，并且借助 NVIDIA 的 SHARPv4（可擴(kuò)展分層聚合和歸約協(xié)議）技術(shù)實(shí)現(xiàn)了 14.4 Tflops 的網(wǎng)絡(luò)計(jì)算能力，較上一代產(chǎn)品提高了 9 倍。

性能的飛躍和能效的提高，使科學(xué)計(jì)算的工作負(fù)載完成時(shí)間與能耗顯著減少。

審核編輯：劉清

聲明：本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人，不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用，如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題，請(qǐng)聯(lián)系本站處理。舉報(bào)投訴

集成電路

集成電路

+關(guān)注

關(guān)注
5378

文章
11319

瀏覽量
360428
加速器

加速器

+關(guān)注

關(guān)注
2

文章
790

瀏覽量
37682
NVIDIA

NVIDIA

+關(guān)注

關(guān)注
14

文章
4856

瀏覽量
102713
量子計(jì)算

量子計(jì)算

+關(guān)注

關(guān)注
4

文章
1072

瀏覽量
34865

原文標(biāo)題：ISC24 | NVIDIA Blackwell 平臺(tái)推動(dòng)科學(xué)計(jì)算突破發(fā)展

文章出處：【微信號(hào)：NVIDIA-Enterprise，微信公眾號(hào)：NVIDIA英偉達(dá)企業(yè)解決方案】歡迎添加關(guān)注！文章轉(zhuǎn)載請(qǐng)注明出處。

評(píng)論

相關(guān)推薦

NVIDIA未來(lái)1年的Blackwell訂單已全部售罄

10月12日資訊顯示，Blackwell無(wú)疑已成為NVIDIA歷史上極為成功的產(chǎn)品典范，其市場(chǎng)需求量已攀升至前所未有的高峰。　　憑借在全球AI算力領(lǐng)域的領(lǐng)先地位，Blackwell吸引了微軟、Meta、Oracle、Op

發(fā)表于 10-12 16:20 ?587次閱讀

NVIDIA AI芯片Blackwell推遲發(fā)布引熱議,公司強(qiáng)調(diào)Hopper需求強(qiáng)勁

據(jù)8月5日最新消息，NVIDIA新款A(yù)I芯片Blackwell因被曝存在設(shè)計(jì)缺陷而推遲發(fā)布的消息，迅速在業(yè)界引發(fā)了廣泛討論與關(guān)注。面對(duì)這一市場(chǎng)傳聞，NVIDIA官方迅速作出回應(yīng)，強(qiáng)調(diào)其旗艦產(chǎn)品

發(fā)表于 08-05 15:05 ?511次閱讀

借助NVIDIA超級(jí)計(jì)算機(jī)加速量子計(jì)算發(fā)展

科學(xué)期刊《自然》（Nature）本月早些時(shí)候發(fā)表了一項(xiàng)研究，通過(guò)使用 NVIDIA 驅(qū)動(dòng)的超級(jí)計(jì)算機(jī)，驗(yàn)證了量子計(jì)算的商業(yè)化途徑。

發(fā)表于 07-25 09:55 ?475次閱讀

NVIDIA CEO黃仁勛在 SIGGRAPH 2024 主題演講中或?qū)⑹状瘟料嘞M(fèi)級(jí)GPU Blackwell

ABSTRACT摘要NVIDIA首席執(zhí)行官黃仁勛將在2024年Siggraph上發(fā)表主題演講，主題為“面向新計(jì)算革命的圖形”——消費(fèi)級(jí)Blackwell即將到來(lái)？JAEALOT2024年6月20日

發(fā)表于 06-21 08:26 ?394次閱讀

<b class='flag-5'>NVIDIA</b> CEO黃仁勛在 SIGGRAPH 2024 主題演講中或?qū)⑹状瘟料嘞M(fèi)級(jí)GPU <b class='flag-5'>Blackwell</b>

英偉達(dá)聯(lián)合計(jì)算機(jī)制造商發(fā)布Blackwell架構(gòu)系統(tǒng)

近日，NVIDIA與全球多家知名計(jì)算機(jī)制造商聯(lián)手，共同推出了一系列采用NVIDIA Blackwell架構(gòu)的新系統(tǒng)。這些系統(tǒng)不僅配備了NVIDIA

發(fā)表于 06-06 10:52 ?590次閱讀

英偉達(dá)Blackwell架構(gòu),行業(yè)首選

的半導(dǎo)體技術(shù)路徑圖，首度公開(kāi)了即將面世的下一代芯片——Rubin平臺(tái)，旨在接替現(xiàn)有的Blackwell。　　回顧過(guò)往，NVIDIA始終保持著每?jī)赡臧l(fā)布一次全新架構(gòu)的傳統(tǒng)，從2020年的Ampere

發(fā)表于 06-05 15:28 ?586次閱讀

計(jì)算機(jī)行業(yè)攜手 NVIDIA 為新工業(yè)革命打造 AI 工廠和數(shù)據(jù)中心

NVIDIA Blackwell 架構(gòu)的系統(tǒng)，這些系統(tǒng)搭載 Grace CPU 以及 NVIDIA 網(wǎng)絡(luò)和基礎(chǔ)設(shè)施，助力于企業(yè)建立 AI 工廠和數(shù)據(jù)中心，推動(dòng)新一輪生成式 AI

發(fā)表于 06-03 09:14 ?211次閱讀

進(jìn)一步解讀英偉達(dá) Blackwell 架構(gòu)、NVlink及GB200 超級(jí)芯片

和推理的速度。英偉達(dá) Blackwell 架構(gòu)在高性能計(jì)算方面的應(yīng)用為人工智能和其他計(jì)算密集型任務(wù)提供了更強(qiáng)大的處理能力和效率。這些應(yīng)用將有助于推動(dòng)

發(fā)表于 05-13 17:16

NVIDIA的專用AI平臺(tái)如何推動(dòng)下一代醫(yī)療健康行業(yè)的發(fā)展

醫(yī)療科技創(chuàng)新企業(yè)在 GTC 上介紹了 NVIDIA 的專用 AI 平臺(tái)如何推動(dòng)下一代醫(yī)療健康行業(yè)的發(fā)展。

發(fā)表于 04-09 10:10 ?1227次閱讀

基于NVIDIA開(kāi)源CUDA-Q量子計(jì)算平臺(tái)發(fā)布

NVIDIA 于太平洋時(shí)間 3 月 18 日推出一項(xiàng)云服務(wù)，旨在幫助研究人員和開(kāi)發(fā)人員在化學(xué)、生物學(xué)、材料科學(xué)等關(guān)鍵科學(xué)領(lǐng)域的量子計(jì)算研究中取得突破

發(fā)表于 03-21 09:54 ?390次閱讀

NVIDIA推出搭載GB200 Grace Blackwell超級(jí)芯片的NVIDIA DGX SuperPOD?

NVIDIA 于太平洋時(shí)間 3 月 18 日發(fā)布新一代 AI 超級(jí)計(jì)算機(jī) —— 搭載 NVIDIA GB200 Grace Blackwell 超級(jí)芯片的

發(fā)表于 03-21 09:49 ?642次閱讀

NVIDIA宣布推出NVIDIA Blackwell平臺(tái)以賦能計(jì)算新時(shí)代

全新 Blackwell GPU、NVLink 和可靠性技術(shù)賦能萬(wàn)億參數(shù)規(guī)模的 AI 模型

發(fā)表于 03-20 09:44 ?530次閱讀

NVIDIA 推出云量子計(jì)算機(jī)模擬微服務(wù)

NVIDIA 量子模擬平臺(tái)將通過(guò)各大云提供商提供，幫助科學(xué)家推進(jìn)量子計(jì)算和算法研究 NVIDIA 的量子仿真

發(fā)表于 03-19 11:27 ?390次閱讀

NVIDIA 推出 Blackwell 架構(gòu) DGX SuperPOD，適用于萬(wàn)億參數(shù)級(jí)的生成式 AI 超級(jí)計(jì)算

——? NVIDIA 于今日發(fā)布新一代 AI 超級(jí)計(jì)算機(jī) —— 搭載 NVIDIA GB200 Grace Blackwell 超級(jí)芯片的 NVI

發(fā)表于 03-19 10:56 ?358次閱讀

NVIDIA 人工智能開(kāi)講 | 什么是 AI For Science？詳解 AI 助力科學(xué)研究領(lǐng)域的新突破

”兩大音頻 APP上搜索“ NVIDIA 人工智能開(kāi)講 ”專輯，眾多技術(shù)大咖帶你深度剖析核心技術(shù)，把脈未來(lái)科技發(fā)展方向！ AI For Science （亦稱 “AI In Science” ），是人工智能領(lǐng)域的一大熱門話題，即如何用人工智能助力

發(fā)表于 12-25 18:30 ?921次閱讀