一区二区三区三上|欧美在线视频五区|国产午夜无码在线观看视频|亚洲国产裸体网站|无码成年人影视|亚洲AV亚洲AV|成人开心激情五月|欧美性爱内射视频|超碰人人干人人上|一区二区无码三区亚洲人区久久精品

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫(xiě)文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

NVIDIA Blackwell平臺(tái)推動(dòng)科學(xué)計(jì)算突破發(fā)展

NVIDIA英偉達(dá)企業(yè)解決方案 ? 來(lái)源:NVIDIA英偉達(dá)企業(yè)解決方案 ? 2024-05-15 09:45 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

最新加速器和網(wǎng)絡(luò)平臺(tái)提升高級(jí)模擬、AI、量子計(jì)算、數(shù)據(jù)分析等方面的性能。

從量子計(jì)算到新藥研發(fā)和聚變能源領(lǐng)域,隨著加速計(jì)算和 AI 的進(jìn)步,全球涌現(xiàn)了一項(xiàng)又一項(xiàng)重大突破,基于物理模擬的科學(xué)計(jì)算有望推進(jìn)造福人類的各個(gè)領(lǐng)域大幅進(jìn)步。

NVIDIA 在今年 3 月的 GTC 上發(fā)布了 NVIDIA Blackwell 平臺(tái),該平臺(tái)可在萬(wàn)億參數(shù)級(jí)大語(yǔ)言模型(LLM)上實(shí)現(xiàn)生成式 AI,而且其成本和能耗相較于 NVIDIA Hopper 架構(gòu)最低可降至 1/25。

Blackwell 對(duì) AI 工作負(fù)載具有重大的意義,其技術(shù)能力還將有助于推進(jìn)包括傳統(tǒng)的數(shù)值模擬在內(nèi)的各類科學(xué)計(jì)算應(yīng)用的探索工作。

加速計(jì)算和 AI 通過(guò)降低能源成本推動(dòng)可持續(xù)計(jì)算。許多科學(xué)計(jì)算應(yīng)用已從中受益。相較于基于傳統(tǒng) CPU 的系統(tǒng)和其他系統(tǒng),天氣模擬的成本和能耗分別降至其 1/200 和 1/300,數(shù)字孿生模擬的成本和能耗則分別降至其 1/65 和 1/58。

利用 Blackwell 實(shí)現(xiàn)科學(xué)計(jì)算模擬性能倍增

科學(xué)計(jì)算和基于物理的模擬通常依賴于所謂的雙精度格式或 FP64(浮點(diǎn))來(lái)解決問(wèn)題。Blackwell GPU 的 FP64 和 FP32 FMA(融合乘加)性能比 Hopper 高出 30% 。

基于物理的模擬對(duì)產(chǎn)品設(shè)計(jì)和開(kāi)發(fā)至關(guān)重要。無(wú)論是飛機(jī)、火車,還是橋梁、半導(dǎo)體芯片和藥品,在模擬中對(duì)產(chǎn)品進(jìn)行測(cè)試和改進(jìn)能夠?yàn)檠芯咳藛T和開(kāi)發(fā)人員節(jié)省數(shù)十億美元。

現(xiàn)今的專用集成電路ASIC)幾乎完全是在 CPU 上設(shè)計(jì)的,整個(gè)流程漫長(zhǎng)且復(fù)雜,包括進(jìn)行模擬分析以確定電壓和電流

但這種情況正在發(fā)生改變。比如,Cadence SpectreX 模擬器就是一個(gè)典型的模擬電路設(shè)計(jì)求解器。SpectreX 電路模擬在 Grace Blackwell 超級(jí)芯片(由 Blackwell GPU 和 Grace CPU 連接而成)上的運(yùn)行速度預(yù)計(jì)可達(dá)到傳統(tǒng) CPU 的 13 倍。

此外,GPU 加速的計(jì)算流體動(dòng)力學(xué)(CFD)已成為一種重要工具。工程師和設(shè)備設(shè)計(jì)師用它來(lái)預(yù)測(cè)各種設(shè)計(jì)的行為。Cadence Fidelity 在 NVIDIA 的 Grace Blackwell 系統(tǒng)上運(yùn)行 CFD 模擬的速度預(yù)計(jì)比傳統(tǒng)基于 CPU 系統(tǒng)快 22 倍,前所未有的流動(dòng)細(xì)節(jié)都可被捕捉到。

在另一項(xiàng)應(yīng)用中,Cadence Reality 的數(shù)字孿生軟件被用于創(chuàng)建物理數(shù)據(jù)中心的虛擬復(fù)制品,包括其服務(wù)器、冷卻系統(tǒng)、電源在內(nèi)的所有組件。這種虛擬模型可以讓工程師在現(xiàn)實(shí)世界中進(jìn)行應(yīng)用之前,就能夠提前對(duì)各種配置和方案進(jìn)行測(cè)試,從而節(jié)省時(shí)間和成本。

Cadence Reality 的優(yōu)異之處在于其基于物理的算法可以模擬熱量、氣流和用電量對(duì)數(shù)據(jù)中心的影響。這有助于工程師和數(shù)據(jù)中心運(yùn)營(yíng)人員更有效地管理容量,預(yù)測(cè)潛在的運(yùn)行問(wèn)題,并做出明智的決策,通過(guò)優(yōu)化數(shù)據(jù)中心的布局和運(yùn)行,從而提高效率和容量利用率。借助 Blackwell GPU,這些模擬的運(yùn)行速度預(yù)計(jì)比 CPU 快高達(dá) 30 倍,從而加快了完成時(shí)間并提高了能效。

AI 在科學(xué)計(jì)算中的應(yīng)用

全新 Blackwell 加速器和網(wǎng)絡(luò)平臺(tái)將大幅提升模擬性能。

NVIDIA Grace Blackwell 開(kāi)啟了高性能計(jì)算(HPC)的新時(shí)代。其架構(gòu)采用第二代 Transformer 引擎,經(jīng)過(guò)優(yōu)化,可加速 LLM 推理工作負(fù)載。

與上一代 Hopper 架構(gòu) GPU 相比,Blackwell 架構(gòu)使資源密集型應(yīng)用如 1.8 萬(wàn)億參數(shù)的 GPT-MoE(生成式預(yù)訓(xùn)練轉(zhuǎn)換器-專家混合)模型實(shí)現(xiàn)了 30 倍的提速,為 HPC 開(kāi)辟了新的可能性。通過(guò)讓 LLM 處理和解讀海量科學(xué)數(shù)據(jù),高性能計(jì)算應(yīng)用可以更快獲得有價(jià)值洞察,從而加速科學(xué)探索。

桑迪亞國(guó)家實(shí)驗(yàn)室正在構(gòu)建一個(gè)適用于并行編程的 LLM 智能助手。傳統(tǒng)的 AI 可以高效生成基本的串行計(jì)算代碼,但當(dāng)涉及到 HPC 應(yīng)用的并行計(jì)算代碼時(shí),LLM 就會(huì)顯得力不從心。桑迪亞的研究人員正在通過(guò)一個(gè)雄心勃勃的項(xiàng)目解決這個(gè)問(wèn)題,他們準(zhǔn)備用 Kokkos 自動(dòng)生成并行代碼。Kokkos 是一種由多國(guó)實(shí)驗(yàn)室設(shè)計(jì)的編程語(yǔ)言,專門(mén)用于在全球最強(qiáng)大超級(jí)計(jì)算機(jī)的數(shù)萬(wàn)個(gè)處理器上運(yùn)行任務(wù)。

桑迪亞國(guó)家實(shí)驗(yàn)室正在使用一種被稱為檢索增強(qiáng)生成(RAG)的 AI 技術(shù)將信息檢索能力與語(yǔ)言生成模型相結(jié)合。該項(xiàng)目團(tuán)隊(duì)正在創(chuàng)建一個(gè) Kokkos 數(shù)據(jù)庫(kù),并利用 RAG 將其與 AI 模型集成。

初步結(jié)果十分喜人。桑迪亞國(guó)家實(shí)驗(yàn)室采用的不同 RAG 方法已經(jīng)自主生成了用于并行計(jì)算應(yīng)用的 Kokkos 代碼。他們希望通過(guò)克服 AI 并行代碼生成中的障礙,為全球領(lǐng)先的超級(jí)計(jì)算設(shè)施提供新的 HPC 可能性。

其他示例包括可再生能源研究、氣候科學(xué)和新藥研發(fā)。

推動(dòng)量子計(jì)算的進(jìn)步

量子計(jì)算為聚變能、氣候研究、新藥研發(fā)等領(lǐng)域帶來(lái)了大幅加速。因此,研究人員正努力在基于 NVIDIA GPU 的系統(tǒng)和軟件上模擬未來(lái)的量子計(jì)算機(jī),以前所未有的速度開(kāi)發(fā)和測(cè)試量子算法。

NVIDIA CUDA-Q 平臺(tái)通過(guò)一個(gè)實(shí)現(xiàn) CPU、GPU 和 QPU(量子處理器)協(xié)同工作的統(tǒng)一編程模型,實(shí)現(xiàn)量子計(jì)算機(jī)模擬和混合應(yīng)用開(kāi)發(fā)。

CUDA-Q 正在加快巴斯夫化學(xué)工作流、石溪大學(xué)高能和核物理學(xué)研究以及 NERSC 量子化學(xué)的模擬速度。

NVIDIA Blackwell 架構(gòu)將助推量子模擬達(dá)到新高度。通過(guò)最新的 NVIDIA NVLink 多節(jié)點(diǎn)互連技術(shù),可以更快地打通數(shù)據(jù)以提高量子模擬速度。

加快數(shù)據(jù)分析以推動(dòng)科學(xué)突破

使用 RAPIDS 處理數(shù)據(jù)的方式在科學(xué)計(jì)算領(lǐng)域非常常見(jiàn)。Blackwell 加入了一個(gè)硬件解壓縮引擎,能夠?qū)嚎s數(shù)據(jù)進(jìn)行解壓縮,并加快在 RAPIDS 中的分析速度。

該解壓縮引擎可將性能提升至 800GB/s,使 NVIDIA Grace Blackwell 在查詢基準(zhǔn)測(cè)試中的性能較 CPU(在 Sapphire Rapids 上)快 18 倍,較 NVIDIA Hopper Tensor Core GPU 快 6 倍。

憑借 8TB/s 的高內(nèi)存帶寬和 Grace CPU 高速 NVLink 片間(C2C)互連技術(shù),該引擎可大幅提高數(shù)據(jù)傳輸速度,進(jìn)而加快整個(gè)數(shù)據(jù)庫(kù)查詢過(guò)程。Blackwell 能夠在數(shù)據(jù)分析和數(shù)據(jù)科學(xué)用例中發(fā)揮出卓越性能,從而加快數(shù)據(jù)洞察速度并降低成本。

NVIDIA 網(wǎng)絡(luò)平臺(tái)為科學(xué)計(jì)算提供極致性能

NVIDIA Quantum-X800 InfiniBand 網(wǎng)絡(luò)平臺(tái)可為科學(xué)計(jì)算基礎(chǔ)設(shè)施提供最高吞吐量。

該平臺(tái)包含 NVIDIA Quantum Q3400 和 Q3200 交換機(jī), 以及 NVIDIA ConnectX-8 SuperNIC,二者組合在帶寬上可達(dá)上一代產(chǎn)品的兩倍。Q3400 平臺(tái)的帶寬容量提高了 5 倍,并且借助 NVIDIA 的 SHARPv4(可擴(kuò)展分層聚合和歸約協(xié)議)技術(shù)實(shí)現(xiàn)了 14.4 Tflops 的網(wǎng)絡(luò)計(jì)算能力,較上一代產(chǎn)品提高了 9 倍。

性能的飛躍和能效的提高,使科學(xué)計(jì)算的工作負(fù)載完成時(shí)間與能耗顯著減少。

審核編輯:劉清
聲明:本文內(nèi)容及配圖由入駐作者撰寫(xiě)或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 集成電路
    +關(guān)注

    關(guān)注

    5425

    文章

    12070

    瀏覽量

    368512
  • 加速器
    +關(guān)注

    關(guān)注

    2

    文章

    827

    瀏覽量

    39127
  • NVIDIA
    +關(guān)注

    關(guān)注

    14

    文章

    5309

    瀏覽量

    106428
  • 量子計(jì)算
    +關(guān)注

    關(guān)注

    4

    文章

    1147

    瀏覽量

    35733

原文標(biāo)題:ISC24 | NVIDIA Blackwell 平臺(tái)推動(dòng)科學(xué)計(jì)算突破發(fā)展

文章出處:【微信號(hào):NVIDIA-Enterprise,微信公眾號(hào):NVIDIA英偉達(dá)企業(yè)解決方案】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    NVIDIA驅(qū)動(dòng)的現(xiàn)代超級(jí)計(jì)算機(jī)如何突破速度極限并推動(dòng)科學(xué)發(fā)展

    現(xiàn)代高性能計(jì)算不僅使得更快的計(jì)算成為可能,它正驅(qū)動(dòng)著 AI 系統(tǒng)解鎖更多領(lǐng)域的科學(xué)突破。 高性能計(jì)算經(jīng)歷了多次迭代,每一次都源于對(duì)技術(shù)的創(chuàng)造
    的頭像 發(fā)表于 06-26 19:39 ?506次閱讀
    <b class='flag-5'>NVIDIA</b>驅(qū)動(dòng)的現(xiàn)代超級(jí)<b class='flag-5'>計(jì)算</b>機(jī)如何<b class='flag-5'>突破</b>速度極限并<b class='flag-5'>推動(dòng)</b><b class='flag-5'>科學(xué)發(fā)展</b>

    NVIDIA Blackwell推動(dòng)流式傳輸和數(shù)據(jù)分析的未來(lái)發(fā)展

    RTX PRO Blackwell GPU 系列推動(dòng)智能內(nèi)容創(chuàng)建、超個(gè)性化媒體和實(shí)時(shí)視頻管線的發(fā)展。
    的頭像 發(fā)表于 03-28 10:02 ?504次閱讀

    Cadence 利用 NVIDIA Grace Blackwell 加速AI驅(qū)動(dòng)的工程設(shè)計(jì)和科學(xué)應(yīng)用

    融合設(shè)計(jì)專業(yè)知識(shí)與加速計(jì)算,推動(dòng)科技創(chuàng)新、實(shí)現(xiàn)能效和工程生產(chǎn)力方面的突破性進(jìn)展,引領(lǐng)全球生活新范式 內(nèi)容提要 ●?Cadence 借助 NVIDIA 最新
    的頭像 發(fā)表于 03-24 10:14 ?776次閱讀

    英偉達(dá)GTC2025亮點(diǎn):NVIDIA Blackwell加速計(jì)算機(jī)輔助工程軟件,實(shí)現(xiàn)實(shí)時(shí)數(shù)字孿生性能數(shù)量級(jí)提升

    、Altair、Cadence、Siemens 和 Synopsys 等在內(nèi)的領(lǐng)先計(jì)算機(jī)輔助工程(CAE)軟件供應(yīng)商正在使用 NVIDIA Blackwell 平臺(tái)加速其仿真工具,速度
    的頭像 發(fā)表于 03-21 15:12 ?681次閱讀

    NVIDIA GTC2025 亮點(diǎn) NVIDIA推出 DGX Spark個(gè)人AI計(jì)算機(jī)

    臺(tái)式超級(jí)計(jì)算機(jī)由 NVIDIA Grace Blackwell 驅(qū)動(dòng),為開(kāi)發(fā)者、研究人員和數(shù)據(jù)科學(xué)家提供加速 AI 功能;系統(tǒng)由頭部計(jì)算機(jī)制
    的頭像 發(fā)表于 03-20 18:59 ?886次閱讀
    <b class='flag-5'>NVIDIA</b> GTC2025 亮點(diǎn)  <b class='flag-5'>NVIDIA</b>推出 DGX Spark個(gè)人AI<b class='flag-5'>計(jì)算</b>機(jī)

    NVIDIA Blackwell白皮書(shū):NVIDIA Blackwell Architecture Technical Brief

    NVIDIA Blackwell白皮書(shū):NVIDIA Blackwell Architecture Technical Brief
    的頭像 發(fā)表于 03-20 18:35 ?740次閱讀

    NVIDIA Blackwell數(shù)據(jù)手冊(cè)與NVIDIA Blackwell架構(gòu)技術(shù)解析

    NVIDIA Blackwell數(shù)據(jù)手冊(cè)與NVIDIA Blackwell 架構(gòu)技術(shù)解析
    的頭像 發(fā)表于 03-20 17:19 ?740次閱讀

    NVIDIA 宣布推出 DGX Spark 個(gè)人 AI 計(jì)算機(jī)

    臺(tái)式超級(jí)計(jì)算機(jī)由 NVIDIA Grace Blackwell 驅(qū)動(dòng),為開(kāi)發(fā)者、研究人員和數(shù)據(jù)科學(xué)家提供加速 AI 功能;系統(tǒng)由頭部計(jì)算機(jī)制
    發(fā)表于 03-19 09:59 ?317次閱讀
       <b class='flag-5'>NVIDIA</b> 宣布推出 DGX Spark 個(gè)人 AI <b class='flag-5'>計(jì)算</b>機(jī)

    NVIDIA Blackwell RTX PRO 提供工作站和服務(wù)器兩種規(guī)格,助力設(shè)計(jì)師、開(kāi)發(fā)者、數(shù)據(jù)科學(xué)家和創(chuàng)作人員構(gòu)建代理式

    月 18 日 —— NVIDIA 今日發(fā)布了 NVIDIA RTX PRO? Blackwell 系列工作站和服務(wù)器 GPU,通過(guò)突破性的加速計(jì)算
    發(fā)表于 03-19 09:50 ?330次閱讀
    <b class='flag-5'>NVIDIA</b> <b class='flag-5'>Blackwell</b> RTX PRO 提供工作站和服務(wù)器兩種規(guī)格,助力設(shè)計(jì)師、開(kāi)發(fā)者、數(shù)據(jù)<b class='flag-5'>科學(xué)</b>家和創(chuàng)作人員構(gòu)建代理式

    NVIDIA使用加速計(jì)算與AI推動(dòng)精準(zhǔn)醫(yī)學(xué)發(fā)展

    在加利福尼亞州圣克拉拉舉行的精準(zhǔn)醫(yī)學(xué)世界大會(huì)上,NVIDIA推動(dòng)了醫(yī)學(xué)成像、基因組學(xué)、計(jì)算化學(xué)和 AI 驅(qū)動(dòng)機(jī)器人技術(shù)的發(fā)展而受到表彰。NVID
    的頭像 發(fā)表于 02-17 17:14 ?536次閱讀

    NVIDIA推出個(gè)人AI超級(jí)計(jì)算機(jī)Project DIGITS

    NVIDIA 推出個(gè)人 AI 超級(jí)計(jì)算機(jī) NVIDIA Project DIGITS,全球的 AI 研究員、數(shù)據(jù)科學(xué)家和學(xué)生都可獲取 NVIDIA
    的頭像 發(fā)表于 01-08 11:03 ?830次閱讀

    Supermicro推出直接液冷優(yōu)化的NVIDIA Blackwell解決方案

    ,宣布推出高性能的SuperCluster。這一端對(duì)端AI數(shù)據(jù)中心解決方案采用NVIDIA Blackwell平臺(tái),專為兆級(jí)參數(shù)規(guī)模的生成式AI時(shí)代所設(shè)計(jì)。全新SuperCluster將可大幅增加液冷
    發(fā)表于 11-25 10:39 ?784次閱讀
    Supermicro推出直接液冷優(yōu)化的<b class='flag-5'>NVIDIA</b> <b class='flag-5'>Blackwell</b>解決方案

    NVIDIA加速計(jì)算如何推動(dòng)醫(yī)療健康

    近日,NVIDIA 企業(yè)平臺(tái)副總裁 Bob Pette 在 AI Summit 一場(chǎng)演講中重點(diǎn)談?wù)摿?NVIDIA 加速計(jì)算如何推動(dòng)醫(yī)療健康
    的頭像 發(fā)表于 11-20 09:10 ?680次閱讀

    NVIDIA向開(kāi)放計(jì)算項(xiàng)目捐贈(zèng)Blackwell平臺(tái)設(shè)計(jì)

    近日,在美國(guó)加利福尼亞州舉行的 OCP 全球峰會(huì)上,NVIDIA 宣布已把 NVIDIA Blackwell 加速計(jì)算平臺(tái)的一些基礎(chǔ)元素捐贈(zèng)
    的頭像 發(fā)表于 11-19 15:30 ?665次閱讀

    NVIDIA Blackwell平臺(tái)帶來(lái)性能躍升

    Blackwell 完成的每一項(xiàng)測(cè)試,都為各項(xiàng) AI 應(yīng)用樹(shù)立了訓(xùn)練性能新標(biāo)桿。
    的頭像 發(fā)表于 11-19 14:24 ?661次閱讀