一区二区三区三上|欧美在线视频五区|国产午夜无码在线观看视频|亚洲国产裸体网站|无码成年人影视|亚洲AV亚洲AV|成人开心激情五月|欧美性爱内射视频|超碰人人干人人上|一区二区无码三区亚洲人区久久精品

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

學(xué)習(xí)資源 | NVIDIA TensorRT 全新教程上線

NVIDIA英偉達(dá) ? 來(lái)源:未知 ? 2023-08-04 17:45 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

NVIDIA TensorRT是一個(gè)用于高效實(shí)現(xiàn)已訓(xùn)練好的深度學(xué)習(xí)模型推理過(guò)程的軟件開(kāi)發(fā)工具包,內(nèi)含推理優(yōu)化器和運(yùn)行環(huán)境兩部分,其目的在于讓深度學(xué)習(xí)模型能夠在 GPU 上以更高吞吐量和更低的延遲運(yùn)行,目前已在業(yè)界得到廣泛應(yīng)用與部署。

為了幫助廣大開(kāi)發(fā)者更好地了解 TensorRT,NVIDIA GPU 計(jì)算專家團(tuán)隊(duì)(Devtech)工程師李瑋、王猛基于最新的 8.6.1 版本錄制了NVIDIA TensorRT 教程。本系列教程預(yù)計(jì) 4 小時(shí),包含五個(gè)章節(jié),旨在相對(duì)全面地介紹 TensorRT。該教程濃縮了 NVIDIA TensorRT 開(kāi)發(fā)團(tuán)隊(duì)的技術(shù)和經(jīng)驗(yàn),以及與客戶在合作過(guò)程中遇到的各種問(wèn)題和相應(yīng)的解決方法,期待開(kāi)發(fā)者們?cè)谟^看該教程及配套代碼庫(kù)后能有所收獲,為學(xué)習(xí)、科研和工作添磚加瓦。

需要注意的是,在未來(lái)版本的 TensorRT 中,部分 API 和用法可能發(fā)生變化,該教程內(nèi)容也會(huì)隨之進(jìn)行更新,請(qǐng)?jiān)谂浜洗a進(jìn)行學(xué)習(xí)的時(shí)候,注意開(kāi)發(fā)環(huán)境和軟件版本,避免兼容性方面的問(wèn)題。

立即掃碼充電!

TensorRT教程介紹

第一部分:TensorRT 簡(jiǎn)介(時(shí)長(zhǎng): 41 分鐘)

TensorRT 基本特性和用法Workflow:使用 TensorRT API 搭建Workflow:使用 ONNX-ParserWorkflow:使用框架內(nèi) TensorRT 接口 本章節(jié)將介紹 TensorRT 的基本特性和用法,并介紹使用 TensorRT 的三種常見(jiàn)工作流程。在該章節(jié)中,將從頭搭建一個(gè)可以在 TensorRT 中運(yùn)行推理計(jì)算的程序,方便了解一些基本 API 的用法,然后分別使用 TensorRT 的原生 API 搭建、使用 Parser 解析 ONNX 模型,以及使用 TensorFlow 和 Pytorch 等平臺(tái)自帶的 TensorRT 接口這三種方法將 TensorRT 用起來(lái)。

第二部分:開(kāi)發(fā)輔助工具(時(shí)長(zhǎng):24 分鐘)

trtexecNetronpolygraphyonnx-graphsurgeonNsightSystems

本章節(jié)介紹使用 TensorRT 過(guò)程中五個(gè)常用的開(kāi)發(fā)輔助工具,它們?cè)谛阅軠y(cè)試、網(wǎng)絡(luò)可視化、模型遷移、精度檢驗(yàn)、計(jì)算圖編輯、模型整體性能優(yōu)化等方面都起到了重要的作用。第二章節(jié)將逐一介紹這五個(gè)工具,并列舉在實(shí)際工作中使用這些工具的范例和經(jīng)驗(yàn)。

第三部分:插件書寫(時(shí)長(zhǎng):18 分鐘)

使用 Plugin 的簡(jiǎn)單例子關(guān)鍵 API結(jié)合使用 Parser 和 PluginPlugin 高級(jí)話題使用 Plugin 的例子

本章節(jié)將著重介紹 TensorRT Plugin 的相關(guān)技術(shù),將從一個(gè)最簡(jiǎn)單的標(biāo)量加法的 Plugin 例子開(kāi)始,講解 Plugin 的原理、特性、用法等,然后介紹一個(gè)把 Plugin 和 Parser 結(jié)合使用的例子,最后補(bǔ)充一些 Plugin 的高級(jí)用法,以及在工作中使用 Plugin 的一些案例。

第四部分:TensorRT高級(jí)用法(時(shí)長(zhǎng): 28 分鐘)

多 OptimizationProfile多 Stream多 ContextCUDAGraphTimingCacheRefitTacticSource硬件兼容+版本兼容更多工具

本章節(jié)將介紹 TensorRT 的一些高級(jí)話題。這些技術(shù)在 TensorRT 的使用過(guò)程中不是必須的,但在復(fù)雜的實(shí)際應(yīng)用場(chǎng)景中,這些技術(shù)對(duì)于改善模型性能和內(nèi)存占用、模型的調(diào)試分析、算法精確控制等方面有重要的作用。建議在完成前三個(gè)章節(jié)的學(xué)習(xí)后,瀏覽本章節(jié),將對(duì) TensorRT 的使用起到錦上添花的作用。

第五部分:常見(jiàn)優(yōu)化策略(時(shí)長(zhǎng):1 小時(shí) 42 分鐘)

概述性能分析工具性能優(yōu)化實(shí)例

本章節(jié)將介紹 TensorRT 工作流程中常見(jiàn)的模型優(yōu)化方法。該部分內(nèi)容將深入講解 TensorRT 相關(guān)性能分析工具,并以實(shí)例方式講述曾經(jīng)遇到過(guò)的一個(gè)模型在移植、優(yōu)化、部署的過(guò)程中使用的優(yōu)化策略。

wKgaomToPMCACEEQAABDYMZ-TIM441.gif

TensorRT Hackathon、

生成式 AI 模型優(yōu)化賽

報(bào)!wKgaomToPMCASfeVAAAKhK271LE512.gif

由阿里云、 NVIDIA 聯(lián)合舉辦,由阿里云天池平臺(tái)組織運(yùn)營(yíng)的“NVIDIA TensorRT Hackathon 2023 生成式 AI 模型優(yōu)化賽”正在火熱報(bào)名中,截止時(shí)間 8 月 14 日上午 10:00。該賽事面向全社會(huì)開(kāi)放,接受個(gè)人或不多于三人的組隊(duì)形式參賽。

掃碼報(bào)名參賽!

wKgaomToPMCAWwrxAAAcWoAng38399.png ? ? ? ? ? ? ? ? ? ?

相關(guān)資源鏈接:

?TensorRT 介紹https://developer.nvidia.com/tensorrt?TensorRT下載:https://developer.nvidia.com/nvidia-tensorrt-download

?TensorRT Cookbook(本教程配套代碼,包含視頻以外的更多范例代碼):https://github.com/NVIDIA/trt-samples-for-hackathon-cn/tree/master/cookbook

?TensorRT文檔:https://docs.nvidia.com/deeplearning/tensorrt/developer-guide/index.html

?C++ API文檔:https://docs.nvidia.com/deeplearning/tensorrt/api/c_api/

?Python API文檔:https://docs.nvidia.com/deeplearning/tensorrt/api/python_api/ 點(diǎn)擊“閱讀原文”,查看 TensorRT 全新教程! 掃描下方海報(bào)二維碼,在 8 月 8日聆聽(tīng)NVIDIA 創(chuàng)始人兼 CEO 黃仁勛在 SIGGRAPH 現(xiàn)場(chǎng)發(fā)表的 NVIDIA 主題演講,了解 NVIDIA 的新技術(shù),包括屢獲殊榮的研究,OpenUSD 開(kāi)發(fā),以及最新的 AI 內(nèi)容創(chuàng)作解決方案。


原文標(biāo)題:學(xué)習(xí)資源 | NVIDIA TensorRT 全新教程上線

文章出處:【微信公眾號(hào):NVIDIA英偉達(dá)】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。


聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 英偉達(dá)
    +關(guān)注

    關(guān)注

    22

    文章

    3953

    瀏覽量

    93775

原文標(biāo)題:學(xué)習(xí)資源 | NVIDIA TensorRT 全新教程上線

文章出處:【微信號(hào):NVIDIA_China,微信公眾號(hào):NVIDIA英偉達(dá)】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    NVIDIA RTX AI加速FLUX.1 Kontext現(xiàn)已開(kāi)放下載

    NVIDIA RTX 與 NVIDIA TensorRT 現(xiàn)已加速 Black Forest Labs 的最新圖像生成和編輯模型;此外,Gemma 3n 現(xiàn)可借助 RTX 和 NVIDIA
    的頭像 發(fā)表于 07-16 09:16 ?222次閱讀

    如何在魔搭社區(qū)使用TensorRT-LLM加速優(yōu)化Qwen3系列模型推理部署

    TensorRT-LLM 作為 NVIDIA 專為 LLM 推理部署加速優(yōu)化的開(kāi)源庫(kù),可幫助開(kāi)發(fā)者快速利用最新 LLM 完成應(yīng)用原型驗(yàn)證與產(chǎn)品部署。
    的頭像 發(fā)表于 07-04 14:38 ?657次閱讀

    使用NVIDIA Triton和TensorRT-LLM部署TTS應(yīng)用的最佳實(shí)踐

    針對(duì)基于 Diffusion 和 LLM 類別的 TTS 模型,NVIDIA Triton 和 TensorRT-LLM 方案能顯著提升推理速度。在單張 NVIDIA Ada Lovelace
    的頭像 發(fā)表于 06-12 15:37 ?600次閱讀
    使用<b class='flag-5'>NVIDIA</b> Triton和<b class='flag-5'>TensorRT</b>-LLM部署TTS應(yīng)用的最佳實(shí)踐

    NVIDIA攜手合作伙伴提升AI智能體的交互能力

    NVIDIA Enterprise AI Factory 的經(jīng)驗(yàn)證設(shè)計(jì)和全新NVIDIA AI Blueprint 可幫助企業(yè)部署具有溝通、研究和學(xué)習(xí)能力的智能 AI 成員至日常運(yùn)
    的頭像 發(fā)表于 05-22 09:52 ?365次閱讀

    NVIDIA TensorRT-LLM中啟用ReDrafter的一些變化

    Recurrent Drafting (簡(jiǎn)稱 ReDrafter) 是蘋果公司為大語(yǔ)言模型 (LLM) 推理開(kāi)發(fā)并開(kāi)源的一種新型推測(cè)解碼技術(shù),該技術(shù)現(xiàn)在可與 NVIDIA TensorRT-LLM 一起使用。
    的頭像 發(fā)表于 12-25 17:31 ?753次閱讀
    在<b class='flag-5'>NVIDIA</b> <b class='flag-5'>TensorRT</b>-LLM中啟用ReDrafter的一些變化

    【AIBOX應(yīng)用】通過(guò) NVIDIA TensorRT 實(shí)現(xiàn)實(shí)時(shí)快速的語(yǔ)義分割

    NVIDIA系列AIBOXAIBOX-OrinNano和AIBOX-OrinNX均搭載NVIDIA原裝JetsonOrin核心板模組,標(biāo)配工業(yè)級(jí)全金屬外殼,鋁合金結(jié)構(gòu)導(dǎo)熱,頂蓋外殼側(cè)面采用條幅格柵
    的頭像 發(fā)表于 12-18 16:33 ?844次閱讀
    【AIBOX應(yīng)用】通過(guò) <b class='flag-5'>NVIDIA</b> <b class='flag-5'>TensorRT</b> 實(shí)現(xiàn)實(shí)時(shí)快速的語(yǔ)義分割

    解鎖NVIDIA TensorRT-LLM的卓越性能

    NVIDIA TensorRT-LLM 是一個(gè)專為優(yōu)化大語(yǔ)言模型 (LLM) 推理而設(shè)計(jì)的庫(kù)。它提供了多種先進(jìn)的優(yōu)化技術(shù),包括自定義 Attention Kernel、Inflight
    的頭像 發(fā)表于 12-17 17:47 ?868次閱讀

    NVIDIA TensorRT-LLM Roadmap現(xiàn)已在GitHub上公開(kāi)發(fā)布

    感謝眾多用戶及合作伙伴一直以來(lái)對(duì)NVIDIA TensorRT-LLM的支持。TensorRT-LLM 的 Roadmap 現(xiàn)已在 GitHub 上公開(kāi)發(fā)布!
    的頭像 發(fā)表于 11-28 10:43 ?722次閱讀
    <b class='flag-5'>NVIDIA</b> <b class='flag-5'>TensorRT</b>-LLM Roadmap現(xiàn)已在GitHub上公開(kāi)發(fā)布

    使用NVIDIA TensorRT提升Llama 3.2性能

    Llama 3.2 模型集擴(kuò)展了 Meta Llama 開(kāi)源模型集的模型陣容,包含視覺(jué)語(yǔ)言模型(VLM)、小語(yǔ)言模型(SLM)和支持視覺(jué)的更新版 Llama Guard 模型。與 NVIDIA 加速
    的頭像 發(fā)表于 11-20 09:59 ?800次閱讀

    TensorRT-LLM低精度推理優(yōu)化

    本文將分享 TensorRT-LLM 中低精度量化內(nèi)容,并從精度和速度角度對(duì)比 FP8 與 INT8。首先介紹性能,包括速度和精度。其次,介紹量化工具 NVIDIA TensorRT Model
    的頭像 發(fā)表于 11-19 14:29 ?1272次閱讀
    <b class='flag-5'>TensorRT</b>-LLM低精度推理優(yōu)化

    NVIDIA發(fā)布全新AI和仿真工具以及工作流

    NVIDIA 在本周于德國(guó)慕尼黑舉行的機(jī)器人學(xué)習(xí)大會(huì)(CoRL)上發(fā)布了全新 AI 和仿真工具以及工作流。機(jī)器人開(kāi)發(fā)者可以使用這些工具和工作流,大大加快 AI 機(jī)器人(包括人形機(jī)器人)的開(kāi)發(fā)工作。
    的頭像 發(fā)表于 11-09 11:52 ?913次閱讀

    NVIDIA Nemotron-4 340B模型幫助開(kāi)發(fā)者生成合成訓(xùn)練數(shù)據(jù)

    Nemotron-4 340B 是針對(duì) NVIDIA NeMo 和 NVIDIA TensorRT-LLM 優(yōu)化的模型系列,該系列包含最先進(jìn)的指導(dǎo)和獎(jiǎng)勵(lì)模型,以及一個(gè)用于生成式 AI 訓(xùn)練的數(shù)據(jù)集。
    的頭像 發(fā)表于 09-06 14:59 ?736次閱讀
    <b class='flag-5'>NVIDIA</b> Nemotron-4 340B模型幫助開(kāi)發(fā)者生成合成訓(xùn)練數(shù)據(jù)

    魔搭社區(qū)借助NVIDIA TensorRT-LLM提升LLM推理效率

    “魔搭社區(qū)是中國(guó)最具影響力的模型開(kāi)源社區(qū),致力給開(kāi)發(fā)者提供模型即服務(wù)的體驗(yàn)。魔搭社區(qū)利用NVIDIA TensorRT-LLM,大大提高了大語(yǔ)言模型的推理性能,方便了模型應(yīng)用部署,提高了大模型產(chǎn)業(yè)應(yīng)用效率,更大規(guī)模地釋放大模型的應(yīng)用價(jià)值?!?/div>
    的頭像 發(fā)表于 08-23 15:48 ?1139次閱讀

    NVIDIA推出全新深度學(xué)習(xí)框架fVDB

    在 SIGGRAPH 上推出的全新深度學(xué)習(xí)框架可用于打造自動(dòng)駕駛汽車、氣候科學(xué)和智慧城市的 AI 就緒型虛擬表示。
    的頭像 發(fā)表于 08-01 14:31 ?1146次閱讀

    英偉達(dá)推出全新NVIDIA AI Foundry服務(wù)和NVIDIA NIM推理微服務(wù)

    NVIDIA 宣布推出全新 NVIDIA AI Foundry 服務(wù)和 NVIDIA NIM 推理微服務(wù),與同樣剛推出的 Llama 3.1 系列開(kāi)源模型一起,為全球企業(yè)的生成式 AI
    的頭像 發(fā)表于 07-25 09:48 ?1061次閱讀