一区二区三区三上|欧美在线视频五区|国产午夜无码在线观看视频|亚洲国产裸体网站|无码成年人影视|亚洲AV亚洲AV|成人开心激情五月|欧美性爱内射视频|超碰人人干人人上|一区二区无码三区亚洲人区久久精品

0
  • 聊天消息
  • 系統(tǒng)消息
  • 評(píng)論與回復(fù)
登錄后你可以
  • 下載海量資料
  • 學(xué)習(xí)在線課程
  • 觀看技術(shù)視頻
  • 寫文章/發(fā)帖/加入社區(qū)
會(huì)員中心
創(chuàng)作中心

完善資料讓更多小伙伴認(rèn)識(shí)你,還能領(lǐng)取20積分哦,立即完善>

3天內(nèi)不再提示

英特爾研究院發(fā)布全新AI擴(kuò)散模型,可根據(jù)文本提示生成360度全景圖

英特爾中國(guó) ? 來(lái)源:未知 ? 2023-06-30 19:50 ? 次閱讀
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

英特爾研究院宣布與Blockade Labs合作發(fā)布LDM3D(Latent Diffusion Model for 3D)模型,這一全新的擴(kuò)散模型使用生成式AI創(chuàng)建3D視覺(jué)內(nèi)容。LDM3D是業(yè)界領(lǐng)先的利用擴(kuò)散過(guò)程(diffusion process)生成深度圖(depth map)的模型,進(jìn)而生成逼真的、沉浸式的360度全景圖。LDM3D有望革新內(nèi)容創(chuàng)作、元宇宙應(yīng)用和數(shù)字體驗(yàn),改變包括娛樂(lè)、游戲、建筑和設(shè)計(jì)在內(nèi)的許多行業(yè)。

生成式AI技術(shù)旨在提高和增強(qiáng)人類創(chuàng)造力,并節(jié)省時(shí)間。然而,目前的大部分生成式AI模型僅限于生成2D圖像,僅有少數(shù)幾種可根據(jù)文本提示生成3D圖像。在使用幾乎相同數(shù)量參數(shù)的情況下,不同于現(xiàn)存的潛在擴(kuò)散模型,LDM3D可以根據(jù)用戶給定的文本提示同時(shí)生成圖像和深度圖。與深度估計(jì)中的標(biāo)準(zhǔn)后處理方法相比,LDM3D能夠?yàn)閳D像中的每個(gè)像素提供更精準(zhǔn)的相對(duì)深度,并為開(kāi)發(fā)者省去了大量用于場(chǎng)景開(kāi)發(fā)的時(shí)間。

--Vasudev Lal

英特爾研究院人工智能機(jī)器學(xué)習(xí)研究專家

封閉的生態(tài)系統(tǒng)限制了規(guī)模。英特爾致力于推動(dòng)AI的真正普及,通過(guò)開(kāi)放的生態(tài)系統(tǒng)讓更多人從這項(xiàng)技術(shù)中受益。計(jì)算機(jī)視覺(jué)領(lǐng)域近年來(lái)取得了重大進(jìn)展,特別是在生成式AI方面。然而,當(dāng)今許多先進(jìn)的生成式AI模型只能生成2D圖像。與通常只能根據(jù)文本提示生成2D RGB圖像的現(xiàn)有擴(kuò)散模型不同,LDM3D可以根據(jù)用戶給定的文本提示同時(shí)生成圖像和深度圖。與深度估計(jì)(depth estimation)中的標(biāo)準(zhǔn)后處理(post-processing)方法相比,LDM3D在使用與潛在擴(kuò)散模型Stable Diffusion幾乎相同數(shù)量參數(shù)的情況下,能夠?yàn)閳D像中的每個(gè)像素提供更精準(zhǔn)的相對(duì)深度(relative depth)。

這項(xiàng)研究有望改變我們與數(shù)字內(nèi)容的互動(dòng)方式,基于文本提示為用戶提供全新的體驗(yàn)。LDM3D生成的圖像和深度圖能夠?qū)⒅T如寧?kù)o的熱帶海灘、摩天大樓、科幻宇宙等文本描述轉(zhuǎn)化為細(xì)致的360度全景圖。LDM3D捕捉深度信息的能力,可以即時(shí)增強(qiáng)整體真實(shí)感和沉浸感,使各行各業(yè)的創(chuàng)新應(yīng)用成為可能,包括娛樂(lè)、游戲、室內(nèi)設(shè)計(jì)、房產(chǎn)銷售,以及虛擬博物館與沉浸式VR體驗(yàn)等。

6月20日,在IEEE/CVF計(jì)算機(jī)視覺(jué)和模式識(shí)別會(huì)議(CVPR)的3DMV工作坊上,LDM3D模型獲得了“Best Poster Award”。

LDM3D是在LAION-400M數(shù)據(jù)集包含一萬(wàn)個(gè)樣本的子集上訓(xùn)練而成的。LAION-400M是一個(gè)大型圖文數(shù)據(jù)集,包含超過(guò)4億個(gè)圖文對(duì)。對(duì)訓(xùn)練語(yǔ)料庫(kù)進(jìn)行標(biāo)注時(shí),研究團(tuán)隊(duì)使用了之前由英特爾研究院開(kāi)發(fā)的稠密深度估計(jì)模型DPT-Large,為圖像中的每個(gè)像素提供了高度準(zhǔn)確的相對(duì)深度。LAION-400M數(shù)據(jù)集是基于研究用途創(chuàng)建而成的,以便廣大研究人員和其它興趣社群能在更大規(guī)模上測(cè)試模型訓(xùn)練。

為了展示LDM3D的潛力,英特爾和Blockade的研究人員開(kāi)發(fā)了應(yīng)用程序DepthFusion,通過(guò)標(biāo)準(zhǔn)的2D RGB圖像和深度圖創(chuàng)建沉浸式、交互式的360度全景體驗(yàn)。DepthFusion利用了TouchDesigner,一種基于節(jié)點(diǎn)的可視化編程語(yǔ)言,用于實(shí)時(shí)互動(dòng)多媒體內(nèi)容,可將文本提示轉(zhuǎn)化為交互式和沉浸式數(shù)字體驗(yàn)。LDM3D是能生成RGB圖像及其深度圖的單一模型,因此能夠節(jié)省內(nèi)存占用和降低延遲。

備注:

1 地址:https://huggingface.co/docs/diffusers/main/en/api/pipelines/stable_diffusion/ldm3d_diffusion

2 地址:

https://arxiv.org/abs/2305.10853


聲明:本文內(nèi)容及配圖由入駐作者撰寫或者入駐合作網(wǎng)站授權(quán)轉(zhuǎn)載。文章觀點(diǎn)僅代表作者本人,不代表電子發(fā)燒友網(wǎng)立場(chǎng)。文章及其配圖僅供工程師學(xué)習(xí)之用,如有內(nèi)容侵權(quán)或者其他違規(guī)問(wèn)題,請(qǐng)聯(lián)系本站處理。 舉報(bào)投訴
  • 英特爾
    +關(guān)注

    關(guān)注

    61

    文章

    10197

    瀏覽量

    174760
  • cpu
    cpu
    +關(guān)注

    關(guān)注

    68

    文章

    11083

    瀏覽量

    217186

原文標(biāo)題:英特爾研究院發(fā)布全新AI擴(kuò)散模型,可根據(jù)文本提示生成360度全景圖

文章出處:【微信號(hào):英特爾中國(guó),微信公眾號(hào):英特爾中國(guó)】歡迎添加關(guān)注!文章轉(zhuǎn)載請(qǐng)注明出處。

收藏 人收藏
加入交流群
微信小助手二維碼

掃碼添加小助手

加入工程師交流群

    評(píng)論

    相關(guān)推薦
    熱點(diǎn)推薦

    直擊Computex 2025:英特爾重磅發(fā)布新一代GPU,圖形和AI性能躍升3.4倍

    電子發(fā)燒友原創(chuàng)? 章鷹 5月19日,在Computex 2025上,英特爾發(fā)布了最新全新圖形處理器(GPU)和AI加速器產(chǎn)品系列。包括全新
    的頭像 發(fā)表于 05-21 00:57 ?5970次閱讀
    直擊Computex 2025:<b class='flag-5'>英特爾</b>重磅<b class='flag-5'>發(fā)布</b>新一代GPU,圖形和<b class='flag-5'>AI</b>性能躍升3.4倍

    直擊Computex2025:英特爾重磅發(fā)布新一代GPU,圖形和AI性能躍升3.4倍

    5月19日,在Computex 2025上,英特爾發(fā)布了最新全新圖形處理器(GPU)和AI加速器產(chǎn)品系列。包括全新
    的頭像 發(fā)表于 05-20 12:27 ?4492次閱讀
    直擊Computex2025:<b class='flag-5'>英特爾</b>重磅<b class='flag-5'>發(fā)布</b>新一代GPU,圖形和<b class='flag-5'>AI</b>性能躍升3.4倍

    英特爾發(fā)布全新GPU,AI和工作站迎來(lái)新選擇

    Computex 2025上,英特爾發(fā)布了為專業(yè)人士和開(kāi)發(fā)者設(shè)計(jì)的全新圖形處理器(GPU)和AI加速器產(chǎn)品系列。包括: 全新
    發(fā)表于 05-20 11:03 ?1517次閱讀

    英特爾酷睿Ultra AI PC上部署多種圖像生成模型

    全新英特爾酷睿Ultra 200V系列處理器對(duì)比上代Meteor Lake,升級(jí)了模塊化結(jié)構(gòu)、封裝工藝,采用全新性能核與能效核、英特爾硬件線程調(diào)度器、Xe2微架構(gòu)銳炫GPU、第四代NP
    的頭像 發(fā)表于 04-02 15:47 ?538次閱讀
    在<b class='flag-5'>英特爾</b>酷睿Ultra <b class='flag-5'>AI</b> PC上部署多種圖像<b class='flag-5'>生成</b><b class='flag-5'>模型</b>

    英特爾OpenVINO 2025.0正式發(fā)布

    生成AI(GenAI)在模型質(zhì)量與應(yīng)用范圍上持續(xù)爆發(fā)式增長(zhǎng),DeepSeek 等頂尖模型已引發(fā)行業(yè)熱議,這種勢(shì)頭預(yù)計(jì)將在 2025年延續(xù)。本次更新聚焦性能提升、更多
    的頭像 發(fā)表于 02-21 10:20 ?759次閱讀
    <b class='flag-5'>英特爾</b>OpenVINO 2025.0正式<b class='flag-5'>發(fā)布</b>

    使用英特爾AI PC為YOLO模型訓(xùn)練加速

    之后,情況有了新的變化,PyTorch2.5正式開(kāi)始支持英特爾顯卡,也就是說(shuō),此后我們能夠借助英特爾 銳炫 顯卡來(lái)進(jìn)行模型訓(xùn)練了。
    的頭像 發(fā)表于 12-09 16:14 ?1607次閱讀
    使用<b class='flag-5'>英特爾</b><b class='flag-5'>AI</b> PC為YOLO<b class='flag-5'>模型</b>訓(xùn)練加速

    英特爾推出全新英特爾銳炫B系列顯卡

    英特爾銳炫B580和B570 GPU以卓越價(jià)值為時(shí)新游戲帶來(lái)超凡表現(xiàn)。 ? > 今日,英特爾發(fā)布全新英特爾銳炫 B系列顯卡(代號(hào)Battle
    的頭像 發(fā)表于 12-07 10:16 ?1435次閱讀
    <b class='flag-5'>英特爾</b>推出<b class='flag-5'>全新</b><b class='flag-5'>英特爾</b>銳炫B系列顯卡

    英特爾發(fā)布全新企業(yè)AI一體化方案

    近日,英特爾正式推出了全新的企業(yè)AI一體化方案。該方案以英特爾至強(qiáng)處理器和英特爾Gaudi 2D AI
    的頭像 發(fā)表于 12-03 11:20 ?597次閱讀

    英特爾發(fā)布全新企業(yè)AI一體化解決方案

    加速器等先進(jìn)硬件。此外,它還結(jié)合了OPEA開(kāi)放軟件平臺(tái),確保了方案的靈活性和兼容性。 作為該方案的首個(gè)落地實(shí)踐,英特爾攜手新華三共同發(fā)布了新華三AIGC靈犀一體機(jī)。這款一體機(jī)充分利用了英特爾
    的頭像 發(fā)表于 12-02 10:48 ?922次閱讀

    NVIDIA推出全新生成AI模型Fugatto

    NVIDIA 開(kāi)發(fā)了一個(gè)全新生成AI 模型。利用輸入的文本和音頻,該模型可以創(chuàng)作出包含任意
    的頭像 發(fā)表于 11-27 11:29 ?830次閱讀

    英特爾推進(jìn)智能計(jì)算的進(jìn)一步落地和發(fā)展

    近日,英特爾研究院副總裁、英特爾中國(guó)研究院院長(zhǎng)宋繼強(qiáng)在第二十一屆中國(guó)國(guó)際半導(dǎo)體博覽會(huì)(IC China 2024)上發(fā)表了題為《面向“智算時(shí)代”的產(chǎn)品設(shè)計(jì)與制程技術(shù)創(chuàng)新》的演講,分享了
    的頭像 發(fā)表于 11-24 11:31 ?742次閱讀

    IC China 2024北京開(kāi)幕:英特爾分享洞察,促智能計(jì)算應(yīng)用落地

    計(jì)算技術(shù)發(fā)展趨勢(shì)的洞察,介紹了英特爾如何通過(guò)產(chǎn)品和技術(shù)創(chuàng)新,加速?gòu)脑频蕉说闹悄苡?jì)算落地,以推動(dòng)數(shù)字經(jīng)濟(jì)發(fā)展和產(chǎn)業(yè)轉(zhuǎn)型升級(jí)。 英特爾研究院副總裁、英特爾中國(guó)
    的頭像 發(fā)表于 11-19 16:22 ?511次閱讀
    IC China 2024北京開(kāi)幕:<b class='flag-5'>英特爾</b>分享洞察,促智能計(jì)算應(yīng)用落地

    英特爾至強(qiáng)品牌新戰(zhàn)略發(fā)布

    品牌是企業(yè)使命和發(fā)展的象征,也承載著產(chǎn)品特質(zhì)和市場(chǎng)認(rèn)可。在英特爾GTC科技體驗(yàn)中心的英特爾 至強(qiáng) 6 能效核處理器發(fā)布會(huì)上,英特爾公司全球副總裁兼首席市場(chǎng)營(yíng)銷官Brett Hannat
    的頭像 發(fā)表于 10-12 10:13 ?872次閱讀

    英特爾與百共同為AI時(shí)代打造高性能基礎(chǔ)設(shè)施

    2024年9月25日,北京 ?——?在2024百云智大會(huì)上,英特爾應(yīng)邀出席并披露基于英特爾?至強(qiáng)?6處理器的新一代云實(shí)例即將在百智能云上推出,分享雙方在云數(shù)據(jù)中心、大
    的頭像 發(fā)表于 09-27 09:48 ?432次閱讀
    <b class='flag-5'>英特爾</b>與百<b class='flag-5'>度</b>共同為<b class='flag-5'>AI</b>時(shí)代打造高性能基礎(chǔ)設(shè)施

    支持140億參數(shù)AI模型,229TOPS!英特爾重磅發(fā)布第一代車載獨(dú)立顯卡

    英特爾院士、英特爾公司副總裁、汽車事業(yè)部總經(jīng)理Jack Weast指出,在今年的CES上,英特爾發(fā)布了第一代AI增強(qiáng)型軟件定義車載SoC。8
    的頭像 發(fā)表于 08-12 09:07 ?1.4w次閱讀
    支持140億參數(shù)<b class='flag-5'>AI</b><b class='flag-5'>模型</b>,229TOPS!<b class='flag-5'>英特爾</b>重磅<b class='flag-5'>發(fā)布</b>第一代車載獨(dú)立顯卡