英特爾研究院發布全新AI擴散模型，可根據文本提示生成360度全景圖

　阿里云優惠券先領券再下單

英特爾研究院宣布與Blockade Labs合作發布LDM3D（Latent Diffusion Model for 3D）模型，這一全新的擴散模型使用生成式AI創建3D視覺內容。LDM3D是業界領先的利用擴散過程（diffusion process）生成深度圖（depth map）的模型，進而生成逼真的、沉浸式的360度全景圖。LDM3D有望革新內容創作、元宇宙應用和數字體驗，改變包括娛樂、游戲、建筑和設計在內的許多行業。

英特爾研究院人工智能和機器學習研究專家Vasudev Lal表示：“生成式AI技術旨在提高和增強人類創造力，并節省時間。然而，目前的大部分生成式AI模型僅限于生成2D圖像，僅有少數幾種可根據文本提示生成3D圖像。在使用幾乎相同數量參數的情況下，不同于現存的潛在擴散模型，LDM3D可以根據用戶給定的文本提示同時生成圖像和深度圖。與深度估計中的標準后處理方法相比，LDM3D能夠為圖像中的每個像素提供更精準的相對深度，并為開發者省去了大量用于場景開發的時間。”

封閉的生態系統限制了規模。英特爾致力于推動AI的真正普及，通過開放的生態系統讓更多人從這項技術中受益。計算機視覺領域近年來取得了重大進展，特別是在生成式AI方面。然而，當今許多先進的生成式AI模型只能生成2D圖像。與通常只能根據文本提示生成2D RGB圖像的現有擴散模型不同，LDM3D可以根據用戶給定的文本提示同時生成圖像和深度圖。與深度估計（depth estimation）中的標準后處理（post-processing）方法相比，LDM3D在使用與潛在擴散模型Stable Diffusion幾乎相同數量參數的情況下，能夠為圖像中的每個像素提供更精準的相對深度（relative depth）。

這項研究有望改變我們與數字內容的互動方式，基于文本提示為用戶提供全新的體驗。LDM3D生成的圖像和深度圖能夠將諸如寧靜的熱帶海灘、摩天大樓、科幻宇宙等文本描述轉化為細致的360度全景圖。LDM3D捕捉深度信息的能力，可以即時增強整體真實感和沉浸感，使各行各業的創新應用成為可能，包括娛樂、游戲、室內設計、房產銷售，以及虛擬博物館與沉浸式VR體驗等。

6月20日，在IEEE/CVF計算機視覺和模式識別會議（CVPR）的3DMV工作坊上，LDM3D模型獲得了“Best Poster Award”

LDM3D是在LAION-400M數據集包含一萬個樣本的子集上訓練而成的。LAION-400M是一個大型圖文數據集，包含超過4億個圖文對。對訓練語料庫進行標注時，研究團隊使用了之前由英特爾研究院開發的稠密深度估計模型DPT-Large，為圖像中的每個像素提供了高度準確的相對深度。LAION-400M數據集是基于研究用途創建而成的，以便廣大研究人員和其它興趣社群能在更大規模上測試模型訓練。

LDM3D模型在一臺英特爾AI超級計算機上完成了訓練，該超級計算機由英特爾®至強®處理器和英特爾®Habana Gaudi® AI加速器驅動。最終的模型和流程整合了RGB圖像和深度圖，生成360度全景圖，實現了沉浸式體驗。

為了展示LDM3D的潛力，英特爾和Blockade的研究人員開發了應用程序DepthFusion，通過標準的2D RGB圖像和深度圖創建沉浸式、交互式的360度全景體驗。DepthFusion利用了TouchDesigner，一種基于節點的可視化編程語言，用于實時互動多媒體內容，可將文本提示轉化為交互式和沉浸式數字體驗。LDM3D是能生成RGB圖像及其深度圖的單一模型，因此能夠節省內存占用和降低延遲。

LDM3D和DepthFusion的發布，為多視角生成式AI和計算機視覺的進一步發展鋪平了道路。英特爾將繼續探索如何使用生成式AI增強人類能力，并致力于打造一個強大的開源AI研發生態系統，讓更多人能夠使用AI技術。延續英特爾對開放AI生態系統的大力支持，LDM3D正在通過HuggingFace進行開源，讓AI研究人員和從業者能對這一系統作出進一步改進，并針對特定應用進行微調。

在2023年6月18日至22日舉行的IEEE/CVF計算機視覺和模式識別會議上，英特爾將發表這項研究成果。欲了解更多信息，請參考論文《LDM3D: Latent Diffusion Model for 3D》。

申請創業報道，分享創業好點子。點擊此處，共同探討創業新機遇！

首次部署英特爾Max系列GPU，極光超算將推動人工智能實現突破性進展

阿貢國家實驗室和英特爾于近日宣布，Aurora超級計算機的10,624個刀片的安裝已經完成，該系統將于2023年晚些時候上線。該機器使用數萬個XeonMax“SapphireRapids”處理器，配備HBM2E內存以及數以萬計的數據中心GPUMax“PonteVecchio”計算GPU可實現超過2F

標簽：

英特爾
英特爾銳炫：驅動持續進步，盡展硬件潛力

發布之初，英特爾銳炫A770和A750顯卡就已展現出不錯的實力。幾個月過去，它們已然成長為同價位最好的顯卡之一。AMD和英偉達微弱的代際改進，再加上較高的價格，讓用戶很難在1500至2500元左右價位找到一款滿意的顯卡，不過英特爾銳炫顯卡悄悄地填補了這一空白。雖然銳炫A770和A750沒有主打旗艦級

標簽：

英特爾
英特爾銳炫Pro圖形顯卡發布新品，集豐富的內容創作功能于一身

英特爾推出兩款全新英特爾銳炫Pro圖形顯卡；搭載英特爾銳炫ProA40圖形顯卡的系統現已出貨。全新發布：英特爾今日宣布英特爾銳炫?ProA系列專業級圖形顯卡新增兩款產品——英特爾銳炫?ProA60和ProA60M。上述兩款產品的性能在現有英特爾銳炫Pro系列的基礎上更進一步，為專業級工作站用戶精心設

標簽：

英特爾
英特爾發布全新量子芯片Tunnel Falls，硅自選量子比特有望更快實現量產

今天，英特爾發布包含12個硅自旋量子比特（siliconspinqubit）的全新量子芯片TunnelFalls，繼續探索量子實用性，以解決重大難題。TunnelFalls是英特爾迄今為止研發的最先進的硅自旋量子比特芯片，利用了英特爾數十年來積累的晶體管設計和制造能力。在英特爾的晶圓廠里，Tunne

標簽：

英特爾
英特爾亮相2023開放原子全球開源峰會:秉持全棧軟件開放戰略,助推科技創新

在數字時代的今天，面對日益復雜的應用場景和業務發展需求，開源已經成為推動全球科技創新新模式。在《“十四五”軟件和信息技術服務業發展規劃》中，明確提出了“建設2~3個有國際影響力的開源社區”的要求，充分證明中國對開源社區和開源技術的重視與支持，快速推動著開源技術和開源社區的飛速發展。6月11-13日，

標簽：

英特爾

當前位置：首頁 > 科技 > IT業界 > 正文

英特爾研究院發布全新AI擴散模型，可根據文本提示生成360度全景圖

相關文章

首次部署英特爾Max系列GPU，極光超算將推動人工智能實現突破性進展

英特爾銳炫：驅動持續進步，盡展硬件潛力

英特爾銳炫Pro圖形顯卡發布新品，集豐富的內容創作功能于一身

英特爾發布全新量子芯片Tunnel Falls，硅自選量子比特有望更快實現量產

英特爾亮相2023開放原子全球開源峰會:秉持全棧軟件開放戰略,助推科技創新

熱門排行

信息推薦

編輯推薦

阿里一元店是新解“囊”雜貨鋪？

億企聯解答互聯網廣告的存在意義何在？

熱門標簽

當前位置：首頁 > 科技 > IT業界 > 正文

英特爾研究院發布全新AI擴散模型，可根據文本提示生成360度全景圖

相關文章

首次部署英特爾Max系列GPU，極光超算將推動人工智能實現突破性進展

英特爾銳炫：驅動持續進步，盡展硬件潛力

英特爾銳炫Pro圖形顯卡發布新品，集豐富的內容創作功能于一身

英特爾發布全新量子芯片Tunnel Falls，硅自選量子比特有望更快實現量產

英特爾亮相2023開放原子全球開源峰會:秉持全棧軟件開放戰略,助推科技創新

熱門排行

信息推薦

編輯推薦

阿里一元店是新解“囊”雜貨鋪？

億企聯解答互聯網廣告的存在意義何在？

熱門標簽

英特爾研究院發布全新AI擴散模型，可根據文本提示生成360度全景圖

首次部署英特爾Max系列GPU，極光超算將推動人工智能實現突破性進展

英特爾銳炫：驅動持續進步，盡展硬件潛力

英特爾銳炫Pro圖形顯卡發布新品，集豐富的內容創作功能于一身

英特爾發布全新量子芯片Tunnel Falls，硅自選量子比特有望更快實現量產

阿里一元店是新解“囊”雜貨鋪？

億企聯解答互聯網廣告的存在意義何在？