用戶名
UID
Email
密碼
登錄
自動登錄
找回密碼
註冊
首頁
Portal
XF NEWS
論壇
BBS
夯評測
REVIEW
嗑消息
TRENDS
瘋採訪
INTERVIEW
潮活動
賀得獎
校園活動
最新文章
搜索
搜索
熱搜:
XFastest 最夯的電腦領域
XFastest
夯評測
嗑新聞
瘋採訪
潮活動
速下載
本版
帖子
用戶
XFastest 最夯的電腦領域
»
論壇
›
官方推薦文章
›
業界動態 Industrial Information
›
NVIDIA Maxine 雲端 AI 視訊技術 Vid2Vid Cameo 讓會議 ...
返回列表
複製連結
發新帖
夯評測
REVIEW
›
AMD 3A平台單通道也能打!Ryzen 7 9800X3D x單通道 16GB RAM 系統 x Radeon RX 9070 XT 遊戲效能測試
AITC S1000、KE680、KM600 Ultra M.2 SSD 開箱測試 / 入門 x 主流 x 旗艦直觀選!
Intel、AMD 雙平台實裝!CORSAIR iCUE LINK TITAN II 360 RX RGB / RX LCD 開箱
最強 AI 武裝!ROG Strix SCAR 18 (2026) G835 開箱測試 / 手動 320W 本地 Armor EdgeAI
電競全景高!ROG Cronox ARGB 機殼開箱組裝 / 4 x Eurux GR120 風扇與 9.2 吋 LCD 螢幕
3D 造景 x 散熱舞台!TCOMAS EXIT D3 PRO 水冷開箱測試 / 三面 LCD 螢幕、LYNK 磁吸風扇
一殼三玩、9 種電源位置!MONTECH TEN 機殼開箱 / 十週年模組化 M-ATX、多種安裝方式
iRocks T36 人體工學椅雙色開箱 / 晨光綠、丹寧藍簡約質感,4D 扶手與舒適支撐兼具
MSI MEG CORELIQUID E15 360 旗艦曲面水冷與 MAESTRO 900R 豪宅開箱測試
波紋 CP 有型!SAMA V42 BK 開箱組裝 / 波紋鋁框前門、USB-C 20Gbps、4顆 ARGB 流光風扇
文章精選
CHOICE
›
「小隻馬裡的千瓦級猛獸!」全漢 FSP DAGGER PM 1200W SFX-L 開箱
VIA 軟體支援 Ducky OK-M-98 緊湊型全尺寸入門三模無線機械鍵盤
AMD 3A平台單通道也能打!Ryzen 7 9800X3D x單通道 16GB RAM 系統 x Radeon RX 9070 XT 遊戲效能測試
ASUS ProArt PA40SU SSD 外接盒開箱 / USB4 40Gbps 高速外接、主動風扇
風扇滿配,視博通高 CP 全新曲面海景 SAC449「速速叫」
【開箱】白色白金認證MIT電源 | FSP VITA PM MIT 1000W WHITE
AITC S1000、KE680、KM600 Ultra M.2 SSD 開箱測試 / 入門 x 主流 x 旗艦直觀選!
強效單塔+數位顯示 DeepCool 九州風神 AK700 DIGITAL NYX
[開箱] 技嘉AMD平價電競筆電 GIGABYTE EAGLE 平替DIY桌機
喬思伯JONSBO D33玻璃透側機殼-搭載R25黃金曲率美學,小體積享受質感與強悍擴充
NVIDIA Maxine 雲端 AI 視訊技術 Vid2Vid Cameo 讓會議畫面更完美
[業界新聞]
複製鏈接
打印
上一主題
下一主題
回復
電梯直達
1
#
7440
0
lin.sinchen
發表於 2021-6-30 14:34:01
|
只看該作者
|
只看大圖
|
倒序瀏覽
|
閱讀模式
NVIDIA 研究人員所開發的 AI 工具 NVIDIA Maxine SDK 當中,有著相當多的深度學習模型其中包含 Vid2Vid Cameo,這模型利用生成對抗網路 (GAN),只需你的一張平面照片,就能產生出不同角度、立體的頭像。
就像 NVIDIA 敬致 Netflix 播出的《紙房子》影集中視訊的畫面,由 NVIDIA 研究人員來說明 Vid2Vid Cameo 可提供給視訊會議更完美的人體頭像,參與者只需要在加入視訊通話前先上傳一張參考圖片,可以是自己的真實照片或卡通圖片,就能使用這項功能。
Vid2Vid Cameo 只需要兩個元素,便能建立出用於視訊會議的逼真 AI 對話頭像,包含一張使用者的臉部照片以及一個視訊串流內容,該模型在 NVIDIA DGX 系統上使用 18 萬個高品質對話頭像的資料集來進行訓練。
Vid2Vid Cameo 的模式能夠辨識臉部的二十個關鍵點,這些關鍵點針對包括眼睛、嘴巴和鼻子在內的特徵位置進行編碼,接著模型會從通話者的參考圖片中擷取這些關鍵點,通話者的圖片可以事先發送給其他參與視訊會議的人,或從過往的會議中重複使用。
如此一來,視訊會議平台只需發送說話者臉部關鍵點的動作資料,而不用在每一個與會者之間發送龐大的即時視訊串流內容;對接收者來說,GAN 模型在接收端使用這些資訊來合成一個模仿參考圖片外觀的視訊內容。
利用 Vid2Vid Cameo 後,視訊會議只需傳送會議者臉部的位置及關鍵點,而並即時的在所有與會者電腦中,藉由 AI 來模擬出會議者的立體頭像,讓整體視訊會議品質可更佳流暢,且不影響視訊畫質。
NVIDIA 的研究人員發現,Vid2Vid Cameo 可以產生更為真實清晰的結果,不管參考圖片和視訊內容是否出自同一個人,還是當 AI 把一個人的動作轉移到另一個人的參考圖片上,它的表現都比最先進的模型更出色。
Vid2Vid Cameo 模型論文的作者為 NVIDIA 研究人員 Arun Mallya 和兩位來自台灣的 Ting-Chun Wang、和 Ming-Yu Liu。NVIDIA Research 團隊由全球兩百多名科學家組成,專注於 AI、電腦視覺、自動駕駛車、機器人和繪圖等領域。
在此特別感謝於 Netflix 播出的《紙房子》影集中,替教授進行英語配音的演員 Edan Moses,感謝他為上述我們最新的 AI 研究成果影片所做出的貢獻。
更多圖片
小圖
大圖
014.jpg
(99.48 KB, 下載次數: 58)
下載附件
保存到相冊
2021-6-30 16:15 上傳
組圖打開中,請稍候......
回復
使用道具
舉報
提升卡
置頂卡
沉默卡
喧囂卡
變色卡
顯身卡
發新帖
返回列表
複製連結
高級模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登錄後才可以回帖
登錄
|
註冊
本版積分規則
發表回復
回帖後跳轉到最後一頁
瀏覽過的版塊
廠商新聞 News
快速回復
返回頂部
返回列表