<nav id="4uuuu"></nav>
  • <tr id="4uuuu"></tr>
  • <tr id="4uuuu"></tr>
  • <tfoot id="4uuuu"><dd id="4uuuu"></dd></tfoot>
    • <noscript id="4uuuu"><optgroup id="4uuuu"></optgroup></noscript>

      久久精品福利网站免费,亚洲色大情网站WWW在线观看,久久水蜜桃网国产免费网手机 ,男女性高视频免费观看国内,老色鬼第一页av在线,久久久久精品婷婷

      OpenAI深夜發(fā)布首個(gè)文生視頻模型Sora,現(xiàn)實(shí)將被徹底顛覆

      程璐2024-02-18 07:56

      2月16日凌晨,OpenAI再次扔出一枚深水炸彈,發(fā)布了首個(gè)文生視頻模型Sora。據(jù)介紹,Sora可以直接輸出長(zhǎng)達(dá)60秒的視頻,并且包含高度細(xì)致的背景、復(fù)雜的多角度鏡頭,以及富有情感的多個(gè)角色。

      目前官網(wǎng)上已經(jīng)更新了48個(gè)視頻demo,在這些demo中,Sora不僅能準(zhǔn)確呈現(xiàn)細(xì)節(jié),還能理解物體在物理世界中的存在,并生成具有豐富情感的角色。該模型還可以根據(jù)提示、靜止圖像甚至填補(bǔ)現(xiàn)有視頻中的缺失幀來(lái)生成視頻。

      例如一個(gè)Prompt(大語(yǔ)言模型中的提示詞)的描述是:在東京街頭,一位時(shí)髦的女士穿梭在充滿溫暖霓虹燈光和動(dòng)感城市標(biāo)志的街道上。

      在Sora生成的視頻里,女士身著黑色皮衣、紅色裙子在霓虹街頭行走,不僅主體連貫穩(wěn)定,還有多鏡頭,包括從大街景慢慢切入到對(duì)女士的臉部表情的特寫(xiě),以及潮濕的街道地面反射霓虹燈的光影效果。

      另一個(gè)Prompt則是,一只貓?jiān)噲D叫醒熟睡的主人,要求吃早餐,主人試圖忽略這只貓,但貓嘗試了新招,最終主人從枕頭下拿出藏起來(lái)的零食,讓貓自己再多待一會(huì)兒。在這個(gè)AI生成視頻里,貓甚至都學(xué)會(huì)了踩奶,對(duì)主人鼻頭的觸碰甚至都是輕輕的,接近物理世界里貓的真實(shí)反應(yīng)。

      Sora生成的視頻截圖,圖片來(lái)源:OpenAI官網(wǎng)

      OpenAI表示,他們正在教AI理解和模擬運(yùn)動(dòng)中的物理世界,目標(biāo)是訓(xùn)練模型來(lái)幫助人們解決需要現(xiàn)實(shí)世界交互的問(wèn)題。

      隨后OpenAI解釋了Sora的工作原理,Sora是一個(gè)擴(kuò)散模型,它從類(lèi)似于靜態(tài)噪聲的視頻開(kāi)始,通過(guò)多個(gè)步驟逐漸去除噪聲,視頻也從最初的隨機(jī)像素轉(zhuǎn)化為清晰的圖像場(chǎng)景。Sora使用了Transformer架構(gòu),有極強(qiáng)的擴(kuò)展性。

      視頻和圖像是被稱為“補(bǔ)丁”的較小數(shù)據(jù)單位集合,每個(gè)“補(bǔ)丁”都類(lèi)似于GPT中的一個(gè)標(biāo)記(Token),通過(guò)統(tǒng)一的數(shù)據(jù)表達(dá)方式,可以在更廣泛的視覺(jué)數(shù)據(jù)上訓(xùn)練和擴(kuò)散變化,包括不同的時(shí)間、分辨率和縱橫比。

      Sora是基于過(guò)去對(duì)DALL·E和GPT的研究基礎(chǔ)構(gòu)建,利用DALL·E 3的重述提示詞技術(shù),為視覺(jué)模型訓(xùn)練數(shù)據(jù)生成高描述性的標(biāo)注,因此模型能更好的遵循文本指令。

      一位YouTube博主Paddy Galloway發(fā)表了對(duì)Sora的感想,他表示內(nèi)容創(chuàng)作行業(yè)已經(jīng)永遠(yuǎn)的改變了,并且毫不夸張。“我進(jìn)入YouTube世界已經(jīng)15年時(shí)間,但OpenAI剛剛的展示讓我無(wú)言…動(dòng)畫(huà)師/3D藝術(shù)家們有麻煩了,素材網(wǎng)站將變得無(wú)關(guān)緊要,任何人都可以無(wú)壁壘獲得難以置信的產(chǎn)品,內(nèi)容背后的‘想法’和故事將變得更加重要。”

      但Sora模型當(dāng)前也存在弱點(diǎn)。OpenAI稱它可能難以準(zhǔn)確模擬復(fù)雜場(chǎng)景的物理原理,并且可能無(wú)法理解因果關(guān)系。例如,一個(gè)人可能咬了一口餅干后,餅干會(huì)沒(méi)有咬痕,玻璃破碎的物理過(guò)程可能也無(wú)法被準(zhǔn)確呈現(xiàn)。

      來(lái)源:界面新聞 記者:程璐

      版權(quán)與免責(zé):以上作品(包括文、圖、音視頻)版權(quán)歸發(fā)布者【程璐】所有。本App為發(fā)布者提供信息發(fā)布平臺(tái)服務(wù),不代表經(jīng)觀的觀點(diǎn)和構(gòu)成投資等建議

      熱新聞

      久久精品福利网站免费
      <nav id="4uuuu"></nav>
    • <tr id="4uuuu"></tr>
    • <tr id="4uuuu"></tr>
    • <tfoot id="4uuuu"><dd id="4uuuu"></dd></tfoot>
      • <noscript id="4uuuu"><optgroup id="4uuuu"></optgroup></noscript>