人工智能(AI)領域的巨頭OpenAI再次引發關注,其最新推出的視頻生成大模型Sora因其出色的逼真度和想象力廣受贊譽。相較于傳統視頻生成領域的平均4秒長度,Sora能夠生成長達60秒的視頻,這一創新無疑顛覆了行業的常規。
據OpenAI官網介紹,Sora是一種擴散模型,其生成視頻的過程從看似靜態噪聲的視頻開始,通過逐步消除噪聲來轉換生成視頻。這一模型具備生成完整視頻或擴展已有視頻的能力,確保視頻主題在暫時離開視野時仍保持一致。此外,Sora還借鑒了GPT模型,采用Transformer架構,并建立在DALL·E和GPT模型的研究基礎上,利用DALL·E 3的重述技術為視覺訓練數據生成高度描述性的標題,從而更精準地遵循用戶的文本指令。
OpenAI對Sora寄予厚望,認為它是能夠理解和模擬現實世界的模型基礎,并相信這一功能將成為實現通用人工智能(AGI)的重要里程碑。這一觀點得到了業界的廣泛認同,甚至有行業觀察者認為AGI的實現可能因此從10年縮短到1年。
事實上,Sora并非首個嘗試AI視頻生成的模型。在此之前,谷歌發布了VideoPoet模型,而Meta則推出了Emu模型。此外,Pika等文生視頻軟件也在市場上掀起了一股AI視頻應用的熱潮。然而,Sora的出現無疑為這一領域帶來了新的突破。
市場分析師普遍認為,Sora及類似產品將在短期內大幅提升圖像和短視頻的制作效率,改變創意生產及營銷工作流,提升短視頻產品生產力。對于更復雜的長視頻和游戲,雖然模型目前還無法很好地理解因果關系和其他技術難點,但仍可以為美術靈感提供支持。從中長期來看,Sora及同類產品將深度參與信息生產和分發兩大環節的變革,使得專業生產內容(PGC)廣泛采用AI工具輔助生產,同時用戶生產內容(UGC)也將借助AI工具逐步替代PGC。這一過程中,AI生成視頻工具的商業化將加速,盡管Sora尚未公布收費標準,但預計其定價將相對較高。
從投資角度來看,Sora的出現為投資者提供了新的關注點。在下游應用側,相關受益細分行業包括視頻美化、廣告營銷、短劇、游戲、辦公軟件等。具體投資標的方面,建議關注美圖公司、中文在線、閱文集團、金山軟件、三人行等。在上游需求方面,算法和算力方面的公司如英偉達等也值得關注。
值得注意的是,技術專家普遍認為,未來的技術突破方向將聚焦于多模態技術。只有真正掌握和應用好多模態AI能力,才能打通物理世界和數字世界的壁壘,實現與物理世界最自然的交互。因此,盡管AI視頻生成是多模態技術路徑中的一個方向,但多模態領域的更大突破仍在等待。
對于A股公司而言,已有十多家公司提前布局多模態大模型或對AI視頻相關研發。例如,海康威視和大華股份都在視覺大模型和多模態大模型研發方面取得了進展。這些公司的早期布局有望在未來的技術浪潮中獲得先機。
總體來說,Sora的出現標志著AI視頻生成技術的新里程碑,為相關行業帶來了前所未有的機遇和挑戰。投資者、企業和研究者都需要密切關注這一領域的發展,以便在未來的技術變革中搶占先機。
近日,賽默飛世爾科技公司宣布與OpenAI達成戰略合作,借助其先進的人工智能技術,推動科學創新和藥物開發的進程。此次合作將OpenAI的應用程序編程接口(API)整合到賽默飛世爾的核心業務領域,包括產......
近日,賽默飛世爾科技公司宣布與OpenAI達成戰略合作,借助其先進的人工智能技術,推動科學創新和藥物開發的進程。此次合作將OpenAI的應用程序編程接口(API)整合到賽默飛世爾的核心業務領域,包括產......
8月28日,美國人工智能公司OpenAI發布了其所謂“最先進的語音到語音模型”GPT-realtime,以及配套的Realtime API(實時應用程序接口)。據OpenAI公司介紹,該模型......
8月28日,美國人工智能公司OpenAI發布了其所謂“最先進的語音到語音模型”GPT-realtime,以及配套的Realtime API(實時應用程序接口)。據OpenAI公司介紹,該模型......
美國開放人工智能研究中心(OpenAI)7日發布其最新人工智能模型GPT-5。據OpenAI官網介紹,這是迄今為止該機構推出的最強大的人工智能系統,在各類基準測試中超越了先前的模型,在編程、數學、寫作......
美國開放人工智能研究中心(OpenAI)7日發布其最新人工智能模型GPT-5。據OpenAI官網介紹,這是迄今為止該機構推出的最強大的人工智能系統,在各類基準測試中超越了先前的模型,在編程、數學、寫作......
6月28日,國家能源集團在京舉行發布會,正式發布全球首個千億級發電行業大模型——“擎源”。該模型構建了覆蓋安全環保、電力交易、產調中樞、設備檢修全鏈條的智能決策體系,實現電力全場景智慧化升級、模型自主......
近日,中國首個海洋領域開源大模型OceanGPT(滄淵)在杭州正式發布。該大模型由海洋精準感知技術全國重點實驗室(浙江大學)牽頭研發,具備基礎的海洋專業知識問答,以及聲吶圖像、海洋觀測圖等海洋特色多模......
近日,中國熱帶農業科學院南亞熱帶作物研究所旱作農業工程團隊在基于混合監督學習的菠蘿智能識別算法方面取得新進展。該團隊設計了一個基于混合監督學習(MIset)的掩蔽自關注實例分割網絡,以快速提取菠蘿的位......
近日,首個可精準診斷罕見病的醫學影像多模態大模型矩陣“明岐”正式亮相。當天,由上海交通大學主辦,上海交通大學計算機學院(網絡空間安全學院)、上海交通大學國際與公共事務學院、健康長三角研究院共同承辦的“......