2024年影音市場轉型:SORA引領的創意與技術突破

圖/Open AI
SORA: OpenAI的影片生成創新
OpenAI開發的SORA是一款突破性的大型生成模型,專門用於視頻數據的生成。這項技術通過轉換器架構在廣泛的視頻和圖像數據上進行大規模訓練,有效處理時空視頻和圖像的隱藏代碼塊。SORA的獨特之處在於其能夠生成長達一分鐘的高保真度影片,並能處理多種持續時間、分辨率和長寬比的視頻和圖像。
技術核心與視頻壓縮
SORA技術的核心在於將視覺數據轉化為統一的表示形式,實現生成模型的大規模訓練。受到大型語言模型成功的啟發,SORA使用視覺塊作為基本的數據表示單位,類似於語言模型中的文字代碼。視頻壓縮網絡將視頻數據壓縮至低維度的隱藏空間,進一步分解成時空塊,適應不同解析度和長寬比的視頻和圖像。
圖/Open AI
擴散模型與創新影響
作為一種擴散模型,SORA從帶有噪聲的塊預測原始的「乾淨」塊,利用轉換器的特性,在多個領域展示出顯著的性能。SORA的創新不僅代表視頻生成模型的重要進展,也被視為一場「工業革命」,對藝術、媒體製作和創意行業產生深遠影響。
未來影音市場的變革
SORA和類似技術的出現預示著影音市場即將迎來深刻的變革,為創作者和觀眾帶來前所未有的機會,同時也提出一系列挑戰。

圖/Open AI