AI文生視頻領(lǐng)域,幾乎只剩Sora還是個(gè)期貨了。
最近兩個(gè)月,國內(nèi)外的AI-generated Video應(yīng)用持續(xù)爆發(fā),中國的快手、字節(jié)、智譜AI、生數(shù)科技、愛詩科技,海外的谷歌、Luma、Runway,格局如八仙過海。
雖然不同平臺水平差異依舊存在,但整體可用性已經(jīng)大大提高,而且風(fēng)格化特征也比較全面。唯一的缺憾是,在融入工作流方面,AI視頻工具們的水平還是差了一點(diǎn)。Sora畫的餅,要交給這些后來者去圓了。
放棄期貨,文生視頻應(yīng)用爆發(fā)
業(yè)界民間都把視頻視為AI應(yīng)用落地的重點(diǎn)領(lǐng)域。英偉達(dá)CEO黃仁勛在7月30日的全球頂級計(jì)算機(jī)圖形學(xué)會議SIGGRAPH 2024上邀請了Meta的CEO扎克伯格進(jìn)行對話,雙方都認(rèn)可視頻能力會是AI大模型的進(jìn)化方向。
出身于英偉達(dá)研究小組的Luma AI首席科學(xué)家宋佳銘,在與a16z合伙人Anjney Midha對談時(shí)說,視頻關(guān)聯(lián)著3D世界,從學(xué)習(xí)角度看,視頻數(shù)據(jù)使模型更好地理解和推理3D世界。所以,實(shí)時(shí)高質(zhì)量的視頻生成,最終會推動具身AI的發(fā)展。
視頻就是這樣一座“橋”,而現(xiàn)在大量的AI公司正在試圖搶先通過它,尤其是OpenAI讓Sora變成了外界用不到的期貨,給了其他平臺進(jìn)一步發(fā)展的空間。
(整理自公開信息)
(圖源:天眼查)
超長戰(zhàn)線背后是這些公司的試探。一部分是關(guān)于商業(yè)模式,另一部分是關(guān)于技術(shù)應(yīng)用前景。
可靈、即夢、Vidu等都推出了會員訂閱模式,在C端進(jìn)行應(yīng)用普及化嘗試。愛詩科技創(chuàng)始人王長虎此前在接受財(cái)新采訪時(shí)表示:“愛詩目前的策略以2C(面向消費(fèi)者)為主,廣泛收集國內(nèi)外用戶反饋,以更好地基于用戶體驗(yàn)迭代底層模型。”至于更遠(yuǎn)的應(yīng)用,現(xiàn)在來談則為時(shí)尚早,主要是因?yàn)镃端的收費(fèi)模式無法承擔(dān)成本。
Luma AI采取了To C的產(chǎn)品形態(tài),不過它原本專注于3D領(lǐng)域,進(jìn)入視頻生成領(lǐng)域是為了探索3D生成與重建的更多可能性,以視頻驅(qū)動3D發(fā)展。這在產(chǎn)業(yè)領(lǐng)域有更多的應(yīng)用前景,例如批量制造電影需要的三維素材等。
最重要的是,Luma AI的期望不是售賣技術(shù)或者素材,而是建立類似TikTok這樣的平臺,也就是一個(gè)基于3D的生態(tài)系統(tǒng)。王長虎也在和極客公園創(chuàng)始人張鵬對話時(shí)表示,愛詩科技也瞄準(zhǔn)的是“AIGC時(shí)代的平臺性機(jī)會”,但平臺的形態(tài)暫時(shí)無法預(yù)測,因?yàn)锳I產(chǎn)業(yè)不會以復(fù)制現(xiàn)在已有的平臺的方式成長。
不僅如此,目前讓AI-generated Video進(jìn)入完整工作流的應(yīng)用已經(jīng)在成形。開源視頻編輯工具Clapper最近熱度上升,它的特色就是集合各類AI技術(shù),用prompt的方式調(diào)動AI Agent生成和迭代故事,直接跳過了手工編輯文件的過程。
(圖源:機(jī)器之心)
由此可見,AI-generated Video的進(jìn)化速度遠(yuǎn)比我們想象得要快。目前,行業(yè)的重點(diǎn)無疑在于生成速度和生成效率兩個(gè)方面。但是,大模型并不提供完全確定的商業(yè)模式方向,這更多取決于團(tuán)隊(duì)的選擇。而在這個(gè)過程中,除了商業(yè)化之外,AI公司還要思考怎么避免陷入合規(guī)困境、成本困境。所以,把文生視頻變得成熟并不容易,現(xiàn)在僅僅相當(dāng)于ChatGPT剛剛問世的階段。
AI-generated Video的“硬傷”和突破口
a16z之前就發(fā)表過觀點(diǎn),巨頭在從科研成果到商業(yè)產(chǎn)品的轉(zhuǎn)化中需要更關(guān)注法律安全、版權(quán)等問題,所以往往效率會慢。我們不去考慮Sora是不是因?yàn)檫@個(gè)原因始終不露面,單看行業(yè)都要面對的相關(guān)問題,邏輯其實(shí)是一樣的。
1.商業(yè)化的“落差”,目前的AI-generated Video很難滿足甲方們的需求
彭博社曾報(bào)道,OpenAI一直試圖向好萊塢推薦Sora,但并不成功。用Sora制作的第一則商業(yè)化廣告是6月公開的玩具反斗城廣告。然而,這則視頻不但用了一些舊素材,公開新聞稿也沒有說完全由AI生成。
導(dǎo)演Nik Kleverov還在一條已經(jīng)刪除的動態(tài)里表示,制作這些鏡頭的創(chuàng)意機(jī)構(gòu)Native Foreign提供了大約十幾個(gè)工作人員參與工作,Sora支持了80%到85%的流程。這對需要高效低成本的AI-generated Video來說算不上什么好消息。
2.訓(xùn)練成本、高質(zhì)量數(shù)據(jù)集難以滿足
視頻的本質(zhì)可以視為一系列圖像,圖像有很多公開的數(shù)據(jù)集,但是視頻沒有。OpenAI遇到過違規(guī)使用YouTube視頻進(jìn)行訓(xùn)練的指控,英偉達(dá)最近被媒體曝光從Netflix和YouTube收集了大量數(shù)據(jù),用來訓(xùn)練自己的Cosmos項(xiàng)目,用于支持其AI產(chǎn)品往現(xiàn)實(shí)世界發(fā)展。它每天可以下載相當(dāng)于80年的視頻內(nèi)容。
這體現(xiàn)了兩個(gè)關(guān)鍵點(diǎn):一是黃仁勛和Luma的觀點(diǎn)類似,AI視頻的發(fā)展確實(shí)對AI進(jìn)入3D世界意義重大,英偉達(dá)也是這樣做的:文本——圖像——視頻——三維模型——現(xiàn)實(shí)世界。二是視頻數(shù)據(jù)集是個(gè)大問題,除了版權(quán)問題,這些視頻數(shù)據(jù)還缺乏標(biāo)簽,斯坦福大學(xué)教授Stefano Ermon說,現(xiàn)階段缺乏篩選和過濾好視頻的方法,而且篩選后還要考慮它們的標(biāo)簽和描述。
3.AI資產(chǎn)泡沫的問題,AI必須為用戶解決重要復(fù)雜的問題才能有價(jià)值,但現(xiàn)在它的發(fā)展成效,遠(yuǎn)遠(yuǎn)不能和互聯(lián)網(wǎng)等技術(shù)當(dāng)年初生時(shí)的情況相比
Benchmark合伙人Michael Eisenberg在最近的一期訪談中,引用了其好友Atreides Management創(chuàng)始人Gavin Baker關(guān)于大模型發(fā)展的觀點(diǎn):“基礎(chǔ)模型是歷史上貶值最快的資產(chǎn)。”
他所舉的例子來自Seeking Alpha的創(chuàng)始人,類似金融領(lǐng)域這種每分鐘都會進(jìn)行業(yè)務(wù)和數(shù)據(jù)更新的高頻領(lǐng)域,訓(xùn)練出來的模型只能完成寫報(bào)告之類的常規(guī)工作,但無法應(yīng)對數(shù)據(jù)的高速刷新,滿足金融預(yù)測未來的需求。
而且,其他技術(shù)的發(fā)展是確定性的,互聯(lián)網(wǎng)發(fā)展早期雖然泡沫巨大,但已經(jīng)體現(xiàn)了應(yīng)用路徑;而AI渾身都是不確定性。互聯(lián)網(wǎng)發(fā)展的邊際成本幾乎約等于0(或者說其中不少都分擔(dān)給了運(yùn)營商和用戶),然而AI成長的邊際成本涉及大量固定資產(chǎn),現(xiàn)在都由創(chuàng)業(yè)者自己承擔(dān),而且越投入邊際改善效應(yīng)越弱。大量的早期投入,很可能是一個(gè)陷阱。
技術(shù)革命之后必須伴隨產(chǎn)業(yè)革命,產(chǎn)業(yè)革命則需要現(xiàn)象級產(chǎn)品的引領(lǐng)。AI更需要的是一個(gè)成功的場景。目前看來,AI-generated Video還沒有拿到這類成果的起色。
Perplexity的創(chuàng)始人Arin對此提供了另外一個(gè)觀點(diǎn),那就是基礎(chǔ)模型的價(jià)值本質(zhì)映射著背后團(tuán)隊(duì)的價(jià)值,即Sora之于OpenAI,文心大模型之于百度。不是Sora能革了視頻的命,只是外界相信由OpenAI領(lǐng)導(dǎo)的Sora具備這樣的可能性而已。當(dāng)Sora沒能提供符合我們預(yù)期的突破時(shí),誰能在這個(gè)領(lǐng)域擔(dān)起大任呢?
由此出發(fā),關(guān)鍵或許在于誰能先把AI-generated Video真正融入到某一個(gè)商業(yè)系統(tǒng)的工作流中去,就像Clapper對視頻制作的探索一樣。而這就是一個(gè)更大的問題了,因?yàn)樗婕暗胶推渌I(lǐng)域的融合——氣象、城市、影視、汽車、制造業(yè)。也許Sora會在今年的某天拿出一個(gè)更具體的成果,也許是其他的創(chuàng)業(yè)公司顛覆了我們對AI視頻的認(rèn)知。
來源:松果財(cái)經(jīng)
申請創(chuàng)業(yè)報(bào)道,分享創(chuàng)業(yè)好點(diǎn)子。點(diǎn)擊此處,共同探討創(chuàng)業(yè)新機(jī)遇!
文/道哥美國設(shè)計(jì)軟件公司Figma近期在紐約證券交易所掛牌上市,首日即上演“狂飆”行情——發(fā)行價(jià)定每股33美元,開盤報(bào)價(jià)85美元,較發(fā)行價(jià)翻倍。首日收報(bào)115.50美元,較發(fā)行價(jià)大漲約250%,市值飆升至近670億美元,創(chuàng)下近30年來同等規(guī)模美股IPO的最大單日漲幅紀(jì)錄。然而,隨著短線資金獲利了結(jié),
文/一燈來源/節(jié)點(diǎn)財(cái)經(jīng)在當(dāng)前無人敢缺席的AI軍備競賽中,巨頭們一面為巨額的資本支出焦慮,一面又向市場勾勒著未來的宏偉藍(lán)圖。在各家動輒千億級投入的背景下,市場迫切需要一份關(guān)于AI回報(bào)價(jià)值的有力證明。而騰訊,率先給出了答卷。8月13日,騰訊控股發(fā)布2025年第二季度財(cái)報(bào)。盡管資本開支同比劇增119%,達(dá)
文/二風(fēng)來源/節(jié)點(diǎn)財(cái)經(jīng)2025年的硅谷,一場沒有硝煙的戰(zhàn)爭正以前所未有的烈度上演。這場戰(zhàn)爭的核心武器不是代碼或芯片,而是人——那些全球僅有數(shù)千名、能夠構(gòu)建未來人工智能基礎(chǔ)模型的頂尖大腦。在這場激烈的人才爭奪戰(zhàn)中,Meta及其首席執(zhí)行官馬克·扎克伯格(MarkZuckerberg)正扮演著最具侵略性的
文/道哥大舉裁員、清空賬號、國內(nèi)IP無法訪問——曾被譽(yù)為“中國AIAgent希望之星”的Manus,在估值飆至5億美元的高光時(shí)刻“閃離”中國市場。近日,Manus“裁員、出走”的消息在媒體端大量發(fā)酵。消息稱,Manus公司總部將由中國遷至新加坡,其國內(nèi)團(tuán)隊(duì)也將大幅裁撤——原有120人規(guī)模團(tuán)隊(duì)除40余
在數(shù)字化與智能化深度交織的時(shí)代浪潮中,安全的邊界不斷延展,技術(shù)的演進(jìn)正引領(lǐng)產(chǎn)業(yè)邁向新一輪變革。10月24日,以“弈動Dynamic·數(shù)智躍遷博弈無界”為主題的2025TechWorld智慧安全大會在北京盛大召開。來自國家部委、院士學(xué)者、高??蒲袡C(jī)構(gòu)和企業(yè)的權(quán)威專家與業(yè)界精英齊聚北京,共議AI安全、數(shù)
2025年10月25日,2025世界青年科學(xué)家峰會之人工智能(AI)融合創(chuàng)新發(fā)展論壇在浙江溫州成功舉辦。本次論壇由國際院士科創(chuàng)中心主辦,中國投資協(xié)會能源投資專業(yè)委員會、溫港院士科創(chuàng)中心承辦,中國電工技術(shù)學(xué)會、中科先進(jìn)技術(shù)溫州研究院與溫州市電力工程學(xué)會提供支持,以“甌江論道-AI賦能綠色發(fā)展”為主題,
我覺得我們AI的目標(biāo)是:從芯片設(shè)計(jì)到軟件生態(tài),全鏈路自主開發(fā),建立可控的世界級AI體系。所以這是俺對未來5年中國AI圈的展望和判斷。(1)2026年,英偉達(dá)造車、國產(chǎn)開車26年國產(chǎn)芯片會在推理和垂直場景上發(fā)力。以DeepSeek為代表,大多數(shù)AI大模型會以軟件彌補(bǔ)硬件不足,所以訓(xùn)練和推理分開,訓(xùn)練就
文/道哥在深陷“后門”風(fēng)波、接受網(wǎng)信辦問詢之后,英偉達(dá)的“特供版”H20芯片,又有了新消息。近日,美國科技媒體《TheInformation》援引知情人士消息稱,英偉達(dá)已悄然向其關(guān)鍵供應(yīng)商——包括負(fù)責(zé)封裝的安靠科技、供應(yīng)高帶寬內(nèi)存的三星電子、以及承擔(dān)后端處理的富士康發(fā)出指令,要求暫停所有與H20AI
文/二風(fēng)來源/節(jié)點(diǎn)財(cái)經(jīng)一場關(guān)于“中國芯”的IPO審議,正把投資者們的目光鎖定在上交所。根據(jù)上交所發(fā)布的公告,上市審核委員會已定于9月26日審議摩爾線程的科創(chuàng)板首發(fā)申請。作為中國半導(dǎo)體自主化浪潮中最受矚目的“考生”之一,包括其創(chuàng)始人顯赫的英偉達(dá)背景、高達(dá)80億元人民幣的募資雄心,以及在國產(chǎn)GPU領(lǐng)域取
技術(shù)的進(jìn)步永無止境,繼創(chuàng)下TPC-C性能&性價(jià)比雙冠之后,阿里云PolarDB云原生數(shù)據(jù)庫再度實(shí)現(xiàn)關(guān)鍵突破。9月24日杭州云棲大會上,阿里云宣布推出全球首款基于CXL(ComputeExpressLink)2.0Switch技術(shù)的PolarDB數(shù)據(jù)庫專用服務(wù)器。在原有RDMA網(wǎng)絡(luò)的基礎(chǔ)上,Polar
2025年9月24日,在杭州舉辦的云棲大會上,阿里云正式發(fā)布全新一代服務(wù)器操作系統(tǒng)AlibabaCloudLinux4(簡稱Alinux4)。Alinux4基于Linux6.6內(nèi)核打造,是首個(gè)全面遵循龍蜥社區(qū)“開源生態(tài)合作倡議”規(guī)范的商業(yè)發(fā)行版。它不僅兼容主流開源社區(qū)生態(tài),更針對阿里云最新9代ECS
9月24日,杭州云棲大會技術(shù)主論壇上,阿里云重磅發(fā)布AI安全護(hù)欄,提供五項(xiàng)核心安全能力,護(hù)航AI安全。一方面為客戶提供融入AIAgent開發(fā)全鏈路的原生安全防護(hù),另一方面持續(xù)用AI賦能安全產(chǎn)品智能化升級,打造Agentic-SOC安全運(yùn)營,提升安全威脅檢測和響應(yīng)效率。在過去的一年,AIAgent正在