8月23-26日,北京國際廣播電影電視展覽會(BIRTV)舉行,這是BIRTV三年后再次回歸線下,也是BIRTV迎來第三十屆的特別時刻。
2023年,不管是在政策、市場方面,還是在技術(shù)方面,對廣播電影電視行業(yè)來說,都是充滿各種變化的一年。在技術(shù)方面,最大的變化無疑來自于以大模型為代表的AI大潮。
經(jīng)過半年多時間的狂飆式發(fā)展,雖然大模型風(fēng)口的聲量似乎不比當(dāng)時,但不可否認(rèn)的是,AI作為一種生產(chǎn)力,或是推動生產(chǎn)力增長的重要力量,它正在對包括視聽領(lǐng)域在內(nèi)的所有行業(yè)的發(fā)展帶來助力。
(資料圖)
而作為亞洲排名第一的專業(yè)性和觀賞性兼?zhèn)涞膰H廣播影視展覽會,BIRTV自然是觀察AI賦能視聽的最佳窗口之一。
實際上,在BIRTV2023開幕首日,阿里云、百度云、騰訊云就集體在BIRTV2023主題報告會暢談大模型。(相關(guān)閱讀:秀行業(yè)肌肉?BAT大模型齊聚BIRTV2023主題報告會)而在此次BIRTV展會上,我們也得以在各大展臺看到不少“AI+視聽”的具體案例。
“AI+視聽”之大模型
傳統(tǒng)AI時代,不同場景對應(yīng)的是不同的小模型,到了大模型時代,大模型就可以吸收海量知識,適配多業(yè)務(wù)場景,視聽領(lǐng)域自然也是AI大模型的典型落地場景之一。
BAT在22日的主題報告會上都分享了各自的大模型探索,在BIRTV展區(qū),華為也為“盤古大模型”的媒體解決方案專門設(shè)置了相應(yīng)版塊——雖然這個展示版塊并不算太大。
其實,華為盤古大模型本身就強調(diào)在細(xì)分場景的落地應(yīng)用。據(jù)了解,盤古大模型媒體解決方案不僅具備強大的通用性和泛化能力,還能根據(jù)不同行業(yè)的特點和需求進(jìn)行快速微調(diào)和適配,實現(xiàn)高效落地。
據(jù)介紹,媒體領(lǐng)域?qū)Υ竽P偷氖褂弥饕P(guān)注LO層的三大基礎(chǔ)模型,分別是視覺大模型 (CV)、自然語言大模型(NLP)、多模態(tài)大模型。
華為方面也建議,媒體行業(yè)客戶直接使用盤古L0層的推理服務(wù),然后根據(jù)自有數(shù)據(jù),訓(xùn)練自己的L1層行業(yè)模型或L2層的行業(yè)細(xì)分場景模型。
比如基于視覺大模型的視圖內(nèi)容生成及審核,就包括標(biāo)簽、視頻/圖片審核、分類等;基于自然語言大模型的自然語言理解生成,包括對話問答、智能寫稿、稿件標(biāo)題生成、代碼生成等;基于多模態(tài)大模型的圖文音視頻理解,則包括圖像生成、圖像編輯、圖像理解等。
另外,此次華為也展示了基于盤古大模型的AIGC智能生產(chǎn)平臺,其中就包括從智能生產(chǎn)到虛擬主播的各種媒體工具。
“AI+視聽”之AI主播
相比AI大模型,虛擬主播、虛擬主持人進(jìn)入人們視野的時間似乎要早得多。
尤其是,不管是電視臺,還是MCN機(jī)構(gòu),或是其他產(chǎn)業(yè)鏈玩家,都早已進(jìn)行了相關(guān)布局。當(dāng)然,隨著AI大模型的火爆,AI主持人的發(fā)展也得到了新一輪助推。
此次BIRTV展會上,在中央廣播電視總臺、江蘇IPTV等展區(qū),我們都看到了AI主持人的身影。
比如總臺“央視頻”推出的AI虛擬主持人全流程采編+播出平臺,目前就已經(jīng)孵化出AI超仿真主播“王冠”、AI手語翻譯官“聆語”、AI航天員“央小天”等多個虛擬主播IP,這些IP也覆蓋多個專業(yè)領(lǐng)域。
再比如江蘇IPTV的虛擬主播“荔小漫”,也是IPTV領(lǐng)域的首個虛擬主播。據(jù)了解,“荔小漫”是有明確形象和人設(shè)的,比如愛藝術(shù),愛中國文化等。在具體應(yīng)用方面,則包括影視解讀、直播報道等場景。
此外,還有如華為展示的3D數(shù)字人模型等,都是此方面的典型探索。相比真人主播,AI主播的優(yōu)勢顯而易見,接下來也勢必會得到更進(jìn)一步的應(yīng)用普及。相應(yīng)地,AI主播對廣播電視生產(chǎn)、傳播等環(huán)節(jié)的賦能也會不斷提升。
“AI+視聽”之全場景賦能
除了AI大模型、AI主播,其實,此次BIRTV展會看下來,就非常容易感受到,AI幾乎已經(jīng)滲透到視聽領(lǐng)域的各個環(huán)節(jié)、各個場景當(dāng)中。
就像央視網(wǎng)的“人工智能編輯部”,已經(jīng)將人工智能技術(shù)廣泛應(yīng)用于時政和重大主題宣傳報道中,以打造獨具總臺“智造”特色的智能創(chuàng)新應(yīng)用產(chǎn)品。
比如中視廣信的智能媒體中臺,在媒體AI的應(yīng)用方面,就包括用戶信息及評論AI審核、視頻內(nèi)容審核、畫面超分增強、智能橫豎屏轉(zhuǎn)換、AIGC圖像生成等眾多場景。
比如數(shù)碼視訊,在視頻AI方面也展示了智能媒資、智能超分、智能橫轉(zhuǎn)豎等實際應(yīng)用案例。
而在國家廣播電視總局廣播電視科學(xué)研究院展區(qū),則有AI視頻修復(fù)增強、智能化數(shù)字媒體內(nèi)容生產(chǎn)、電視劇版本技術(shù)檢測等更加細(xì)致的展示。
另外,在IPTV、有線這樣的電視大屏業(yè)務(wù)上,比如新媒股份針對不同運維階段建立的大數(shù)據(jù)及AI模型,中國廣電展出的大屏AI健身、康養(yǎng)語音遙控器等,也都是大屏領(lǐng)域“AI+視聽”的代表性案例。
可以看到,AI正在與視聽加速融合,并成為視聽行業(yè)發(fā)展中的一個重要趨勢,這一趨勢帶來的,則是從產(chǎn)業(yè)轉(zhuǎn)型升級、到用戶體驗提升全方位的助力。
但另一方面,誠然,產(chǎn)業(yè)各方對AI的應(yīng)用的確已經(jīng)隨處可見,可如果從更長遠(yuǎn)的視角來看,“AI+視聽”的探索,其實真的才剛剛開始。
視聽行業(yè)如何進(jìn)一步擁抱AI等關(guān)鍵技術(shù),并將其與產(chǎn)業(yè)所需相結(jié)合?2023年11月15-16日,由流媒體網(wǎng)主辦的「春城論道暨第26屆智能視聽與科技創(chuàng)新產(chǎn)業(yè)論壇」將于昆明舉行,屆時,來自產(chǎn)業(yè)鏈各方的嘉賓將就這一話題展開探討,論道展區(qū)也將集中展示產(chǎn)業(yè)的最新案例,敬請關(guān)注。
責(zé)任編輯:李楠
分享到:版權(quán)聲明:凡注明來源“流媒體網(wǎng)”的文章,版權(quán)均屬流媒體網(wǎng)所有,轉(zhuǎn)載需注明出處。非本站出處的文章為轉(zhuǎn)載,觀點供業(yè)內(nèi)參考,不代表本站觀點。文中圖片均來源于網(wǎng)絡(luò)收集整理,僅供學(xué)習(xí)交流,版權(quán)歸原作者所有。如涉及侵權(quán),請及時聯(lián)系我們刪除!關(guān)鍵詞:











