點擊藍字 關(guān)注我們
SUBSCRIBE to US

Image: Google
谷歌希望讓生成AI視頻變得更簡單,并為此推出了一款新工具。這款工具名為Flow,谷歌在宣布該工具的同時,還推出了新的Veo 3視頻生成模型、為Veo 2模型增加了更多控制功能,以及新的圖像生成模型Imagen 4。
借助Flow,用戶可以使用文本生成視頻提示(text-to-video prompts)和素材生成視頻提示(ingredients-to-video prompts,即上傳幾張圖片,F(xiàn)low會結(jié)合提示詞讓模型理解用戶想要的內(nèi)容)來制作8秒的AI生成視頻片段。隨后,還能使用Flow的場景構(gòu)建工具將多個片段拼接在一起。
Flow看起來有點像電影剪輯應(yīng)用程序,但專門用于制作AI生成視頻。從看到的演示來看,它可能是一個有用的工具。在一場簡報中,谷歌實驗室產(chǎn)品經(jīng)理Thomas Iljic展示了幾個Flow的實際應(yīng)用案例。
在一個演示中,我們觀看了一段動畫風(fēng)格的視頻:“鏡頭” 拉遠,顯示視頻正在一臺電視上播放;鏡頭再次拉遠,展現(xiàn)出電視所在的房間。隨后,“鏡頭” 緩緩飛過一扇窗戶,畫面中一輛卡車駛過。
盡管只是在谷歌會議的小窗口中短暫展示了這段視頻,但整體看起來銜接相當(dāng)流暢。不過,如果仔細觀察,可能會發(fā)現(xiàn)AI生成內(nèi)容特有的奇怪之處。但Iljic表示,F(xiàn)low的設(shè)計理念并非用于創(chuàng)作長視頻,而是更側(cè)重于幫助電影制作人快速將想法 “落地呈現(xiàn)”。
至于谷歌在I/O大會上發(fā)布的新模型,谷歌DeepMind的創(chuàng)意主管Matthieu Lorrain告訴The Verge,Veo 3將有更高的質(zhì)量,更容易被觸發(fā),并且能夠同時生成視頻和聲音(包括對話)。它還更擅長理解較長的提示,并能正確處理提示中的一系列事件。
Veo 2將提供相機控制和物體移除等工具。而谷歌新的圖像生成模型Imagen 4提高了質(zhì)量,能以更多格式導(dǎo)出,并且顯然更擅長生成真實文本,而不是經(jīng)常出現(xiàn)在此類圖像中的AI亂碼。
Flow近日在美國面向訂閱谷歌新的Google AI Pro和Google AI Ultra計劃的用戶推出。一篇博客文章稱:“Google AI Pro為用戶提供Flow的關(guān)鍵功能,每月可生成100次內(nèi)容,而Google AI Ultra提供最高使用限制,并讓用戶能夠提前使用自帶音頻生成功能的Veo 3(https://blog.google/technology/ai/google-flow-veo-ai-filmmaking-tool/)。”

微信號|IEEE電氣電子工程師學(xué)會
新浪微博|IEEE中國
Bilibili | IEEE中國
· IEEE電氣電子工程師學(xué)會 ·
往
期
推
薦
人工智能不會取代你,它將改變你的工作
時時在線的家教對全球?qū)W習(xí)者意味著什么?
自閉癥篩查是兒科人工智能的試驗場
軌道上的溫室氣體獵手