Veo

Veo是由Google DeepMind開發的文字轉影片模型。與其他同類型模型一樣,Veo利用生成式人工智慧,根據使用者所輸入的提示生成影片。

發展
2024年5月,在Google I/O2024大會上,Google發布了一款名為Veo的影片生成模型。根據官方說法,該模型能夠生成超過一分鐘長的1080p 高畫質影片。

2025年4月,Google宣布Veo 2開始在Gemini上提供給進階使用者使用。同年5月,Google發布Veo 3,不僅能生成影片,亦可產生與畫面同步的音訊,包括對白、音效與環境音。

Veo 3的一項重要創新,在於能生成與影片高度契合的音樂與語音。Google DeepMind執行長傑米斯·哈薩比斯表示,此次發表標誌著 AI 影片生成正式走出「無聲電影時代」。另有評論指出,該模型在面對不同提示時,經常重複相同的笑點。

評論者推測Google可能使用YouTube影片或Reddit貼文作為模型訓練資料。不過Google官方未明確說明其訓練素材的來源。

參考資料
外部連結
*

评论 (0)

  • 还没有评论,来抢沙发吧。