GNIT北美舉行文本轉視頻模型AI的線上討論
2026年1月3日

在1月2日,GNIT北美的成員專門討論了OpenAI的Sora文本轉視頻模型AI。OpenAI推出了一種新的文本轉視頻AI,標誌著生成人工智能的一次重大進步。在早期模型的基礎上,這款AI提供了增強的現實感、改進的創造控制以及集成的音頻功能,使其成為創作者和開發者的一個強大工具。該系統根據文本提示生成短視頻片段,將書面描述轉化為高品質的視頻內容,具有生動的運動、準確的物理效果和同步的音頻,包括對話和音效。
一個顯著的特點是用戶可以通過面部掃描和聲音取樣將自己的數位形象插入視頻,提供獨特而個性化的體驗。該模型還支持多種創意風格,從電影式和照片寫實到動畫和超現實,為用戶提供了廣泛的故事講述畫布。
隨著模型的推出,同時還有一款社交應用程序,目前在美國和加拿大以邀請制的方式在iOS上提供。該應用程序的功能類似於TikTok式的平台,用戶可以創建、分享和探索AI生成的視頻。它還包括隱私控制,允許用戶管理誰可以使用他們的數位形象,並在他們的形象或聲音被融入到新內容中時收到通知。
儘管具備這些功能,該AI仍然引發了倫理考慮,尤其是在冒充和深偽內容方面。OpenAI已實施防範措施以防止濫用,包括對露骨、暴力、極端或自我傷害相關內容的限制。然而,內容審核仍然面臨挑戰,并且已報導出濫用案例,突顯了持續需要謹慎監督的必要性。
該AI目前對ChatGPT Plus和Pro用戶開放,計劃通過API在不久的將來進一步擴展可用性。隨著OpenAI繼續改進模型及其應用,伴隨應用程序正在逐步擴展至更多iOS用戶,平衡創新與負責任的使用。總體而言,這款新的AI代表了文本轉視頻技術的一次重大飛躍,結合現實感、個性化和創意靈活性,具有潛力轉變多個行業的內容創作。
GNIT北美 · originally published on gnit.org.