GNIT 북미, 텍스트-비디오 모델 AI에 대한 온라인 토론 개최

2026년 1월 3일

Online discussion on text-to-video AI models

1월 2일, GNIT 북미 회원들은 OpenAI의 Sora를 위한 텍스트-비디오 모델 AI에 대해 특별히 논의했습니다. OpenAI는 생성 인공지능의 주요 발전을 의미하는 새로운 텍스트-비디오 AI를 공개했습니다. 이전 모델을 바탕으로 이 AI는 향상된 사실성, 개선된 창의적 제어 및 통합된 오디오 기능을 제공하여 창작자와 개발자에게 강력한 도구가 됩니다. 이 시스템은 텍스트 프롬프트를 기반으로 짧은 비디오 클립을 생성하며, 서술된 내용을 사실적인 움직임, 정확한 물리학 및 동기화된 오디오(대화 및 음향 효과 포함)로 변환하여 고품질 비디오 콘텐츠를 만듭니다.

눈에 띄는 기능 중 하나는 사용자가 얼굴 스캔 및 음성 샘플링을 통해 자신의 디지털 초상화를 비디오에 삽입할 수 있는 능력으로, 독특하고 개인화된 경험을 제공합니다. 이 모델은 영화적이고 포토 리얼리스틱한 스타일에서 애니메이션 및 초현실적인 스타일에 이르기까지 다양한 창작 스타일을 지원하여 사용자에게 폭넓은 이야기 전개를 위한 캔버스를 제공합니다.

모델과 함께 현재 미국과 캐나다에서 초대 전용 시스템으로 iOS에서 사용할 수 있는 소셜 앱이 있습니다. 이 앱은 사용자가 AI 생성 비디오를 만들고, 공유하며 탐색할 수 있는 TikTok 스타일의 플랫폼으로 기능합니다. 또한 사용자가 자신의 디지털 초상화를 사용할 수 있는 사람을 관리할 수 있는 개인 정보 보호 통제를 포함하여, 새로운 콘텐츠에 자신의 이미지나 목소리가 포함될 때 알림을 받을 수 있습니다.

그 기능에도 불구하고, 이 AI는 특히 사칭 및 딥페이크 콘텐츠와 관련하여 윤리적 고려 사항을 제기합니다. OpenAI는 명시적, 폭력적, 극단적인 또는 자해 관련 콘텐츠에 대한 제한을 포함한 오용 방지를 위한 안전 장치를 구현했습니다. 그러나 콘텐츠 검열에는 여전히 도전 과제가 남아 있으며, 오용 사례가 보고되어 신중한 감독의 지속적인 필요성을 부각시키고 있습니다.

현재 이 AI는 ChatGPT Plus 및 Pro 사용자에게 접근 가능하며, 가까운 미래에 API를 통해 더 넓게 제공될 예정입니다. 동반 앱은 OpenAI가 모델과 응용 프로그램 모두를 지속적으로 개선하는 가운데 점진적으로 더 많은 iOS 사용자에게 확장되고 있습니다. 전반적으로, 이 새로운 AI는 사실성, 개인화 및 창의적 유연성을 결합하여 여러 산업에서 콘텐츠 제작을 혁신할 수 있는 잠재력을 지닌 텍스트-비디오 기술의 중요한 도약을 나타냅니다.

GNIT 북미 · 원문 게재: gnit.org.