OpenAI, 인상 적인 AI 텍스트 대 동영상 모델 '소라' 발표, 현실적인 장면 애니메이션 생성

OpenAI, 인상 적인 AI 텍스트 대 동영상 모델 ‘소라’ 발표, 현실적인 장면 애니메이션 생성

OpenAI의 최근 AI 벤처는 지금까지 가장 인상적인 것일 수 있습니다. “소라”라는 이름의 이 새로운 텍스트-비디오 AI 모델은 테스트할 수 있는 제한된 수의 사용자에게 문을 열었습니다. 이 회사는 전적으로 AI가 만든 여러 비디오를 보여주며 출시했고, 최종 결과는 충격적으로 사실적입니다.

OpenAI는 Sora를 소개하면서 텍스트 프롬프트를 기반으로 현실적인 장면을 만들 수 있다고 말하며, 웹사이트에 공유된 비디오가 이를 증명합니다. 프롬프트는 설명적이지만 짧습니다. 저는 개인적으로 ChatGPT와 상호 작용하는 데 더 긴 프롬프트를 사용했습니다. 예를 들어, 위에 있는 털북숭이 매머드 비디오를 생성하기 위해 Sora는 동물, 주변 환경 및 카메라 배치를 설명하는 67단어 프롬프트가 필요했습니다.

텍스트-비디오 모델인 Sora를 소개합니다.

소라는 매우 세부적인 장면, 복잡한 카메라 동작, 생생한 감정을 지닌 여러 캐릭터가 등장하는 최대 60초 분량의 영상을 제작할 수 있습니다. https://t.co/7j2JN27M3W

프롬프트: “아름다운, 눈 덮인… pic.twitter.com/ruTEWn87vf

— OpenAI (@OpenAI) 2024년 2월 15일

OpenAI는 “Sora는 시각적 품질을 유지하고 사용자의 지시를 준수하면서 최대 1분 길이의 비디오를 생성할 수 있습니다.”라고 밝혔습니다. 발표. AI는 많은 캐릭터, 풍경, 정확한 동작으로 가득 찬 복잡한 장면을 생성할 수 있습니다. 이를 위해 OpenAI는 Sora가 필요에 따라 줄 사이를 예측하고 읽는다고 말합니다.

OpenAI는 “이 모델은 사용자가 프롬프트에서 요청한 내용뿐만 아니라 그러한 것들이 물리적 세계에 어떻게 존재하는지도 이해합니다.”라고 말했습니다. 이 모델은 캐릭터, 옷, 배경을 다루는 데 그치지 않고 “생생한 감정을 표현하는 매력적인 캐릭터”도 만듭니다.

소라는 기존 비디오의 빈 공간을 채우거나 비디오 길이를 늘릴 수 있고, 이미지를 기반으로 비디오를 생성할 수도 있으므로 단순히 텍스트로만 구성된 프롬프트가 아닙니다.

비디오는 스크린샷 스틸로 보기에는 좋지만, 동작은 정신을 날려버릴 정도입니다. OpenAI는 사이버펑크풍 도쿄 거리와 골드 러시 당시 캘리포니아의 “역사적 영상”을 포함하여 새로운 기술을 보여주는 다양한 비디오를 제공했습니다. 또한 인간의 눈을 극도로 클로즈업한 장면도 있습니다. 프롬프트는 만화에서 야생 동물 사진까지 모든 것을 포함합니다.

소라는 여전히 몇 가지 실수를 했습니다. 자세히 살펴보면, 예를 들어 군중 속의 일부 인물은 머리가 없거나 이상하게 움직입니다. 어색한 움직임은 일부 샘플에서 처음 보기에 두드러졌지만, 전반적인 이상함은 여러 번 봐야 알아낼 수 있었습니다.

OpenAI가 Sora를 일반 대중에게 공개하기까지는 시간이 좀 걸릴 수 있습니다. 지금은 잠재적 위험을 평가할 레드팀이 모델을 테스트할 예정입니다. 일부 제작자도 아직 개발 초기 단계이기는 하지만 지금 테스트를 시작할 수 있습니다.

AI는 아직 불완전하기 때문에, 저는 꽤 지저분한 것을 기대하며 들어갔습니다. 기대치가 낮았든, 소라의 역량이 좋았든, 저는 감명을 받았지만, 약간 걱정되기도 했습니다. 우리는 이미 가짜와 진짜를 구별하기 어려운 세상에 살고 있으며, 이제 이미지뿐만 아니라 비디오도 위험에 처해 있습니다. 그러나 소라는 피카와 같이 우리가 본 최초의 텍스트-비디오 모델은 아닙니다.

다른 사람들도 깃발을 게양하고 있습니다. 인기 있는 기술 유튜버, Marques Brownlee소라 영상에 대한 반응으로 “이것이 당신에게 조금이라도 문제가 되지 않는다면, 아무것도 문제가 되지 않을 것입니다”라고 트윗했습니다.

이 비디오는 모두 AI가 생성한 것이며 이것이 당신에게 조금이라도 문제가 되지 않는다면 아무것도 문제가 되지 않을 것입니다.

최신 모델: https://t.co/zkDWU8Be9S

(윌 스미스가 스파게티를 먹는 걸 기억하시나요? 질문이 너무 많아요) pic.twitter.com/TQ44wvNlQw

— 마르케스 브라운리 (@MKBHD) 2024년 2월 15일

OpenAI의 Sora가 지금 이렇게 좋다면, 몇 년 동안 더 개발하고 테스트한 후에는 어떤 일을 할 수 있을지 상상하기 어렵습니다. 이런 종류의 기술은 많은 일자리를 대체할 잠재력이 있지만, ChatGPT처럼 인간 전문가와 공존하기를 바랍니다.

우리의 활동을 지원해주세요 ❤️

이 글이 마음에 드셨다면, 앞으로도 좋은 콘텐츠를 계속 발행할 수 있도록 팁을 남겨주세요.

페이팔로 안전하게 결제
관련 항목:  토키: 1930년 이전 데이터로 학습된 빈티지 LLM – 제2차 세계 대전을 예측할 수 있을까?
Moyens I/O Staff는 당신에게 도움이 될 기술, 개인 개발, 라이프스타일 및 전략에 대한 팁을 제공하여 당신에게 동기를 부여했습니다.