검색결과 총 2건
-
알리바바 'Wan3.0' 베타 공개…AI 영상 생성, 짧은 클립 넘어 제작 도구로
[경제일보] 알리바바가 생성형 인공지능(AI) 영상 생성 모델의 한계를 길이와 입력 방식 측면에서 동시에 넓히고 있다. 최대 30초 영상 생성에 텍스트뿐 아니라 이미지·영상·오디오, 웹페이지와 문서까지 참조할 수 있도록 기능을 확장하면서 단순한 영상 제작 도구를 넘어 콘텐츠 제작 전반을 자동화하는 방향으로 기술 고도화에 나섰다. 11일 알리바바는 영상 생성 모델 'Wan3.0' 베타 버전을 공개하고 공개 베타 테스트를 시작했다고 밝혔다. 사용자는 알리바바 클라우드의 AI 개발 플랫폼 '모델스튜디오'와 AI 네이티브 클라우드 플랫폼 'Qwen 클라우드'를 통해 테스트를 신청할 수 있다. Wan3.0의 가장 큰 변화는 생성할 수 있는 영상의 길이다. 기존 AI 영상 생성 모델이 수초에서 최대 15초 안팎의 짧은 영상을 만드는 데 초점을 맞췄다면 Wan3.0은 클립 하나를 최대 30초까지 생성할 수 있도록 했다. 알리바바의 이전 모델인 Wan2.7-Video가 지원했던 최대 15초와 비교하면 생성 가능한 영상 길이가 두 배로 늘었다. 영상 길이가 길어지면서 AI 영상 제작의 활용 범위도 넓어질 것으로 전망된다. 짧은 장면 하나를 만드는 데 그치지 않고 인물의 움직임이나 카메라 이동이 이어지는 장면을 하나의 클립으로 구성할 수 있기 때문이다. 알리바바는 사용자가 입력한 프롬프트를 분석해 적절한 영상 길이를 추천하는 기능과 기존 영상의 시간적 흐름을 이어 영상을 확장하는 기능도 Wan3.0에 적용했다. 단순히 영상 생성 시간을 늘리는 것만으로는 실제 콘텐츠 제작에 활용하기 어렵다는 점에서 입력 방식도 확대했다. Wan3.0은 텍스트와 이미지뿐 아니라 영상과 오디오를 함께 참조할 수 있으며 웹페이지, PDF, 파워포인트 프레젠테이션 등 문서 자료도 영상 제작을 위한 입력 자료로 활용할 수 있다. 예를 들어 기업이 제품 소개 자료나 프레젠테이션을 보유하고 있다면 이를 기반으로 마케팅 영상을 만들 수 있고, 교육 기관은 문서 형태의 교육 자료를 영상 콘텐츠로 전환할 수 있다. 영상 제작자가 기존 촬영본이나 이미지, 음성 자료를 제공해 새로운 장면을 구성하는 방식도 가능하다. AI 영상 생성 시장의 경쟁이 단순히 '얼마나 그럴듯한 영상을 만드는가'에서 '사용자가 가진 자료를 얼마나 정확하게 영상으로 전환할 수 있는가'로 이동하고 있다는 점도 주목된다. 영상 제작 과정에서는 새로운 이미지를 만들어내는 것보다 기존 캐릭터나 제품, 브랜드의 특징을 유지하면서 여러 장면을 연결하는 것이 중요한 경우가 많기 때문이다. Wan3.0은 이 같은 문제를 해결하기 위해 시각적 일관성 확보에도 초점을 맞췄다. AI 영상에서 반복적으로 지적돼온 인물의 얼굴이나 의상, 소품 등이 장면마다 달라지는 현상을 줄이고 참조 자료에 포함된 캐릭터와 제품의 세부적인 특징을 유지하도록 설계했다. 화면 구성과 음성의 일관성도 주요 기능으로 제시됐다. 알리바바는 인물의 표정과 움직임을 자연스럽게 표현하고 다국어 음성을 생성하는 동시에 소프트웨어 사용자 인터페이스(UI)와 모션 그래픽 등 상대적으로 구현하기 까다로운 요소도 안정적으로 생성할 수 있다고 설명했다. 알리바바가 영상 생성 모델을 지속적으로 고도화하는 것은 생성형 AI 경쟁의 무게중심이 텍스트와 이미지에서 영상으로 이동하고 있기 때문이다. 영상은 텍스트나 이미지보다 생성에 필요한 연산량이 많고 시간적 일관성까지 유지해야 하는 만큼 AI 모델의 기술 수준을 가늠하는 분야로 꼽힌다. 특히 글로벌 빅테크와 AI 기업들이 영상 생성 모델의 품질과 길이, 입력 방식 등을 경쟁적으로 개선하면서 영상 생성 AI의 활용 범위도 점차 전문 콘텐츠 제작 영역으로 확대되고 있다. 짧은 영상을 단순히 만들어주는 수준을 넘어 기존 콘텐츠를 분석하고 새로운 영상으로 재구성하는 제작 도구로 발전하고 있는 것이다. 알리바바 역시 Wan 시리즈를 통해 이 시장을 공략하고 있다. Wan 시리즈는 2023년 7월 처음 공개된 이후 이미지와 영상 생성 기능을 지속적으로 고도화해왔다. Wan3.0에서는 영상 길이를 늘리는 동시에 멀티모달 참조 입력과 시각적 일관성 강화에 집중하면서 실제 제작 환경에서의 활용성을 높이는 데 초점을 맞췄다. AI 영상 생성 시장에서도 앞으로는 생성 품질뿐 아니라 기존 제작 과정에 얼마나 자연스럽게 편입될 수 있는지가 경쟁력을 좌우할 전망이다. 알리바바가 Wan3.0을 통해 영상 생성 시간을 늘리고 참조 입력 범위를 확대한 것도 이 같은 제작 환경의 변화를 겨냥한 것으로 풀이된다. 알리바바 관계자는 "'Wan3.0'은 영화 제작자의 제작 과정 효율화, 숏폼 드라마와 소셜 미디어 콘텐츠 제작, 기업의 텍스트·이미지 기반 마케팅 및 교육 영상 제작을 지원하는 등 다양한 산업 영역에서 활용될 수 있도록 설계됐다"며 "또한 자율주행차와 로보틱스 시스템 학습에 필요한 사실적인 시뮬레이션 영상을 생성할 수 있어 기술 개발자에게도 유용한 도구로 활용될 수 있다"고 말했다.
2026-08-11 11:25:24
-
SKT, AI로 영상 속 사물 자연스럽게 합성…ECCV 2026 논문 채택
[경제일보] 생성형 인공지능(AI)을 활용한 영상 제작과 콘텐츠 후반 작업이 빠르게 확산되면서 영상 속 사물을 자연스럽게 합성하는 컴퓨터 비전 기술 경쟁도 치열해지고 있다. SK텔레콤은 세계 3대 컴퓨터 비전 학회에서 AI 영상 합성 기술력을 인정받는 동시에 해당 기술을 상용 서비스에도 적용하며 광고·미디어 분야 AI 사업 확대에 나선 것으로 풀이된다. 30일 SK텔레콤은 카이스트 주재걸 교수 연구팀과 공동 연구한 AI 영상 합성 기술 '인서트애니웨어' 관련 논문이 오는 9월 8일부터 12일까지 스웨덴 말뫼에서 열리는 '유럽 컴퓨터 비전 학회(ECCV) 2026'에 채택됐다고 밝혔다. ECCV는 컴퓨터 비전 및 패턴 인식 학회(CVPR), 국제 컴퓨터 비전 학회(ICCV)와 함께 세계 3대 컴퓨터 비전 학회로 꼽힌다. 인서트애니웨어는 기존 영상에 촬영 당시 존재하지 않았던 사물을 AI를 활용해 자연스럽게 삽입하는 기술이다. 광고 영상에 특정 제품을 추가하거나 촬영이 끝난 콘텐츠에 소품과 캐릭터, 브랜드 요소 등을 삽입하는 등 영상 후반 작업에 활용할 수 있도록 개발됐다. 기존 AI 영상 합성 기술은 카메라가 이동하거나 삽입한 사물이 다른 물체에 가려지는 상황에서 위치와 크기가 흔들리거나 실제로는 가려져야 할 사물이 화면에 그대로 노출되는 문제가 있는 것으로 알려졌다. 또한 사물 주변의 그림자와 반사, 조명 효과를 자연스럽게 구현하지 못해 합성한 흔적이 남는 한계도 지적돼 왔다. 이에 SK텔레콤과 카이스트 연구팀은 해당 문제를 해결하기 위해 영상 속 3차원 공간 구조에 시간 정보를 함께 반영하는 '4D 장면 이해' 기술을 적용했다. 사용자가 한 장면에서 원하는 위치를 지정하면 AI가 해당 위치 정보를 전체 영상으로 자동 확장해 카메라 이동이나 장면 변화에도 사물의 위치와 형태를 안정적으로 유지할 수 있도록 구현했다. 또한 AI를 활용해 삽입된 사물 주변의 그림자와 반사, 조명 효과까지 자연스럽게 생성해 실제 촬영한 영상과 유사한 결과물을 구현할 수 있도록 설계했다. SK텔레콤은 이를 통해 별도의 복잡한 후반 작업 없이도 고품질 영상 합성이 가능하다고 설명했다. 이번 연구는 원천 기술 확보에 그치지 않고 실제 서비스에도 적용됐다. SK텔레콤은 해당 기술을 광고·미디어 분야 기업 고객에게 제공 중인 가상 간접광고(VPPL) 솔루션 '애드플럭스'에 적용해 상용화했다. 애드플럭스는 기존 촬영 영상을 다시 제작하지 않고도 원하는 제품이나 브랜드 이미지를 영상에 자연스럽게 삽입할 수 있는 솔루션이다. 관련 기술에 대한 특허 출원도 완료했으며, '끝까지 간다 독박투어', '우리 지금 만나', '박장대소-부르면 언제든 콜' 등 방송 프로그램에도 적용된 바 있다. SK텔레콤은 이번 연구 성과를 계기로 광고와 방송을 비롯해 커머스, 콘텐츠 제작 등 다양한 분야로 AI 영상 합성 기술 적용 범위를 확대할 계획이다. 산학 공동 연구를 통해 확보한 컴퓨터 비전 원천 기술을 기반으로 기업 고객 대상 AI 미디어 솔루션 경쟁력을 지속 강화하고, 상용 서비스를 고도화해 AI 기반 콘텐츠 제작 시장 공략을 이어간다는 방침이다. 양승지 SK텔레콤 엔터프라이즈기술지원담당은 "이번 ECCV 2026 논문 채택은 SKT의 AI 영상 합성 기술이 세계적 무대에서 인정받은 성과"라며 "앞으로도 광고·미디어 분야에서 바로 활용할 수 있는 고품질 AI 영상 합성 기술을 지속 고도화해 나갈 것"이라고 말했다.
2026-06-30 08:44:42