검색결과 총 5건
-
알리바바 'Wan3.0' 베타 공개…AI 영상 생성, 짧은 클립 넘어 제작 도구로
[경제일보] 알리바바가 생성형 인공지능(AI) 영상 생성 모델의 한계를 길이와 입력 방식 측면에서 동시에 넓히고 있다. 최대 30초 영상 생성에 텍스트뿐 아니라 이미지·영상·오디오, 웹페이지와 문서까지 참조할 수 있도록 기능을 확장하면서 단순한 영상 제작 도구를 넘어 콘텐츠 제작 전반을 자동화하는 방향으로 기술 고도화에 나섰다. 11일 알리바바는 영상 생성 모델 'Wan3.0' 베타 버전을 공개하고 공개 베타 테스트를 시작했다고 밝혔다. 사용자는 알리바바 클라우드의 AI 개발 플랫폼 '모델스튜디오'와 AI 네이티브 클라우드 플랫폼 'Qwen 클라우드'를 통해 테스트를 신청할 수 있다. Wan3.0의 가장 큰 변화는 생성할 수 있는 영상의 길이다. 기존 AI 영상 생성 모델이 수초에서 최대 15초 안팎의 짧은 영상을 만드는 데 초점을 맞췄다면 Wan3.0은 클립 하나를 최대 30초까지 생성할 수 있도록 했다. 알리바바의 이전 모델인 Wan2.7-Video가 지원했던 최대 15초와 비교하면 생성 가능한 영상 길이가 두 배로 늘었다. 영상 길이가 길어지면서 AI 영상 제작의 활용 범위도 넓어질 것으로 전망된다. 짧은 장면 하나를 만드는 데 그치지 않고 인물의 움직임이나 카메라 이동이 이어지는 장면을 하나의 클립으로 구성할 수 있기 때문이다. 알리바바는 사용자가 입력한 프롬프트를 분석해 적절한 영상 길이를 추천하는 기능과 기존 영상의 시간적 흐름을 이어 영상을 확장하는 기능도 Wan3.0에 적용했다. 단순히 영상 생성 시간을 늘리는 것만으로는 실제 콘텐츠 제작에 활용하기 어렵다는 점에서 입력 방식도 확대했다. Wan3.0은 텍스트와 이미지뿐 아니라 영상과 오디오를 함께 참조할 수 있으며 웹페이지, PDF, 파워포인트 프레젠테이션 등 문서 자료도 영상 제작을 위한 입력 자료로 활용할 수 있다. 예를 들어 기업이 제품 소개 자료나 프레젠테이션을 보유하고 있다면 이를 기반으로 마케팅 영상을 만들 수 있고, 교육 기관은 문서 형태의 교육 자료를 영상 콘텐츠로 전환할 수 있다. 영상 제작자가 기존 촬영본이나 이미지, 음성 자료를 제공해 새로운 장면을 구성하는 방식도 가능하다. AI 영상 생성 시장의 경쟁이 단순히 '얼마나 그럴듯한 영상을 만드는가'에서 '사용자가 가진 자료를 얼마나 정확하게 영상으로 전환할 수 있는가'로 이동하고 있다는 점도 주목된다. 영상 제작 과정에서는 새로운 이미지를 만들어내는 것보다 기존 캐릭터나 제품, 브랜드의 특징을 유지하면서 여러 장면을 연결하는 것이 중요한 경우가 많기 때문이다. Wan3.0은 이 같은 문제를 해결하기 위해 시각적 일관성 확보에도 초점을 맞췄다. AI 영상에서 반복적으로 지적돼온 인물의 얼굴이나 의상, 소품 등이 장면마다 달라지는 현상을 줄이고 참조 자료에 포함된 캐릭터와 제품의 세부적인 특징을 유지하도록 설계했다. 화면 구성과 음성의 일관성도 주요 기능으로 제시됐다. 알리바바는 인물의 표정과 움직임을 자연스럽게 표현하고 다국어 음성을 생성하는 동시에 소프트웨어 사용자 인터페이스(UI)와 모션 그래픽 등 상대적으로 구현하기 까다로운 요소도 안정적으로 생성할 수 있다고 설명했다. 알리바바가 영상 생성 모델을 지속적으로 고도화하는 것은 생성형 AI 경쟁의 무게중심이 텍스트와 이미지에서 영상으로 이동하고 있기 때문이다. 영상은 텍스트나 이미지보다 생성에 필요한 연산량이 많고 시간적 일관성까지 유지해야 하는 만큼 AI 모델의 기술 수준을 가늠하는 분야로 꼽힌다. 특히 글로벌 빅테크와 AI 기업들이 영상 생성 모델의 품질과 길이, 입력 방식 등을 경쟁적으로 개선하면서 영상 생성 AI의 활용 범위도 점차 전문 콘텐츠 제작 영역으로 확대되고 있다. 짧은 영상을 단순히 만들어주는 수준을 넘어 기존 콘텐츠를 분석하고 새로운 영상으로 재구성하는 제작 도구로 발전하고 있는 것이다. 알리바바 역시 Wan 시리즈를 통해 이 시장을 공략하고 있다. Wan 시리즈는 2023년 7월 처음 공개된 이후 이미지와 영상 생성 기능을 지속적으로 고도화해왔다. Wan3.0에서는 영상 길이를 늘리는 동시에 멀티모달 참조 입력과 시각적 일관성 강화에 집중하면서 실제 제작 환경에서의 활용성을 높이는 데 초점을 맞췄다. AI 영상 생성 시장에서도 앞으로는 생성 품질뿐 아니라 기존 제작 과정에 얼마나 자연스럽게 편입될 수 있는지가 경쟁력을 좌우할 전망이다. 알리바바가 Wan3.0을 통해 영상 생성 시간을 늘리고 참조 입력 범위를 확대한 것도 이 같은 제작 환경의 변화를 겨냥한 것으로 풀이된다. 알리바바 관계자는 "'Wan3.0'은 영화 제작자의 제작 과정 효율화, 숏폼 드라마와 소셜 미디어 콘텐츠 제작, 기업의 텍스트·이미지 기반 마케팅 및 교육 영상 제작을 지원하는 등 다양한 산업 영역에서 활용될 수 있도록 설계됐다"며 "또한 자율주행차와 로보틱스 시스템 학습에 필요한 사실적인 시뮬레이션 영상을 생성할 수 있어 기술 개발자에게도 유용한 도구로 활용될 수 있다"고 말했다.
2026-08-11 11:25:24
-
-
-
카톡에서 바로 묻고 답한다…카카오, 카톡에 챗GPT 챗봇 도입
[경제일보] 카카오가 카카오톡 채팅방 안에서 바로 생성형 인공지능(AI)을 활용할 수 있는 '챗GPT 챗봇' 기능을 도입했다. 별도 애플리케이션이나 웹사이트 이동 없이 카카오톡 대화창에서 실시간으로 AI와 소통할 수 있게 되면서 AI 서비스의 대중화가 한층 가속화될 전망이다. 16일 카카오는 카카오톡 채팅방에서 사용할 수 있는 '챗GPT 챗봇' 기능을 새롭게 선보인다고 밝혔다. 이용자는 그룹 채팅방과 1대1 채팅방 등에서 챗GPT를 대화 참여자로 추가한 뒤 질문을 입력하면 즉시 답변을 받을 수 있다. 이번 기능은 카카오가 지난해 오픈AI와 협력해 선보인 '챗GPT 포 카카오' 서비스를 카카오톡 이용 환경 안으로 확장한 것이다. AI 서비스를 별도 플랫폼이 아닌 국민 메신저 카카오톡 안에 자연스럽게 녹여내며 이용자 접점을 확대하려는 전략으로 풀이된다. 이용자는 채팅방 우측 상단 메뉴에서 '챗봇'을 선택해 챗GPT 챗봇을 추가한 뒤 입력창에 '@ChatGPT'를 입력하고 원하는 질문이나 명령어를 작성하면 챗GPT를 사용할 수 있다. 입력창 하단 키보드 툴바에 새롭게 추가된 'ChatGPT' 버튼을 통해서도 이용할 수 있다. 예를 들어 "@ChatGPT 오늘 날씨 알려줘", "@ChatGPT 회의 내용을 요약해줘", "@ChatGPT 생일 축하 문구 작성해줘"와 같은 요청을 입력하면 챗GPT가 채팅방 안에서 실시간으로 답변을 제공한다. 카카오는 단순 질의응답뿐 아니라 이미지 생성 기능도 지원한다. 이용자가 "@ChatGPT 바다 풍경 그려줘"와 같이 요청하면 생성형 AI를 활용해 이미지 결과물을 제공한다. 현재 프롬프트 입력은 텍스트 방식으로 지원된다. 특히 단체 채팅방에서 AI를 공동으로 활용할 수 있다는 것이 특징이다. 가족, 친구, 동료 등이 함께 있는 대화방에서 일정 조율, 여행 계획 수립, 문서 작성, 아이디어 회의 등을 진행할 때 AI를 공동 비서처럼 활용할 수 있도록 설계됐다. 카카오는 이용 편의성을 높이기 위해 입력창 상단에 '뉴스', '운세', '인기 질문' 등 자주 사용하는 명령어도 배치했다. 또한 챗봇이 답변할 때 질문자를 직접 멘션하도록 설계해 여러 명이 참여하는 대화방에서도 답변 대상을 명확하게 구분할 수 있도록 구성했다. 채팅방에서 제공되는 답변 이후 보다 심층적인 대화를 원할 경우에는 답변 말풍선 하단의 '자세히 보기'를 통해 '챗GPT 포 카카오' 서비스로 연결된다. 이를 통해 연속적인 대화와 추가 질문도 가능하다. 카카오는 이번 기능 도입으로 생성형 AI 서비스를 별도 애플리케이션이 아닌 카카오톡 대화 환경 안으로 확장하게 됐다. 이용자는 채팅방 내에서 실시간으로 질문과 답변을 주고받을 수 있으며, 필요할 경우 '챗GPT 포 카카오' 서비스로 이동해 보다 심화된 대화를 이어갈 수 있다. 카카오는 지난해 오픈AI와 협력해 '챗GPT for 카카오'를 선보인 이후 카카오톡 기반 AI 서비스 확대에 나서고 있다. 지난 5월 기준 누적 가입자는 1100만명을 넘어섰으며, 카카오는 자사 서비스와 외부 서비스를 연결하는 AI 에이전트 플랫폼 '카카오툴즈'도 고도화하고 있다. 유용하 카카오 AI 커넥트 성과리더는 "챗봇 기능을 통해 이용자들이 카카오톡으로 대화하며 더욱 쉽고 유용하게 AI를 활용할 수 있게 됐다"며 "카카오톡과 AI의 유기적인 결합을 통해 일상 속 AI 대중화를 이끌어 나갈 것"이라고 말했다.
2026-06-16 15:34:52
-
AI도 한국 문화 맞춤 검증…KT, AI 안전성 벤치마크 'KSAFE-MM' 공개
[경제일보] KT가 한국 사회와 문화적 특성을 반영한 멀티모달 인공지능(AI) 안전성 평가 체계를 공개했다. 생성형 AI 확산으로 텍스트를 넘어 이미지와 음성까지 동시에 이해하는 멀티모달 AI 활용이 늘어나는 가운데 국내 환경에 맞는 안전성 검증 기준을 마련해 AI 신뢰성 확보에 나서겠다는 전략으로 풀이된다. 16일 KT는 고려대학교와 공동으로 개발한 멀티모달 대형언어모델(MLLM) 안전성 벤치마크 'KSAFE-MM'을 공개했다고 밝혔다. 최근 생성형 AI 시장은 텍스트 중심 서비스에서 이미지와 음성, 영상까지 통합적으로 처리하는 멀티모달 AI 중심으로 빠르게 진화하고 있다. 다만 AI 모델의 활용 범위가 확대될수록 허위정보 생성, 편향성, 유해 콘텐츠 노출, 개인정보 침해 등 안전성 이슈 역시 함께 커지고 있는 것으로 알려졌다. 특히 글로벌 AI 기업들이 개발한 안전성 평가 기준은 영어권 문화와 사회 환경을 중심으로 설계돼 국내 이용 환경과 문화적 특수성을 충분히 반영하지 못한다는 한계도 제기돼 왔다. 이에 KT와 고려대는 해당 문제를 해결하기 위해 'KSAFE-MM'을 공동 개발했다고 설명했다. 'KSAFE-MM'은 한국 사회의 문화적·사회적 맥락을 반영한 멀티모달 AI 안전성 평가 체계로, 글로벌 공통 위험 요소를 한국 문화 환경에 맞게 재구성한 'KSAFE-MM-G'와 전세 사기, 독도 분쟁 등 국내 특수 이슈를 반영한 'KSAFE-MM-C'로 구성된다. 전체 평가 데이터는 총 1만4135개 샘플 규모다. 연구진은 해당 벤치마크를 활용해 구글의 '젬마'와 네이버의 '하이퍼클로바 X'를 비롯한 12개 글로벌 멀티모달 AI 모델의 안전성을 검증했다. 이번 연구의 가장 큰 특징은 벤치마크 구축 과정을 자동화한 것이다. 기존 AI 안전성 벤치마크는 전문가가 데이터를 수집하고 검수하는 방식이 대부분으로 많은 비용과 시간이 필요했다. 반면 KSAFE-MM은 현지 커뮤니티 기반 민감 주제 수집, 템플릿 기반 질의 생성, 합성 이미지 제작, 탈옥 질의 생성까지 전 과정을 자동화한 4단계 파이프라인을 구축했다. KT와 고려대 연구진은 동일한 파이프라인을 일본어 환경에 적용한 파일럿 프로젝트 'JSAFE-MM-C'도 진행했다. 연구진은 이를 통해 해당 프레임워크가 한국뿐 아니라 다양한 국가와 문화권에서도 활용 가능한 범용 안전성 평가 체계임을 확인했다고 설명했다. 업계에서는 생성형 AI 규제 논의가 본격화되는 가운데 AI 안전성 평가 체계의 중요성이 더욱 커질 것으로 전망하고 있다. 특히 기업들은 AI 서비스 출시 전 위험 요소를 점검하는 레드팀 테스트와 가드레일 모델 검증 수요가 늘어나고 있어 실질적인 활용도가 높을 것으로 분석된다. KT는 이번 연구 결과를 실제 AI 서비스 안전성 검증과 모델 평가, 위험 분석 등에 활용할 계획이다. 연구 결과와 벤치마크 데이터는 '아카이브'와 '허깅페이스'를 통해 공개돼 학계와 산업계가 자유롭게 활용할 수 있다. KT는 최근 다국어 AI 안전성 벤치마크 'XL-세이프티벤치'를 공개한 데 이어 KSAFE-MM을 선보이며 한국형 AI 안전성 평가 체계 구축을 확대하고 있다. KT는 책임 있는 AI 전담 조직을 중심으로 안전성 분류 체계와 평가 로직 개발 등 관련 연구를 지속 추진한다는 방침이다. 박재형 KT AX미래기술원 프론티어 AI Lab장 상무는 "안전성 벤치마크의 공개는 단순한 데이터 배포를 넘어 AI 안전성 연구 생태계 전반이 함께 발전할 수 있는 기반을 만드는 일"이라며 "KSAFE-MM이 학계와 산업계에서 한국어·한국 문화 맥락의 AI 안전성을 검증하는 공통 기준으로 자리잡길 기대한다"고 말했다.
2026-06-16 14:07:30