검색결과 총 2건
-
알리바바, 칩부터 에이전트까지 'AI 풀스택'…2032년 데이터센터 20GW
[경제일보] 알리바바가 인공지능(AI) 모델을 넘어 반도체와 데이터센터, 클라우드, 에이전트까지 직접 아우르는 'AI 풀스택' 전략을 본격화한다. 자체 AI 칩과 데이터센터 인프라를 확대하는 동시에 차세대 Qwen 모델과 기업용 AI 에이전트 플랫폼을 내놓으며 AI 기술을 실제 서비스로 연결한다는 구상이다. 특히 글로벌 데이터센터 용량을 오는 2032년까지 20기가와트(GW) 이상으로 확대하겠다는 계획을 제시하며 AI 경쟁의 무게중심을 모델 성능에서 컴퓨팅 인프라와 에이전트 운영 환경으로 넓히고 있다. 22일 알리바바 그룹은 최근 진행된 연례 기술 행사 '압사라 컨퍼런스'에서 칩과 클라우드 인프라, 파운데이션 모델, 에이전트를 아우르는 AI 기술 로드맵을 공개했다고 밝혔다. 알리바바는 반도체 설계 부문 T-Head를 통해 AI 프로세서와 중앙처리장치(CPU)를 개발하고, 데이터센터와 네트워크·스토리지 인프라를 고도화한 뒤 자체 클라우드와 Qwen 모델, AI 에이전트 서비스를 연결하는 구조를 구축하고 있다. AI 서비스에 필요한 연산부터 모델, 데이터, 애플리케이션까지 기술 스택 전반을 확보하겠다는 전략이다. 에디 우 알리바바 그룹 최고경영자(CEO)는 글로벌 데이터센터 용량을 2032년까지 20GW를 넘어서는 수준으로 확대하겠다는 목표를 제시했다. AI가 기업 업무와 산업 전반으로 확산하면서 늘어나는 연산 수요에 대응하기 위해 데이터센터 인프라 투자를 지속한다는 계획이다. T-Head는 AI 학습과 추론을 지원하는 차세대 프로세서 'Zhenwu V900'도 공개했다. 전작 Zhenwu M890보다 3배 높은 성능을 제공하며 216GB GPU 메모리와 초당 1200GB의 칩 간 대역폭을 지원한다. FP8과 FP4 등 다양한 수치 정밀도를 지원하며, 양산 및 상용 출시는 내년 1분기로 예정됐다. T-Head는 Zhenwu AI 칩이 자동차, 금융, 대규모 언어 모델, 체화 AI, 에너지, 제조 등 다양한 분야에서 650곳이 넘는 고객사가 활용하고 있다고 밝혔다. 알리바바는 Zhenwu V900과 네트워크·스토리지 칩을 통합한 차세대 슈퍼노드 서버도 공개했으며 최대 50만장의 카드로 구성된 슈퍼노드 클러스터를 지원한다고 설명했다. 자체 CPU 로드맵도 공개했다. 알리바바는 내년 출시를 목표로 에이전틱 AI 작업에 최적화한 Yitian CPU를 개발하고 있으며, 2029년에는 독자 코어 기반의 Yitian 750을 선보이고 Yitian CPU와 Zhenwu AI 칩을 직접 연결할 계획이다. 모델 경쟁도 이어간다. 알리바바는 차세대 Qwen4를 현재 학습 중이며 Qwen4.5와 Qwen5로 이어지는 로드맵을 공개했다. 후속 모델은 5조~10조개 수준의 파라미터 규모로 확대될 것으로 예상했다. 특히 이번 행사에서는 AI 모델 자체보다 AI가 실제 기업 업무를 수행하도록 지원하는 '에이전틱 클라우드' 전략도 공개했다. 에이전틱 클라우드는 대규모 모델의 학습·추론을 담당하는 'AI 네이티브 클라우드', 기업용 에이전트의 배포·운영을 지원하는 '에이전트 네이티브 클라우드', 실시간 데이터와 장기 기억을 제공하는 '컨텍스트 엔진'으로 구성된다. 핵심 제품인 '에이전트 코어'는 AI 에이전트의 구축부터 실행·관리까지 지원하는 기업용 플랫폼이다. '에이전트 시큐리티 센터'를 통해 보안과 규정 준수를 관리하고, '에이전트 컨텍스트'는 기업의 문서와 업무 시스템, 채팅 기록, 멀티모달 데이터를 통합해 에이전트가 과거 작업과 조직 내 지식을 활용할 수 있도록 한다. 알리바바는 이를 통해 지식 기반 업무에서 토큰 사용량을 최대 67% 줄일 수 있다고 설명했다. AI를 활용해 AI를 개발하는 기술도 공개했다. Qwen3.8-Max가 한 달간 데이터 검증과 반복 실험, 오류 진단 등을 자동 수행하며 33차례의 개선 주기를 거쳤으며, 칩 설계 과정에서는 AI가 60시간 이상 자기 개선을 수행하고 전자설계자동화(EDA) 도구를 1만회 이상 호출했다고 밝혔다. 클라우드 인프라도 AI 활용에 맞춰 고도화한다. AI 모델 학습을 지원하는 클라우드 병렬 파일 스토리지(CPFS)는 초당 100TB의 처리량과 1억 IOPS를 제공하며, 자체 AI 네트워킹 아키텍처 HPN 8.0 Pro는 100페타비트(Pb) 대역폭과 800G급 네트워크 포트 13만개 이상을 지원한다. 알리바바는 이번 발표를 통해 AI 모델과 서비스를 개별적으로 개발하는 것을 넘어 컴퓨팅 인프라부터 클라우드, 데이터, 에이전트까지 하나의 생태계로 묶는 전략을 제시했다. 특히 20GW 이상의 데이터센터 확보와 자체 AI 칩·CPU 로드맵을 함께 제시하며 AI 수요 증가에 대응할 인프라 경쟁력 확보에도 무게를 싣고 있다. 조 차이 알리바바 그룹 회장은 "지난 몇 년간 AI는 기술이 무엇을 할 수 있는지에 대한 우리의 상상력을 끊임없이 넓혀 왔으며, AI는 발전 가능성이 무궁무진하고 실제 현장에 도입하고 활용 규모를 확대해 수천 개 산업 분야의 생산성을 높일 수 있다"며 "AI가 기술적 혁신을 넘어 실질적인 가치를 창출하도록 이끄는 것이 바로 '지능, 그 가능성을 넘어서'라는 주제의 진정한 의미"라고 말했다.
2026-09-22 14:58:44
-
알리바바 'Wan3.0' 베타 공개…AI 영상 생성, 짧은 클립 넘어 제작 도구로
[경제일보] 알리바바가 생성형 인공지능(AI) 영상 생성 모델의 한계를 길이와 입력 방식 측면에서 동시에 넓히고 있다. 최대 30초 영상 생성에 텍스트뿐 아니라 이미지·영상·오디오, 웹페이지와 문서까지 참조할 수 있도록 기능을 확장하면서 단순한 영상 제작 도구를 넘어 콘텐츠 제작 전반을 자동화하는 방향으로 기술 고도화에 나섰다. 11일 알리바바는 영상 생성 모델 'Wan3.0' 베타 버전을 공개하고 공개 베타 테스트를 시작했다고 밝혔다. 사용자는 알리바바 클라우드의 AI 개발 플랫폼 '모델스튜디오'와 AI 네이티브 클라우드 플랫폼 'Qwen 클라우드'를 통해 테스트를 신청할 수 있다. Wan3.0의 가장 큰 변화는 생성할 수 있는 영상의 길이다. 기존 AI 영상 생성 모델이 수초에서 최대 15초 안팎의 짧은 영상을 만드는 데 초점을 맞췄다면 Wan3.0은 클립 하나를 최대 30초까지 생성할 수 있도록 했다. 알리바바의 이전 모델인 Wan2.7-Video가 지원했던 최대 15초와 비교하면 생성 가능한 영상 길이가 두 배로 늘었다. 영상 길이가 길어지면서 AI 영상 제작의 활용 범위도 넓어질 것으로 전망된다. 짧은 장면 하나를 만드는 데 그치지 않고 인물의 움직임이나 카메라 이동이 이어지는 장면을 하나의 클립으로 구성할 수 있기 때문이다. 알리바바는 사용자가 입력한 프롬프트를 분석해 적절한 영상 길이를 추천하는 기능과 기존 영상의 시간적 흐름을 이어 영상을 확장하는 기능도 Wan3.0에 적용했다. 단순히 영상 생성 시간을 늘리는 것만으로는 실제 콘텐츠 제작에 활용하기 어렵다는 점에서 입력 방식도 확대했다. Wan3.0은 텍스트와 이미지뿐 아니라 영상과 오디오를 함께 참조할 수 있으며 웹페이지, PDF, 파워포인트 프레젠테이션 등 문서 자료도 영상 제작을 위한 입력 자료로 활용할 수 있다. 예를 들어 기업이 제품 소개 자료나 프레젠테이션을 보유하고 있다면 이를 기반으로 마케팅 영상을 만들 수 있고, 교육 기관은 문서 형태의 교육 자료를 영상 콘텐츠로 전환할 수 있다. 영상 제작자가 기존 촬영본이나 이미지, 음성 자료를 제공해 새로운 장면을 구성하는 방식도 가능하다. AI 영상 생성 시장의 경쟁이 단순히 '얼마나 그럴듯한 영상을 만드는가'에서 '사용자가 가진 자료를 얼마나 정확하게 영상으로 전환할 수 있는가'로 이동하고 있다는 점도 주목된다. 영상 제작 과정에서는 새로운 이미지를 만들어내는 것보다 기존 캐릭터나 제품, 브랜드의 특징을 유지하면서 여러 장면을 연결하는 것이 중요한 경우가 많기 때문이다. Wan3.0은 이 같은 문제를 해결하기 위해 시각적 일관성 확보에도 초점을 맞췄다. AI 영상에서 반복적으로 지적돼온 인물의 얼굴이나 의상, 소품 등이 장면마다 달라지는 현상을 줄이고 참조 자료에 포함된 캐릭터와 제품의 세부적인 특징을 유지하도록 설계했다. 화면 구성과 음성의 일관성도 주요 기능으로 제시됐다. 알리바바는 인물의 표정과 움직임을 자연스럽게 표현하고 다국어 음성을 생성하는 동시에 소프트웨어 사용자 인터페이스(UI)와 모션 그래픽 등 상대적으로 구현하기 까다로운 요소도 안정적으로 생성할 수 있다고 설명했다. 알리바바가 영상 생성 모델을 지속적으로 고도화하는 것은 생성형 AI 경쟁의 무게중심이 텍스트와 이미지에서 영상으로 이동하고 있기 때문이다. 영상은 텍스트나 이미지보다 생성에 필요한 연산량이 많고 시간적 일관성까지 유지해야 하는 만큼 AI 모델의 기술 수준을 가늠하는 분야로 꼽힌다. 특히 글로벌 빅테크와 AI 기업들이 영상 생성 모델의 품질과 길이, 입력 방식 등을 경쟁적으로 개선하면서 영상 생성 AI의 활용 범위도 점차 전문 콘텐츠 제작 영역으로 확대되고 있다. 짧은 영상을 단순히 만들어주는 수준을 넘어 기존 콘텐츠를 분석하고 새로운 영상으로 재구성하는 제작 도구로 발전하고 있는 것이다. 알리바바 역시 Wan 시리즈를 통해 이 시장을 공략하고 있다. Wan 시리즈는 2023년 7월 처음 공개된 이후 이미지와 영상 생성 기능을 지속적으로 고도화해왔다. Wan3.0에서는 영상 길이를 늘리는 동시에 멀티모달 참조 입력과 시각적 일관성 강화에 집중하면서 실제 제작 환경에서의 활용성을 높이는 데 초점을 맞췄다. AI 영상 생성 시장에서도 앞으로는 생성 품질뿐 아니라 기존 제작 과정에 얼마나 자연스럽게 편입될 수 있는지가 경쟁력을 좌우할 전망이다. 알리바바가 Wan3.0을 통해 영상 생성 시간을 늘리고 참조 입력 범위를 확대한 것도 이 같은 제작 환경의 변화를 겨냥한 것으로 풀이된다. 알리바바 관계자는 "'Wan3.0'은 영화 제작자의 제작 과정 효율화, 숏폼 드라마와 소셜 미디어 콘텐츠 제작, 기업의 텍스트·이미지 기반 마케팅 및 교육 영상 제작을 지원하는 등 다양한 산업 영역에서 활용될 수 있도록 설계됐다"며 "또한 자율주행차와 로보틱스 시스템 학습에 필요한 사실적인 시뮬레이션 영상을 생성할 수 있어 기술 개발자에게도 유용한 도구로 활용될 수 있다"고 말했다.
2026-08-11 11:25:24