검색결과 총 5건
-
알리바바 클라우드, 韓 3호 데이터센터 가동…2호 개소 1년 만에 증설
[경제일보] 알리바바 클라우드가 한국에 세 번째 데이터센터를 구축하며 국내 인공지능(AI)·클라우드 시장 공략을 강화한다. 국내 데이터센터를 기존 2곳에서 3곳으로 늘려 서비스 안정성과 데이터 주권 대응력을 높이는 동시에 자체 AI 모델과 개발 플랫폼, 에이전트 도구를 앞세워 한국 기업의 AI 전환(AX) 시장까지 사업 영역을 확대한다는 전략이다. 18일 알리바바 클라우드는 서울 강남구 조선팰리스에서 기자 간담회를 열고 한국 시장에 대한 인프라 투자 확대와 AI 사업 전략을 공개했다. 윤용준 알리바바 클라우드 한국 총괄 지사장은 "지난해 에디 우 알리바바 그룹 CEO는 클라우드와 AI와 관련된 부분으로 향후 3년 동안 530억 달러를 투자하겠다는 공격적인 투자 계획을 발표했고, 오늘 세 번째 데이터센터의 런칭 역시 투자의 연장선상"이라며 "한국은 그 어떤 국가보다도 디지털 인프라 스트럭처나 AI와 관련된 인프라에 대한 수요가 높은 국가이기 때문에 이러한 시장의 수요를 반영하기 위해 지속적으로 AI와 관련된 인프라 투자를 확대할 생각"이라고 말했다. 앞서 알리바바 클라우드는 지난 2016년 한국 시장에 진출한 이후 2022년 첫 번째 데이터센터를 구축한 데 이어 2025년 두 번째 데이터센터를 개소했다. 올해는 서울에 세 번째 데이터센터를 출범시키며 국내 인프라를 확대한다. 이번 데이터센터 확대는 알리바바의 글로벌 AI 인프라 투자 전략의 일환으로 진행된다. 최근 알리바바는 글로벌 AI 인프라에 530억 달러(약 75조원) 규모의 투자를 추진하고 있으며, 알리바바 클라우드는 이를 기반으로 글로벌 클라우드 인프라와 AI 서비스를 확대하고 있다. 알리바바 클라우드에 따르면 이번 신규 데이터센터 구축으로 글로벌 인프라는 30개 리전, 104개 가용영역(AZ)으로 확대됐다. 한국에서는 기존 2개 AZ에서 3개 AZ 체제로 전환하면서 서비스 안정성과 가용성을 높였다는 설명이다. 특히 알리바바 클라우드는 국내에 3개의 AZ를 확보하면서 서비스 수준협약(SLA)도 기존 99.9%에서 99.99%로 높아졌다고 강조했다. 여러 가용영역을 활용해 특정 시설에 장애가 발생하더라도 서비스를 지속할 수 있는 구조를 강화한 것이다. 데이터 주권과 규제에 대한 대응도 보강한다. 알리바바 클라우드는 국내 고객의 데이터를 고객 동의 없이 해외로 반출하지 않는다는 방침을 다시 한 번 밝혔다. 국내에 데이터와 서비스를 둘 수 있는 인프라를 확대해 데이터 주권을 중시하는 기업과 공공기관의 클라우드 수요에 대응한다는 전략이다. 윤 지사장은 "퍼블릭 클라우드 사업자에게 데이터 보호와 개인 정보 보호는 그 어떤 것과도 바꿀 수 없는 가장 높은 우선순위일 것"이라며 "글로벌 컴플라이언스 인증을 몇 년째 갱신하고 있으며 고객들이 저희 알리바바 클라우드 상에 중요한 데이터들을 보관하거나 해당 데이터를 바탕으로 워크로드를 운영할 때 전체적인 컴플라이언스에 위반되는 사항들이 발생하지 않도록 모니터링할 수 있는 관리 체계도 제공하고 있다"고 강조했다. 알리바바 클라우드는 데이터센터 확대를 기반으로 한국 시장에서 AI 사업도 본격적으로 확대한다. 단순히 클라우드 인프라를 제공하는 데 그치지 않고 AI 컴퓨팅 인프라부터 파운데이션 모델, 개발 플랫폼, 애플리케이션까지 연결하는 '엔드투엔드 풀스택' 전략을 내세웠다. AI 컴퓨팅 인프라는 글로벌 30개 이상의 리전을 기반으로 제공하고, 파운데이션 모델 영역에서는 자체 대규모 언어 모델(LLM) '큐원(Qwen)'을 비롯해 이미지·영상 생성 모델 등을 활용한다. 모델 스튜디오와 PAI를 통해 AI 모델의 학습과 배포를 지원하고, 애플리케이션 영역에서는 기업용 AI 도구와 산업별 솔루션을 제공하는 구조다. 특히 오픈소스와 상용 모델을 함께 제공하는 투트랙 전략을 통해 기업이 필요에 따라 AI 모델을 선택할 수 있도록 한다는 구상이다. 자체 AI 모델인 Qwen 외에도 영상 생성 모델 '완(WAN)', 이미지 생성 모델 '해피호스(HappyHorse)' 등을 AI 서비스 포트폴리오에 포함했다. 기업용 AI 개발 도구도 확대한다. AI 코딩 도구 '큐오더(Qoder)'와 업무용 AI 도구 '큐원워크(QwenWork)', 영상 콘텐츠 제작을 지원하는 '원더클립(WonderClip)' 등을 앞세워 개발자와 기업의 AI 활용 범위를 넓힌다는 계획이다. 한국 기업을 대상으로 한 AI 전환 사례도 소개했다. 알리바바 클라우드는 네이버의 메타버스 자회사 제페토가 실시간 3D 아바타 서비스 운영을 위해 알리바바 클라우드의 인프라를 활용하고 있다고 설명했다. 제페토는 아시아 지역에서 대규모 동시 접속자를 수용하면서 실시간 3D 아바타 상호작용을 구현해야 하는 만큼 낮은 지연 시간과 높은 컴퓨팅 성능이 필요하다. 여기에 아바타와 3D 콘텐츠를 안정적으로 전 세계 이용자에게 전달하기 위한 글로벌 콘텐츠 전송 네트워크(CDN) 인프라도 요구된다. 알리바바 클라우드는 이러한 실시간 처리와 글로벌 콘텐츠 전송 수요에 대응할 수 있는 클라우드 인프라를 제공했다고 설명했다. 글로벌 서비스를 운영하는 국내 기업을 대상으로 클라우드 인프라 공급을 확대할 수 있다는 점을 강조한 것이다. AI 스타트업과의 협력 사례도 공개됐다. 광주 기반 AI 스타트업 젠다이브는 알리바바 클라우드의 AI 모델을 자사 AI 에이전트 기반 업무 플랫폼 '데브다이브'에 통합했다. 데브다이브는 특정 AI 모델에 종속되지 않는 '모델 애그노스틱' 방식의 AI 에이전트 기반 업무 운영 체제(WorkOS)다. 사용자가 자연어로 원하는 업무를 입력하면 여러 AI 기능을 조합해 반복적으로 사용할 수 있는 업무 워크플로를 구축하는 방식이다. 젠다이브는 여기에 알리바바 클라우드의 영상 생성 모델 완과 이미지 생성 모델 해피호스를 적용했다. 문서 분석뿐 아니라 이미지와 영상 등 시각 콘텐츠를 자동으로 생성하는 업무까지 AI 에이전트의 활용 범위를 확대했다. 알리바바 클라우드를 선택한 이유로는 생성 비용과 모델 선택의 다양성, 빠른 연동 및 확장성을 꼽았다. 특히 젠다이브는 고객 영상 제작 과정에서 기존 AI 활용 방식과 비교해 비용을 10분의 1 수준으로 낮췄다고 설명했다. 함민혁 젠다이브 대표이사는 "이번에 라이브 커머스 기업에게 알리바바 클라우드의 '해피올스' 모델을 사용해서 기존 AI 대비 10배 이상의 비용 절감 효과를 가졌다"며 "회사 단위로 50명, 100명이 AI를 사용하는데 해당 사람들이 한두 번 안에 만들어야 할 것들을 20번, 30번씩 계속 생성에 대한 비용을 썼을 때 해당 모델에 대해, 그리고 비용에 대해 알리바바 클라우드 모델들이 최적화되어 있고 비용에 대한 경쟁성이 있기 때문에 저희(젠다이브)가 선택했다"고 말했다. 알리바바 클라우드는 한국 시장에서 인프라뿐 아니라 현지 기업과의 협력도 확대할 계획이다. 중소기업과 스타트업의 디지털 전환을 지원하고 파트너 생태계를 확대하는 한편 현지 채용과 인력도 늘려 고객 대응력을 높인다는 방침이다. 한국 기업의 중국 및 아시아 시장 진출을 지원하는 것도 주요 전략으로 제시했다. 알리바바 클라우드가 중국을 비롯해 아시아 지역에 구축한 클라우드 인프라와 AI 역량을 활용해 국내 기업의 해외 서비스 확장을 지원한다는 구상이다. 윤용준 지사장은 "지난 2022년 한국 첫 번째 데이터센터를 오픈하고 (두 번째 데이터센터까지) 3년이 걸렸는데, 1년 만에 세 번째 데이터센터를 오픈했다는 것은 그만큼 한국에서 클라우드 수요도 수요지만 AI와 관련된 수요가 굉장히 늘어나고 있다"며 "AI가 좀 더 저희 생활에 밀접하게 다가오는 이 시점에서 저희 알리바바 클라우드도 한국 고객들의 디지털 트랜스포메이션을 잘 지원할 수 있는 신뢰할 수 있는 파트너로서 지속적으로 노력하겠다"고 말했다.
2026-08-18 12:35:33
-
알리바바 'Wan3.0' 베타 공개…AI 영상 생성, 짧은 클립 넘어 제작 도구로
[경제일보] 알리바바가 생성형 인공지능(AI) 영상 생성 모델의 한계를 길이와 입력 방식 측면에서 동시에 넓히고 있다. 최대 30초 영상 생성에 텍스트뿐 아니라 이미지·영상·오디오, 웹페이지와 문서까지 참조할 수 있도록 기능을 확장하면서 단순한 영상 제작 도구를 넘어 콘텐츠 제작 전반을 자동화하는 방향으로 기술 고도화에 나섰다. 11일 알리바바는 영상 생성 모델 'Wan3.0' 베타 버전을 공개하고 공개 베타 테스트를 시작했다고 밝혔다. 사용자는 알리바바 클라우드의 AI 개발 플랫폼 '모델스튜디오'와 AI 네이티브 클라우드 플랫폼 'Qwen 클라우드'를 통해 테스트를 신청할 수 있다. Wan3.0의 가장 큰 변화는 생성할 수 있는 영상의 길이다. 기존 AI 영상 생성 모델이 수초에서 최대 15초 안팎의 짧은 영상을 만드는 데 초점을 맞췄다면 Wan3.0은 클립 하나를 최대 30초까지 생성할 수 있도록 했다. 알리바바의 이전 모델인 Wan2.7-Video가 지원했던 최대 15초와 비교하면 생성 가능한 영상 길이가 두 배로 늘었다. 영상 길이가 길어지면서 AI 영상 제작의 활용 범위도 넓어질 것으로 전망된다. 짧은 장면 하나를 만드는 데 그치지 않고 인물의 움직임이나 카메라 이동이 이어지는 장면을 하나의 클립으로 구성할 수 있기 때문이다. 알리바바는 사용자가 입력한 프롬프트를 분석해 적절한 영상 길이를 추천하는 기능과 기존 영상의 시간적 흐름을 이어 영상을 확장하는 기능도 Wan3.0에 적용했다. 단순히 영상 생성 시간을 늘리는 것만으로는 실제 콘텐츠 제작에 활용하기 어렵다는 점에서 입력 방식도 확대했다. Wan3.0은 텍스트와 이미지뿐 아니라 영상과 오디오를 함께 참조할 수 있으며 웹페이지, PDF, 파워포인트 프레젠테이션 등 문서 자료도 영상 제작을 위한 입력 자료로 활용할 수 있다. 예를 들어 기업이 제품 소개 자료나 프레젠테이션을 보유하고 있다면 이를 기반으로 마케팅 영상을 만들 수 있고, 교육 기관은 문서 형태의 교육 자료를 영상 콘텐츠로 전환할 수 있다. 영상 제작자가 기존 촬영본이나 이미지, 음성 자료를 제공해 새로운 장면을 구성하는 방식도 가능하다. AI 영상 생성 시장의 경쟁이 단순히 '얼마나 그럴듯한 영상을 만드는가'에서 '사용자가 가진 자료를 얼마나 정확하게 영상으로 전환할 수 있는가'로 이동하고 있다는 점도 주목된다. 영상 제작 과정에서는 새로운 이미지를 만들어내는 것보다 기존 캐릭터나 제품, 브랜드의 특징을 유지하면서 여러 장면을 연결하는 것이 중요한 경우가 많기 때문이다. Wan3.0은 이 같은 문제를 해결하기 위해 시각적 일관성 확보에도 초점을 맞췄다. AI 영상에서 반복적으로 지적돼온 인물의 얼굴이나 의상, 소품 등이 장면마다 달라지는 현상을 줄이고 참조 자료에 포함된 캐릭터와 제품의 세부적인 특징을 유지하도록 설계했다. 화면 구성과 음성의 일관성도 주요 기능으로 제시됐다. 알리바바는 인물의 표정과 움직임을 자연스럽게 표현하고 다국어 음성을 생성하는 동시에 소프트웨어 사용자 인터페이스(UI)와 모션 그래픽 등 상대적으로 구현하기 까다로운 요소도 안정적으로 생성할 수 있다고 설명했다. 알리바바가 영상 생성 모델을 지속적으로 고도화하는 것은 생성형 AI 경쟁의 무게중심이 텍스트와 이미지에서 영상으로 이동하고 있기 때문이다. 영상은 텍스트나 이미지보다 생성에 필요한 연산량이 많고 시간적 일관성까지 유지해야 하는 만큼 AI 모델의 기술 수준을 가늠하는 분야로 꼽힌다. 특히 글로벌 빅테크와 AI 기업들이 영상 생성 모델의 품질과 길이, 입력 방식 등을 경쟁적으로 개선하면서 영상 생성 AI의 활용 범위도 점차 전문 콘텐츠 제작 영역으로 확대되고 있다. 짧은 영상을 단순히 만들어주는 수준을 넘어 기존 콘텐츠를 분석하고 새로운 영상으로 재구성하는 제작 도구로 발전하고 있는 것이다. 알리바바 역시 Wan 시리즈를 통해 이 시장을 공략하고 있다. Wan 시리즈는 2023년 7월 처음 공개된 이후 이미지와 영상 생성 기능을 지속적으로 고도화해왔다. Wan3.0에서는 영상 길이를 늘리는 동시에 멀티모달 참조 입력과 시각적 일관성 강화에 집중하면서 실제 제작 환경에서의 활용성을 높이는 데 초점을 맞췄다. AI 영상 생성 시장에서도 앞으로는 생성 품질뿐 아니라 기존 제작 과정에 얼마나 자연스럽게 편입될 수 있는지가 경쟁력을 좌우할 전망이다. 알리바바가 Wan3.0을 통해 영상 생성 시간을 늘리고 참조 입력 범위를 확대한 것도 이 같은 제작 환경의 변화를 겨냥한 것으로 풀이된다. 알리바바 관계자는 "'Wan3.0'은 영화 제작자의 제작 과정 효율화, 숏폼 드라마와 소셜 미디어 콘텐츠 제작, 기업의 텍스트·이미지 기반 마케팅 및 교육 영상 제작을 지원하는 등 다양한 산업 영역에서 활용될 수 있도록 설계됐다"며 "또한 자율주행차와 로보틱스 시스템 학습에 필요한 사실적인 시뮬레이션 영상을 생성할 수 있어 기술 개발자에게도 유용한 도구로 활용될 수 있다"고 말했다.
2026-08-11 11:25:24
-
SKT, 6880억개 매개변수 'A.X K2' 공개…산업 AX 넘어 조 단위 AI 모델 간다
[경제일보] 인공지능(AI) 경쟁이 거대언어모델(LLM)의 성능을 넘어 산업 현장에 얼마나 효과적으로 적용할 수 있느냐의 경쟁으로 확대되고 있다. 글로벌 빅테크들이 조(兆) 단위 매개변수 모델을 앞세워 AI 주도권 경쟁을 벌이는 가운데 SK텔레콤이 독자 AI 파운데이션 모델 '에이닷엑스 케이투(A.X K2)'를 공개하고 제조와 국방, 바이오 등 산업 현장의 AI 전환(AX)에 속도를 낸다. 향후 조 단위 모델로 확장하는 로드맵도 제시하며 글로벌 AI 경쟁력 확보에도 나설 계획이다. 29일 SK텔레콤은 글로벌 오픈소스 플랫폼 허깅페이스에 매개변수 6880억개(688B) 규모의 독자 AI 파운데이션 모델 'A.X K2'를 공개했다고 밝혔다. A.X K2는 지난해 공개한 5190억개(519B) 규모의 A.X K1의 후속 모델이다. 모델 규모를 확대하는 동시에 수학과 과학 추론 능력, 한국어 지식 이해 능력과 장문 추론 성능 등을 강화했다. SK텔레콤에 따르면 국내외 14개 벤치마크 평균 성능은 A.X K1 대비 32.2% 포인트 향상됐으며, 장문 이해와 AI 에이전트 관련 평가에서는 약 83.9% 포인트 개선된 것으로 나타났다. 이번 성능 향상의 핵심은 SK텔레콤이 자체 개발한 'SGA(희소 게이트 어텐션)' 구조다. 긴 문맥을 처리할 때 관련성이 높은 정보만 선별적으로 참조하는 방식으로, 산업 현장에서 요구되는 정확성과 운영 효율을 높이기 위해 개발됐다. SK텔레콤은 이를 통해 장문의 문서를 이해하고 복잡한 추론을 수행해야 하는 기업용 AI 서비스에 보다 최적화된 성능을 구현했다고 설명했다. A.X K2는 최근 6개월 이내 공개된 글로벌 주요 AI 모델들과도 경쟁력을 확보했다. SK텔레콤은 큐원(Qwen3.5-397B-A17B)과 딥시크(DeepSeek-V4-Flash), GLM-5.1, 키미 K2.6(Kimi-K2.6) 등 해외 주요 AI 모델과 동급 수준의 벤치마크 결과를 기록했다고 밝혔다. SK텔레콤은 이번 A.X K2 공개를 계기로 산업 현장과 국민의 일상에 AI를 적용하는 '산업 AI' 전략에도 속도를 낸다. 이를 위해 총 4차례의 사후 학습을 거쳐 응답 품질과 안정성, 운영 효율 등을 종합적으로 점검했으며 제조와 국방, 바이오 등 다양한 분야에서 활용 사례를 확대하고 있다. 제조 분야에서는 KG스틸과 코넥에 제조 특화 AI 에이전트를 적용한다. 하반기에는 KG스틸 당진공장의 냉간 압연 라인과 코넥의 주조·가공 공정에 제조 특화 AI 에이전트 데모 버전을 적용해 현장 실증을 진행할 예정이다. 산업 현장의 노하우를 AI에 접목해 생산성과 품질 관리 효율을 높이는 것이 목표다. 국방 분야에서는 국방부와 협업해 A.X K1 기반의 양자화 모델 3종을 개발했다. 높은 수준의 보안과 데이터 주권이 요구되는 국방 분야의 특성을 고려해 메모리 사용량을 줄이고 처리 속도를 높이는 양자화 기술을 적용했다. 국방부와 SK텔레콤은 육·해·공군과 해병대 산하 부대에서 해당 모델을 활용할 계획이다. 바이오 분야로의 적용도 검토 중이다. 현재 SK텔레콤은 SK바이오팜과 난치성 암 표적 치료제 개발에 AI를 활용하고 있으며, 통상 1~2년이 소요되던 신약 개발 초기 연구 기간을 약 5개월 수준으로 단축하는 성과를 거둔 것으로 알려졌다. 사무 환경과 일상 영역으로의 적용도 확대되고 있다. SK텔레콤은 A.X K2를 기업용 AI 서비스 '에이닷 비즈(A.Biz)'에 적용해 뉴스레터 생성과 자료 수집·분석, 보고서 작성 기능 등을 제공하고 있다. SK하이닉스의 사내 업무용 AI 도구에도 A.X K2 경량 모델을 제공해 문서 작성과 정보 정리 등 다양한 업무에 활용 중이다. 일상생활에서는 에이닷 전화의 'AI 제안' 기능과 에이닷 '노트' 기능에 A.X K2 경량 모델을 적용했다. 통화 내용을 기반으로 일정과 할 일을 추출하거나 기록된 내용을 목적에 맞게 정리해 이용자의 후속 행동을 지원한다. 이와 함께 SK텔레콤은 자사 AI 모델을 API 형태로 제공하며 국내 AI 생태계 확대에도 나서고 있다. 과학기술정보통신부가 주최하는 '전국민 AI 경진대회' 참가자들과 중소벤처기업부의 '모두의 챌린지 AX-LLM'에 선정된 스타트업 등에 A.X K1을 제공하고 있으며, 정부가 추진하는 '모두의 AI' 사업에도 참여할 예정이다. SK텔레콤은 향후 A.X K2의 후속 모델을 조 단위 매개변수 규모로 확대해 글로벌 경쟁력을 확보한다는 계획이다. 최근 공개된 키미가 2조8000억개 규모의 매개변수를 기반으로 미국 최상위 AI 모델에 준하는 성능을 선보이는 등 글로벌 AI 시장에서는 조 단위 모델이 새로운 경쟁 기준으로 자리 잡고 있다. 오픈AI와 구글, 앤트로픽 등 글로벌 빅테크들은 모델 규모를 공개하지 않고 있지만, 최정상급 AI 모델은 조 단위 모델을 기반으로 구축한 뒤 이를 경량화하는 방식이 일반적인 흐름으로 평가된다. SK텔레콤 역시 글로벌 선도 사업자 수준의 AI 경쟁력을 확보하기 위해 독자 AI 모델의 규모와 성능을 지속적으로 고도화한다는 방침이다. 또한 SK텔레콤은 A.X K2를 중심으로 비전 인코더 기반의 비전 언어(VL) 모델과 오디오 인코더·디코더 기반의 음성 모델 등 파생 모델 라인업도 공개했다. 이미지와 텍스트를 함께 이해하는 'A.X K2 VL Light-Preview'는 보고서와 매뉴얼, 법률 문서 분석 등에 활용할 수 있으며, 'A.X K2 ALM'은 고객센터 음성 통화 분석 등에 적용될 예정이다. 크래프톤이 개발한 'A.X K2 Raon-Speech'는 향후 게임 내 AI 음성 상호작용 기술 고도화에 활용된다. SK텔레콤은 제조와 국방, 바이오를 비롯한 산업 현장과 국민의 일상 전반에 AI를 적용하는 동시에 조 단위 독자 AI 모델 개발을 통해 글로벌 AI 경쟁력 확보에 속도를 낸다는 전략이다. 김태윤 SK텔레콤 파운데이션 모델 담당은 "개인의 일상생활부터 사무 환경, 제조 현장까지 폭넓게 활용될 수 있도록 다양한 기능을 고도화했다"며 "앞으로도 다양한 산업 분야에 A.X K2를 적용·발전시켜 국가 경쟁력 강화에 기여해 나가겠다"고 말했다.
2026-07-29 09:16:12
-
-
구글, '젬마4' 출시로 오픈소스 AI 경쟁 참전…'제미나이' 투트랙 전략
[경제일보] 구글이 오픈형 인공지능(AI) 모델 '젬마 4'를 공개하며 개방형 AI 시장 공략에 속도를 내고 있다. 고급 추론 능력과 온디바이스 실행을 강화한 모델을 앞세워 개발자 생태계를 확대하고 폐쇄형 모델인 제미나이와의 투트랙 전략으로 AI 경쟁력 강화에 나서는 것으로 분석된다. 2일(현지시간) 구글은 고급 추론과 에이전트 기반 워크플로우를 지원하는 오픈형 모델 제품군 '젬마 4'를 출시했다고 밝혔다. 젬마 4는 아파치 2.0 라이선스로 제공되며 상업적 활용이 가능하다. 구글은 오픈형 모델을 통해 개발자와 기업이 다양한 환경에서 AI를 활용할 수 있도록 접근성을 확대한다는 전략이다. 젬마 4는 'Effective 2B(E2B)', 'Effective 4B(E4B)', '26B Mixture of Experts(MoE)', '31B Dense' 등 총 4가지 모델로 구성됐다. 해당 모델들은 단순한 대화 기능을 넘어 복잡한 논리 처리와 에이전트 기반 자동화 작업을 지원하도록 설계됐다. 특히 고급 추론 기능과 코드 생성 능력, 이미지·오디오 처리 기능 등 멀티모달 지원을 강화했으며 최대 256K 컨텍스트를 지원해 긴 문서 처리도 가능하다. 또한 140개 이상의 언어를 지원해 글로벌 애플리케이션 개발 환경을 제공한다. 구글은 이번 젬마 4를 통해 온디바이스 AI 전략도 강화했다. E2B와 E4B 모델은 스마트폰과 노트북, IoT 기기 등 엣지 환경에서 실행할 수 있도록 설계됐다. 이를 통해 클라우드 연결 없이도 AI 기능을 활용할 수 있으며 낮은 레이턴시와 개인정보 보호 측면에서도 장점을 제공한다. 특히 구글 픽셀을 비롯해 퀄컴, 미디어텍 등 주요 반도체 기업과 협력을 통해 스마트폰과 라즈베리 파이, 엔비디아 젯슨 나노 등 다양한 기기에서 오프라인 실행을 지원한다. 온디바이스 AI 확산이 가속화되는 가운데 구글이 모바일 중심 AI 경쟁력 확보에 나선 것으로 풀이된다. 오픈형 AI 모델 경쟁도 한층 치열해지고 있다. 메타의 'Llama' 시리즈를 비롯해 '미스트랄', 알리바바 'Qwen', 마이크로소프트 'Phi' 등 주요 기업들이 오픈형 모델을 잇따라 공개하며 개발자 생태계 확보 경쟁에 나서고 있다. 이에 구글 역시 젬마 4를 통해 오픈형 AI 시장에서 영향력을 확대하려는 전략으로 분석된다. 구글은 폐쇄형 모델인 제미나이를 중심으로 고성능 AI 서비스를 제공하는 동시에 젬마 시리즈를 통해 구글의 AI 전략 다변화를 진행하고 있다. 제미나이가 클라우드 기반 서비스와 기업 고객 중심이라면 젬마는 개발자와 스타트업을 대상으로 한 오픈형 생태계 구축에 초점이 맞춰져 있다. 두 모델을 병행 운영하며 AI 플랫폼 경쟁력을 강화하려는 전략으로 풀이된다. 또한 구글은 허깅페이스, vLLM, Ollama, NVIDIA NIM 등 주요 개발 도구에서 젬마 4를 출시 당일부터 지원해 개발자 생태계 확대에도 집중한다. 또한 구글 AI 스튜디오와 구글 콜랩, 버텍스 AI 등을 통해 모델 학습과 배포 환경을 확인할 수 있어 개발자는 로컬 환경뿐 아니라 구글 클라우드를 통해 확장 가능한 AI 서비스를 구축할 수 있을 것으로 전망된다. 하드웨어 지원 범위도 확대됐다. 젬마 4는 소비자용 GPU부터 엔비디아 H100 GPU, 구글 TPU까지 다양한 환경에서 실행할 수 있도록 최적화됐다. AMD GPU와의 연동도 지원하며 엣지 기기부터 클라우드까지 폭넓은 환경에서 활용 가능하도록 설계됐다. 이번 젬마 4 출시 이후 온디바이스 AI와 개방형 생태계를 중심으로 AI 시장 주도권 경쟁이 확대될 것으로 분석된다. 구글이 젬마 4를 통해 개발자 생태계 확보에 나서면서 AI 플랫폼 경쟁 구도도 한층 치열해질 전망이다.
2026-04-03 11:32:17