검색결과 총 8건
-
-
삼성SDS, 국가 AI 연구용 GPU 공급…B300 앞세워 AI 인프라 사업 확대
[경제일보] 삼성SDS가 국가 AI 연구용 컴퓨팅 사업에 엔비디아 최신 B300 기반 GPU 클러스터를 공급한다. 대학과 정부출연연구기관 등 자체적으로 대규모 AI 인프라를 확보하기 어려운 연구기관에 최신 GPU를 제공해 국내 AI 연구 인프라 고도화를 지원하는 동시에 GPU와 국산 NPU를 아우르는 클라우드 사업 확대에도 속도를 낸다. 11일 삼성SDS는 과학기술정보통신부와 정보통신기획평가원(IITP)이 지원하는 '2026년 AI 연구용 컴퓨팅 지원 프로젝트'의 GPU 자원 공급사로 선정돼 지난달 20일부터 서비스를 시작했다고 밝혔다. 이번 사업은 국내 학계와 연구기관에 AI 연구에 필요한 GPU 컴퓨팅 자원을 지원하는 국가 AI 연구 지원 사업이다. 초거대 AI 모델과 대규모 언어 모델(LLM) 연구가 확대되고 있지만 대학과 정부출연연구기관 등이 최신 GPU를 직접 대규모로 확보하기에는 비용과 운영 부담이 큰 만큼 민간 인프라를 활용해 연구자들의 접근성을 높이는 것이 목적이다. 사업 규모는 약 153억원이며 서비스는 지난 7월부터 내년 3월까지 제공된다. 삼성SDS를 포함한 복수 사업자가 공급사로 선정됐으며 삼성SDS는 GPU 공급 계획과 보유 자원 규모, 연구 환경, 운영 지원 체계, 보안 역량 등을 평가하는 입찰에서 1순위 사업자로 선정됐다. 삼성SDS는 이번 사업에 엔비디아 H100뿐 아니라 최신 B300(블랙웰 울트라) 기반 GPU 클러스터를 투입한다. B300은 엔비디아의 최신 블랙웰 울트라 아키텍처 기반 GPU로, 이번 사업에서 요구한 호퍼급 이상의 사양을 충족하는 동시에 대규모 AI 모델의 학습과 추론에 필요한 성능과 메모리를 제공한다. AI 모델이 대형화하면서 최신 GPU 확보 여부가 AI 연구의 속도와 규모를 좌우하는 요소로 떠오르고 있다. 특히 대규모 모델을 학습하려면 여러 GPU를 동시에 연결해야 하는 만큼 GPU 자체의 성능뿐 아니라 GPU 간 데이터를 빠르게 주고받을 수 있는 네트워크와 스토리지 등 전체 인프라 구성이 중요하다. 삼성SDS는 다수의 GPU를 하나의 자원 풀로 묶는 대규모 클러스터 구성과 고속 인터커넥트 네트워크를 함께 제공한다. CPU와 메모리, 스토리지, 네트워크, 개발 환경 등도 사전 구성해 연구자가 별도의 인프라 구축 과정 없이 AI 연구에 필요한 컴퓨팅 환경을 사용할 수 있도록 지원한다. 최신 GPU는 단순히 장비를 구매하는 것뿐 아니라 데이터센터 공간과 전력, 냉각, 네트워크, 운영 인력 등이 함께 필요해 연구기관이 독자적으로 대규모 클러스터를 구축하기 어려운 것으로 평가된다. 이를 민간 클라우드 방식으로 보완해 국내 AI 연구 현장에서 제기되던 최신 GPU 접근성 문제를 해결한다는 구상이다. 정부 역시 이러한 인프라 격차를 줄이기 위해 국가 AI 연구용 컴퓨팅 지원 사업을 추진하고 있다. 연구자가 직접 고가의 GPU와 서버 인프라를 확보하지 않아도 클라우드를 통해 필요한 컴퓨팅 자원을 사용할 수 있도록 해 연구기관의 AI 개발 접근성을 높이는 방식이다. 앞서 삼성SDS는 지난 3월에 국내 최초로 SCP를 통해 엔비디아 B300 기반 GPUaaS를 출시했다. 고객이 고가의 GPU를 직접 구매하지 않고도 클라우드를 통해 AI 학습과 추론에 필요한 GPU 자원을 사용할 수 있도록 한 서비스다. 이번 사업을 통해 삼성SDS는 단순한 공공 사업을 넘어 AI 클라우드 사업의 적용 범위를 확대하는 것으로 분석된다. 또한 지난달에는 국산 AI 반도체 기업 퓨리오사AI의 2세대 NPU '레니게이드(RNGD)' 기반 NPUaaS도 SCP에 탑재했다. 엔비디아 GPU 중심의 AI 인프라뿐 아니라 AI 추론에 특화된 국산 NPU까지 클라우드에서 제공하면서 AI 가속기 선택지를 넓히고 있다. AI 인프라 시장이 GPU 중심에서 다양한 가속기를 활용하는 방향으로 확대될 가능성도 삼성SDS가 GPU와 NPU를 함께 제공하는 배경으로 꼽힌다. AI 서비스가 학습 중심에서 실제 서비스 운영과 추론 단계로 확대되면서 모든 작업에 고성능 GPU를 사용하는 것보다 작업 특성에 맞춰 GPU와 NPU 등 가속기를 선택하는 것이 비용과 효율 측면에서 중요해질 수 있기 때문이다. 삼성SDS가 GPU와 NPU를 모두 클라우드 서비스 형태로 제공할 경우 기업과 연구기관은 직접 하드웨어를 구매하지 않고 필요한 가속기를 선택해 사용할 수 있다. AI 인프라 구축에 필요한 초기 투자 부담을 줄이는 동시에 기술 변화에 따라 새로운 가속기로 전환하기도 상대적으로 용이하다. 이번 국가 AI 연구용 컴퓨팅 사업에서 B300을 실제 연구 현장에 공급하는 것도 삼성SDS의 AI 인프라 사업을 확대하는 데 레퍼런스로 활용될 수 있다. 대학과 출연연 등 연구기관을 대상으로 최신 GPU 클러스터를 운영하면서 대규모 AI 연구에 필요한 인프라 구축과 운영 역량을 확보할 수 있기 때문이다. 삼성SDS는 이번 국가 AI 연구용 컴퓨팅 사업을 통해 연구기관의 최신 GPU 접근성을 높이는 동시에 GPUaaS와 NPUaaS 등 AI 인프라 서비스의 적용 분야를 확대한다는 계획이다. 향후 공공·연구 분야를 넘어 기업의 AI 모델 개발과 서비스 운영 수요까지 AI 가속기 클라우드 사업을 확대할 수 있을지 주목된다. 이호준 삼성SDS 클라우드서비스사업부장 부사장은 "이번 사업을 통해 국내 연구자들이 세계 최고 수준의 AI 인프라를 바탕으로 혁신적인 성과를 낼 수 있도록 안정적인 서비스를 제공할 것"이라며 "앞으로도 국가 AI 연구 인프라의 저변을 확대하고 대한민국의 AI 경쟁력을 높이는 데 기여하겠다"고 말했다.
2026-08-11 08:27:46
-
AI 팩토리 시대 핵심은 경량화…노타, 솔라 오픈2 메모리 76% 줄였다
[경제일보] 생성형 인공지능(AI)의 경쟁 기준이 빠르게 변화하고 있다. 과거에는 얼마나 큰 AI 모델을 만들 수 있느냐가 경쟁력이었다면 최근에는 이를 얼마나 효율적으로 운영할 수 있는지가 핵심 요소로 떠오르고 있다. AI 에이전트 시대가 본격화되면서 기업들이 마주한 과제 역시 성능 경쟁을 넘어 GPU 비용과 운영 효율성 확보로 확대되는 가운데, 노타가 대규모 AI 모델을 GPU 2장만으로 구동할 수 있는 경량화 기술을 선보이며 기업들의 AI 전환(AX) 비용 절감에 나섰다. 27일 노타는 업스테이지와 함께 참여 중인 정부 독자 AI 파운데이션 모델 프로젝트의 2차 성과물인 '솔라 오픈2' 전용 경량화 모델을 공개했다고 밝혔다. 최근 글로벌 AI 시장에서는 딥시크와 문샷 AI의 '키미' 시리즈 등 고성능 오픈 웨이트 모델이 주목받고 있다. 다만 AI 경쟁의 기준은 단순히 모델 성능을 넘어 실제 업무 환경에서 얼마나 효율적으로 활용할 수 있는지로 확대되고 있다. 특히 문서 업무와 코딩, 검색, 툴 호출 등을 수행하는 AI 에이전트가 확산되면서 토큰 사용량과 연산 비용이 크게 증가하고 있어 AI 운영 비용을 낮추는 경량화 기술이 새로운 경쟁력으로 부상하고 있다. 기업들의 AI 인프라 경쟁 역시 새로운 국면을 맞고 있다. AI 팩토리와 AI 데이터센터 구축 경쟁이 본격화되면서 GPU 확보가 중요한 과제로 떠올랐지만, 높은 구축 비용과 전력 소비는 여전히 기업들의 부담으로 꼽힌다. 같은 성능을 보다 적은 GPU로 구현할 수 있다면 인프라 구축 비용과 운영 비용을 동시에 절감할 수 있는 만큼 AI 경량화 기술의 중요성도 커지고 있다. 솔라 오픈2는 문서 업무와 코딩, 툴 호출, 다단계 추론 등 실제 기업 업무에 활용할 수 있는 AI 에이전트 구현에 초점을 맞춘 대규모 언어모델(LLM)이다. 총 2500억개의 매개변수를 갖추고 있으며 실제 작업 시에는 필요한 150억개의 매개변수만 활성화하는 '전문가 혼합(MoE)' 구조를 채택했다. 하나의 모델 안에 있는 여러 연산 모듈 가운데 일부만 선택적으로 활용하는 방식으로 연산 효율성을 높인 것이 특징이다. 노타는 해당 솔라 오픈2의 기능을 실제 기업 환경에 보다 효율적으로 배포할 수 있도록 데이터 기반 MoE 양자화와 라우터 인지형 MoE 양자화, 비균일 전역 프루닝 기술 등을 적용했다고 설명했다. 양자화는 모델을 보다 낮은 정밀도의 데이터 형식으로 변환해 메모리 사용량을 줄이는 기술이며, 프루닝은 중요도가 낮은 연산 모듈을 선택적으로 제거해 모델을 경량화하는 기술이다. 특히 데이터 기반 MoE 양자화에는 모델 가중치를 4비트 저정밀 형식으로 변환하면서도 모든 전문가 모듈이 안정적인 통계치를 확보할 수 있도록 캘리브레이션 데이터를 합성하는 'PASCAL-MoE' 기술이 활용됐다. 라우터 인지형 MoE 양자화에는 양자화 이후에도 라우터가 전문가 모듈을 안정적으로 선택할 수 있도록 자체 개발한 양자화 알고리즘이 적용됐다. 이를 통해 노타는 원본 모델의 가중치 메모리를 기존 500.6GB에서 117.8GB로 약 76.5% 줄이는 데 성공했다고 강조했다. 기존에는 엔비디아 'H100 GPU' 8장이 필요했던 환경을 GPU 2장만으로 구동할 수 있도록 최적화했으며, 양자화 이후에도 AI 에이전트의 핵심 기능인 툴 호출 성능을 안정적으로 유지하는 것으로 알려졌다. 실제로 글로벌 AI 시장 역시 성능 경쟁에서 운영 효율성 경쟁으로 무게 중심이 이동하고 있다. 높은 성능의 AI 모델을 보다 적은 인프라로 구동할 수 있는 기술이 기업들의 AI 도입 장벽을 낮추는 핵심 요소로 떠오르면서 경량화 기술이 AI 팩토리 시대의 필수 기술로 자리 잡고 있는 것이다. 노타는 이번 솔라 오픈2 경량화 모델을 통해 국내 기업들이 보다 적은 비용으로 AI 에이전트를 도입하고 활용 범위를 확대할 수 있을 것으로 기대하고 있다. 특히 별도의 대규모 GPU 인프라를 구축하기 어려운 기업들도 효율적으로 AI 서비스를 운영할 수 있도록 지원해 AI 전환을 가속화한다는 계획이다. 노타가 공개한 솔라 오픈2 전용 경량화 모델은 글로벌 AI 플랫폼 허깅페이스를 통해 확인할 수 있다. 김태호 노타 CTO는 "이번 성과는 대규모 MoE 모델을 기업이 실제 도입할 수 있는 형태로 최적화했다는 데 의미가 있다"며 "기업이 자사의 인프라와 예산에 맞춰 에이전트 AI를 도입하고 활용 범위를 확장할 수 있도록 모델 구조와 하드웨어 환경에 최적화된 양자화 및 경량화 기술을 지속해서 고도화하겠다"고 말했다.
2026-07-27 14:27:30
-
KT클라우드, 리벨리온 NPU 적용한 공공 AI 인프라 구축
[경제일보] 공공 클라우드 시장에서 인공지능(AI) 인프라 패러다임이 GPU 중심에서 신경망처리장치(NPU) 기반으로 이동하고 있다. 정부의 국산 AI 반도체 활용 확대 정책과 맞물리면서 KT 클라우드는 NPU 서비스를 확대하고 있다. 4일 KT 클라우드는 공공기관 전용 클라우드에 리벨리온의 차세대 NPU를 적용한 'NPU 서버' 상품을 출시하고 공공 AI 인프라 시장 확대에 나선다고 밝혔다. 이번 서비스는 공공 전용 데이터센터 환경에서 가상머신(VM) 방식으로 NPU 인프라를 제공하는 것이 특징이다. 또한 국내 NPUaaS(서비스형 NPU) 중 최초로 클라우드 보안 인증(CSAP)을 획득해 공공기관 도입 요건을 충족한 것으로 알려졌다. 공공 클라우드 시장은 보안 규제와 함께 국산 기술 활용 비중 확대가 중요한 평가 요소로 자리 잡고 있다. 이에 AI 모델 학습과 추론 과정에서 발생하는 데이터 보안성과 비용 효율성을 동시에 충족할 수 있는 인프라 확보가 핵심 과제로 떠오르고 있다. KT 클라우드의 NPU 서버는 리벨리온의 데이터센터용 AI 반도체 'ATOM 플러스'를 기반으로 구축됐다. 최근 AI 워크로드가 모델 학습 중심에서 추론 중심으로 빠르게 이동하면서, 추론에 특화된 NPU는 GPU 대비 비용 효율성과 전력 효율성을 동시에 개선할 수 있는 대안으로 주목받고 있다. 이를 통해 공공기관 및 공공 AX 사업 참여 기업들은 보안 규제를 준수하면서도 AI 서비스 구축에 필요한 연산 인프라를 활용할 수 있게 될 전망이다. 특히 민원 상담, 행정 업무 지원, 문서 검색 및 분석 등 공공 서비스 영역에서 AI 에이전트 적용 범위가 확대될 것으로 예상된다. 클라우드 업계에서는 향후 공공 AI 인프라 시장에서 GPU 중심 구조가 점차 변화할 가능성에 주목하고 있다. 그동안 AI 인프라는 엔비디아 GPU 중심으로 구축돼 왔으나, 국산 AI 반도체 생태계 확대 정책과 맞물리면서 NPU 기반 인프라 도입이 본격화되는 흐름이라는 분석이다. 앞서 KT 클라우드는 지난 4월 AI 통합 플랫폼 'AI 넥서스'를 출시하며 AI 인프라 사업을 확장한 바 있다. AI 넥서스는 학습 전용 인프라 'AI 트레인'과 추론 전용 인프라 'AI SERV'를 통합한 서비스로, AI 모델 개발부터 배포, 운영까지 전 과정을 단일 플랫폼에서 지원한다. 특히 모델 서빙(Model Serving) 기능을 통해 복잡한 배포 과정 없이 AI 모델을 실행 환경에 적용할 수 있도록 설계했고, 모델 스토어 기능을 통해 오픈소스 모델 기반 AI 서비스 구축도 지원한다. 또한 'A100', 'H100', 'H200' 등 다양한 GPU 라인업을 제공하고 있으며, 향후 차세대 GPU인 '엔비디아 B300' 기반 서비스로 확장할 계획이다. KT 클라우드는 공공 보안 요건을 충족하는 AI 인프라 제공을 기반으로 공공기관과 지자체의 디지털 전환(AX) 수요에 대응하고, 국내 AI 반도체 생태계 확산에도 기여한다는 방침이다. 김봉균 KT 클라우드 대표는 "정부의 국산 AI 반도체 활용 확대 기조에 맞춰 공공 전용 NPU 상품을 출시하게 됐다"며 "KT 클라우드는 최적의 AI 인프라 플랫폼 사업자로서 공공기관과 기업의 AX 혁신을 지원하고, 국가 AI 산업 경쟁력 강화에 기여하겠다"고 말했다.
2026-06-04 09:59:00
-
NHN클라우드, AI 풀스택 '팩토리X' 공개…"국가대표 AI 인프라 기업 도약"
[경제일보] "NHN클라우드는 '팩토리X'라는 새로운 이름으로 다시 도전을 시작하려고 한다" 26일 김동훈 NHN클라우드 대표는 NHN클라우드가 서울 중구 더플라자호텔 서울에서 진행하는 기자간담회에서 신규 AI 풀스택 브랜드 '팩토리X'와 중장기 AI 사업 전략을 발표하며 이렇게 말했다. 이날 기자간담회에는 김동훈 NHN클라우드 대표와 강민수 CIO, 김태형 CTO, 안성민 NHN엔터프라이즈 대표 등이 참석해 AI 인프라와 플랫폼, 서비스 전략을 직접 소개했다. NHN클라우드는 이날 대규모 GPU 인프라 운영 경험을 기반으로 차세대 AI 풀스택 전략을 통해 AI 인프라 사업을 확대한다는 목표를 공개했다. 단순 클라우드 사업자를 넘어 AI 인프라 구축부터 운영, 서비스 실행까지 전 과정을 제공하는 '국가대표 AI 인프라 기업'으로 도약하겠다는 것이다. NHN클라우드는 이번 신규 브랜드 공개를 시작으로 AI 사업을 핵심 성장축으로 육성한다는 계획이다. 최근 3년간 연평균 24% 성장세를 이어온 AI 사업을 기반으로 향후 전체 매출에서 AI 사업 비중을 50% 이상까지 확대하겠다는 목표도 제시했다. 김동훈 대표는 이날 발표에서 AI 산업 경쟁 구도가 변화하고 있다고 강조했다. 그는 "AI 경쟁 핵심은 거대 모델 자체보다 이를 실제 비즈니스 환경에서 안정적으로 운영하고 비용을 최적화할 수 있는 실행 환경으로 이동하고 있다"며 "'팩토리X'는 NHN클라우드가 지난 수년간 GPU 인프라 시장에서 축적한 운영 경험과 엔지니어링 역량을 집약한 결과물"이라고 강조했다. '팩토리X'는 GPU 인프라와 AI 플랫폼, AI 서비스까지 통합 제공하는 구조로 설계됐다. NHN클라우드는 개념검증(PoC) 단계에 머무르는 기업들의 AI 프로젝트를 실제 서비스와 업무 환경으로 연결하는 데 초점을 맞췄다고 설명했다. 이날 NHN클라우드는 대규모 GPU 인프라 운영 현황도 공개했다. NHN클라우드에 따르면 광주 국가 AI 데이터센터에서 엔비디아 H100 GPU와 국산 NPU를 함께 운영 중이며 AI 전용 데이터센터 '팩토리X 서울'에서는 정부 GPU 사업을 기반으로 총 27.4EF(엑사플롭스) 규모 AI 클러스터를 구축했다. 특히 NHN클라우드는 최신 GPU인 B200 7656장을 기반으로 국내 최대 수준인 4080장 단일 GPU 클러스터를 상용 운영하고 있다고 설명했다. 현장에서는 랙당 75kW급 고밀도 GPU 환경을 제어하기 위한 100% 수랭식 냉각 시스템 운영 사례도 함께 소개됐다. NHN클라우드는 이를 통해 기존 공랭식 대비 GPU 장애율을 크게 낮추고 운영 안정성을 확보했다고 강조했다. 강민수 CIO는 "AI 서비스 경쟁이 본격화되면서 GPU 확보뿐 아니라 냉각과 전력, 네트워크 설계까지 인프라 운영 역량 중요성이 커지고 있다"며 "AI 서버의 수냉을 적용한 비율은 지난해 23%에 그쳤지만 올해에는 57%로 1년 만에 약 2.5배 급등할 것으로 예상"이라고 설명했다. NHN클라우드는 GPU 자원 운영 효율화를 위한 자체 플랫폼 전략도 공개했다. 자체 개발한 GPU 통합 관리 플랫폼 'GPU Live'는 AI 학습과 추론 워크로드를 자동 분리하고 GPU 자원을 동적으로 배분하는 기능을 제공한다. 이를 통해 GPU 활용률을 높이고 유휴 자원을 최소화한다는 것이다. AI 개발 플랫폼 'AI 이지메이커'도 소개됐다. NHN클라우드는 컨테이너 기반 개발 환경을 통해 모델 학습부터 배포와 운영까지 전 과정을 지원하며 기업들의 AI 개발 생산성을 높일 수 있을 것으로 전망했다. 김태형 NHN클라우드 CTO는 "GPU를 보유한 것과 GPU를 잘 쓰는 것은 완전히 다른 문제"라며 "NHN클라우드의 인프라와 플랫폼 위에서 고객은 AI 시대가 요구하는 빠르고 폭발적인 시도를 반복할 수 있다"고 설명했다. 안성민 NHN엔터프라이즈 대표는 이날 기업 업무 환경에 적용 가능한 AI 에이전트 서비스 '프로젝트 X'도 공개했다. 해당 서비스는 올해 하반기 출시 예정으로 비개발자도 자연어 기반으로 맞춤형 AI 에이전트를 설계할 수 있도록 구성된 것이 특징이다. 안 대표는 "에이전틱 AI 서비스는 폭발적으로 성장하고 있지만, 역설적이게도 이러한 에이전틱 AI 서비스의 폭발은 기업 간 격차를 폭발적으로 벌리고 있는 양상"이라며 "프로젝트 X가 준비한 표준 환경 위에서 최신 상용 모델과 때로는 오픈 모델을 함께 활용할 수 있어 안전성과 유연성 그리고 기동성까지 동시에 만족시킨다"고 말했다. NHN클라우드는 최근 공공과 민간 AI 인프라 사업을 동시에 확대하고 있다. 지난해 정부 'AI 컴퓨팅자원 활용기반 강화 사업'에서 최대 구축 사업자로 선정된 데 이어 올해 초에는 크래프톤 GPU 클러스터 구축 사업도 수주했다. NHN클라우드는 현재 엔씨 AI, 티맥스티베로 등과 협력해 AI·클라우드 생태계 구축에도 나서고 있고, 특히 데이터 주권 기반 AI 인프라 구축과 국산 기술 중심 생태계 확대를 한다는 계획이다. 김 대표는 "100개 기업 중에 7개 기업만이 GPU를 제대로 활용하고 있다"며 "인프라를 얼마나 단단하고 효율적으로 운영하냐가 AI 성적을 좌우한다"고 강조했다.
2026-05-26 11:17:24
-
구글, '젬마4' 출시로 오픈소스 AI 경쟁 참전…'제미나이' 투트랙 전략
[경제일보] 구글이 오픈형 인공지능(AI) 모델 '젬마 4'를 공개하며 개방형 AI 시장 공략에 속도를 내고 있다. 고급 추론 능력과 온디바이스 실행을 강화한 모델을 앞세워 개발자 생태계를 확대하고 폐쇄형 모델인 제미나이와의 투트랙 전략으로 AI 경쟁력 강화에 나서는 것으로 분석된다. 2일(현지시간) 구글은 고급 추론과 에이전트 기반 워크플로우를 지원하는 오픈형 모델 제품군 '젬마 4'를 출시했다고 밝혔다. 젬마 4는 아파치 2.0 라이선스로 제공되며 상업적 활용이 가능하다. 구글은 오픈형 모델을 통해 개발자와 기업이 다양한 환경에서 AI를 활용할 수 있도록 접근성을 확대한다는 전략이다. 젬마 4는 'Effective 2B(E2B)', 'Effective 4B(E4B)', '26B Mixture of Experts(MoE)', '31B Dense' 등 총 4가지 모델로 구성됐다. 해당 모델들은 단순한 대화 기능을 넘어 복잡한 논리 처리와 에이전트 기반 자동화 작업을 지원하도록 설계됐다. 특히 고급 추론 기능과 코드 생성 능력, 이미지·오디오 처리 기능 등 멀티모달 지원을 강화했으며 최대 256K 컨텍스트를 지원해 긴 문서 처리도 가능하다. 또한 140개 이상의 언어를 지원해 글로벌 애플리케이션 개발 환경을 제공한다. 구글은 이번 젬마 4를 통해 온디바이스 AI 전략도 강화했다. E2B와 E4B 모델은 스마트폰과 노트북, IoT 기기 등 엣지 환경에서 실행할 수 있도록 설계됐다. 이를 통해 클라우드 연결 없이도 AI 기능을 활용할 수 있으며 낮은 레이턴시와 개인정보 보호 측면에서도 장점을 제공한다. 특히 구글 픽셀을 비롯해 퀄컴, 미디어텍 등 주요 반도체 기업과 협력을 통해 스마트폰과 라즈베리 파이, 엔비디아 젯슨 나노 등 다양한 기기에서 오프라인 실행을 지원한다. 온디바이스 AI 확산이 가속화되는 가운데 구글이 모바일 중심 AI 경쟁력 확보에 나선 것으로 풀이된다. 오픈형 AI 모델 경쟁도 한층 치열해지고 있다. 메타의 'Llama' 시리즈를 비롯해 '미스트랄', 알리바바 'Qwen', 마이크로소프트 'Phi' 등 주요 기업들이 오픈형 모델을 잇따라 공개하며 개발자 생태계 확보 경쟁에 나서고 있다. 이에 구글 역시 젬마 4를 통해 오픈형 AI 시장에서 영향력을 확대하려는 전략으로 분석된다. 구글은 폐쇄형 모델인 제미나이를 중심으로 고성능 AI 서비스를 제공하는 동시에 젬마 시리즈를 통해 구글의 AI 전략 다변화를 진행하고 있다. 제미나이가 클라우드 기반 서비스와 기업 고객 중심이라면 젬마는 개발자와 스타트업을 대상으로 한 오픈형 생태계 구축에 초점이 맞춰져 있다. 두 모델을 병행 운영하며 AI 플랫폼 경쟁력을 강화하려는 전략으로 풀이된다. 또한 구글은 허깅페이스, vLLM, Ollama, NVIDIA NIM 등 주요 개발 도구에서 젬마 4를 출시 당일부터 지원해 개발자 생태계 확대에도 집중한다. 또한 구글 AI 스튜디오와 구글 콜랩, 버텍스 AI 등을 통해 모델 학습과 배포 환경을 확인할 수 있어 개발자는 로컬 환경뿐 아니라 구글 클라우드를 통해 확장 가능한 AI 서비스를 구축할 수 있을 것으로 전망된다. 하드웨어 지원 범위도 확대됐다. 젬마 4는 소비자용 GPU부터 엔비디아 H100 GPU, 구글 TPU까지 다양한 환경에서 실행할 수 있도록 최적화됐다. AMD GPU와의 연동도 지원하며 엣지 기기부터 클라우드까지 폭넓은 환경에서 활용 가능하도록 설계됐다. 이번 젬마 4 출시 이후 온디바이스 AI와 개방형 생태계를 중심으로 AI 시장 주도권 경쟁이 확대될 것으로 분석된다. 구글이 젬마 4를 통해 개발자 생태계 확보에 나서면서 AI 플랫폼 경쟁 구도도 한층 치열해질 전망이다.
2026-04-03 11:32:17
-
-
혼다코리아 모터사이클 딜러 모집, 벤츠 서비스센터 예약 앱 출시 外
[경제일보] 혼다코리아가 오는 16일부터 4월 30일까지 전국 5개 지역 혼다 모터사이클 공식 딜러를 모집한다. 국내 혼다 모터사이클 공식 딜러는 현재 판매되고 있는 110cc부터 1800cc까지 혼다 모터사이클 전 모델 라인업을 대상으로 한다. 이번 신규 딜러 모집은 혼다 모터사이클 완성차·부품·용품 구매 및 정비 서비스 편의 향상을 위해 실시하며 서울 강북권, 서울 강남권, 수원특례시, 대구광역시, 광주광역시 등을 대상으로 모집한다. 모터사이클 산업에 대한 역량과 소신을 겸비한 사업자라면 누구나 지원할 수 있다. 이력서, 자기소개서, 사업의향서 등 3가지 제출서류를 모집기간 내에 이메일 또는 우편으로 접수 가능하다. ◆ "차량 화면서 서비스센터 예약"…벤츠 코리아, 온보드 서비스 앱 출시 메르세데스-벤츠 코리아가 차량 내 중앙 디스플레이를 통해 서비스센터 예약이 가능한 '온보드 서비스 애플리케이션'을 출시했다. 이번에 제공되는 온보드 서비스 애플리케이션은 수입차 업계 최초로 선보이는 서비스로, 차량 내부 중앙 디스플레이 애플리케이션을 통해 서비스센터 정비 예약을 진행할 수 있다. 온보드 서비스 애플리케이션은 2세대 MBUX(NTG7) 또는 3세대 MBUX 이상의 인포테인먼트 시스템이 적용된 차량을 대상으로 제공된다. 이와 함께 정기점검 관리, 원격 차량 상태 확인, 차량 진단 등을 위한 디지털 서비스가 활성화되어 있어야 하며, 해당 조건을 충족할 경우 OTA 업데이트를 통해 애플리케이션이 자동 설치된다. 예약 내역은 차량 디스플레이와 메르세데스-벤츠 홈페이지 또는 모바일 애플리케이션에서도 확인할 수 있다. 예약 변경 또는 취소도 가능하다. 메르세데스-벤츠 코리아는 무선 소프트웨어 업데이트를 통한 차량 서비스 개선에 초점을 맞추고 있다. 지난해 11월에는 글로벌 엔터테인먼트 애플리케이션, 인천국제공항 실시간 항공 정보, 목적지 휴무시간 알림 등 차량 내에서 즐길 수 있는 콘텐츠를 강화했다. ◆ 포르쉐 AG, 신형 '카이엔 S 일렉트릭' 공개…韓 하반기 출시 포르쉐 AG가 카이엔 일렉트릭과 최상위 모델 카이엔 터보 일렉트릭 사이에 위치한 신형 '카이엔 S 일렉트릭'을 공개했다. 카이엔 S 일렉트릭은 기본형 모델 대비 224마력(PS)의 추가 출력, 더욱 날렵한 외관 디자인, 그리고 한층 더 광범위한 옵션 사양이 특징이다. 프런트 및 리어 액슬에 각각 영구 자석 동기 모터를 장착한 드라이브 시스템을 통해 544마력(PS)의 출력을 발휘하며, 런치 컨트롤 사용 시 최대 666마력(PS)까지 시스템 출력이 증가한다. 정지 상태에서 100km/h까지 가속하는데 3.8초, 최고속도는 250km/h며 주행 가능 거리는 최대 653km (WLTP 기준)에 이른다. 카이엔 S 일렉트릭은 카이엔 일렉트릭, 카이엔 터보 일렉트릭과 같은 총 113kWh 용량의 고전압 배터리를 탑재한다. 적합한 급속 충전소에서 최대 400kW의 출력으로 배터리 충전 상태 10%에서 80%까지 16분 이내에 충전할 수 있다. 신형 카이엔 S 일렉트릭 모델의 국내 판매 가격은 1억6380만원이며, 국내에는 올해 하반기 출시될 예정이다.
2026-03-11 13:14:39