검색결과 총 167건
-
독파모 2차 평가 공개…모티프·SKT·LG AI연구원 항목별 강점 엇갈려
[경제일보] 정부가 '국가대표 AI' 육성을 위해 추진 중인 독자 AI 파운데이션 모델 프로젝트의 2차 단계 평가 세부 기준과 결과를 공개했다. 이번 평가는 글로벌 AI 벤치마크뿐 아니라 국내 환경에 맞춘 성능 평가, 전문가 평가, 실제 사용자 평가까지 반영한 것이 특징이다. 당초 항목별 1위 기업과 점수를 공개하지 않는다는 방침이었지만 평가 투명성을 둘러싼 논란이 제기되자 1차 평가와 동일한 수준으로 공개 범위를 확대했다. 20일 과학기술정보통신부는 최근 발표한 독자 AI 파운데이션 모델 프로젝트 2차 단계 평가의 기준과 결과를 공개했다고 밝혔다. 이번 평가에는 SK텔레콤, LG AI연구원, 모티프테크놀로지스 등 4개 정예팀이 참여했다. 이번 2차 평가는 총 100점 만점으로 벤치마크 평가 40점, 전문가 평가 35점, 사용자 평가 25점으로 구성됐다. 단순히 AI 모델의 벤치마크 성능만 비교하는 방식에서 벗어나 기술적 독자성, 개발 전략, 생태계 파급 효과, 실제 사용성 등을 종합적으로 평가한 것으로 알려졌다. 가장 큰 비중을 차지한 벤치마크 평가는 글로벌 평가와 국내 평가로 나뉜다. 글로벌 평가에는 'AAII'에서 활용하는 벤치마크를 적용해 에이전트, 코딩, 일반 지식, 과학적 추론 등 분야의 성능을 평가했다. 국내 평가는 한국지능정보사회진흥원(NIA) 벤치마크를 활용해 수학, 지식, 장문 이해, 안전성, 신뢰성, 한국어, 지시 이행 등 7개 분야를 평가했다. 글로벌 AAII 평가에서는 모티프테크놀로지스 정예팀이 11.9점으로 가장 높은 점수를 받았다. NIA 벤치마크에서는 SK텔레콤 정예팀이 13.4점으로 최고점을 기록했다. 4개 팀의 AAII 평균 점수는 9.48점, NIA 벤치마크 평균은 13.05점이었다. 전문가 평가는 외부 전문가 10명으로 구성된 평가위원회가 진행했다. 산업계 3명, 학계 5명, 연구계 2명이 참여했으며 정예팀이 제출한 자료를 바탕으로 약 5일간 서면 평가와 질의응답을 진행했다. 전문가 평가는 개발 전략 및 기술 10점, 개발 성과 및 계획 10점, 생태계·글로벌 파급효과 및 기여 계획 15점으로 구성됐다. 특히 이번 2차 평가에서는 1차 평가 이후 제기된 AI 모델의 독자성과 활용성에 대한 요구를 반영했다. 향후 AI 기술 변화에 대응하는 '무빙타깃' 전략과 차세대 기술 도입 계획 등도 평가 대상에 포함됐다. 전문가 평가에서는 LG AI연구원 정예팀이 29.5점으로 최고점을 기록했다. 4개 팀 평균은 28.75점이었다. 실제 이용자가 AI 모델을 어떻게 평가하는지도 점수에 반영됐다. 사용자 평가는 AI 전문 사용자와 일반 국민으로 나눠 진행됐으며 AI 스타트업 대표 등 전문 사용자 49명과 일반 국민 185명이 실제 평가에 참여했다. 전문 사용자 평가는 15점 만점으로 환산됐으며 SK텔레콤 정예팀이 11.6점으로 가장 높은 점수를 받았다. 일반 국민 평가에서는 LG AI연구원 정예팀이 7.6점으로 최고점을 기록했다. 일반 국민 평가단은 성별과 연령별 쿼터를 적용해 무작위로 선정됐다. 글로벌 벤치마크에서는 모티프테크놀로지스, 국내 벤치마크와 전문 사용자 평가에서는 SK텔레콤, 전문가 평가와 일반 국민 평가에서는 LG AI연구원이 각각 최고점을 기록했다. 과기정통부 관계자는 "독파모 프로젝트는 단순한 순위 경쟁이나 탈락 팀 선정을 목적으로 하는 것이 아니라, 우리 AI 기업들이 경쟁을 넘어 성장하고, 국내 AI 생태계의 질적 성장과 확장을 견인하는 데 그 취지가 있다"며 "평가 결과 공개에 따른 일부 기업의 예기치 않은 직·간접적 피해를 최소화하는 한편, 평가 과정 결과에 대한 공정성과 투명성이라는 가치 역시 균형 있게 고려하여, 1차 단계평가 결과 공개와 같은 수준으로 2차 단계평가 결과를 공개했다"고 말했다.
2026-08-20 17:54:50
-
AWS, 국내 피지컬 AI 15개사 지원…로봇 상용화 생태계 키운다
[경제일보] 아마존웹서비스(AWS)가 국내 기업 15곳을 선발해 로봇과 자율주행, 디지털 트윈 등 피지컬 AI 기술의 개발부터 상용화까지 지원한다. 생성형 AI를 넘어 AI가 실제 물리적 환경을 인식하고 판단해 움직이는 피지컬 AI 시장이 본격적인 산업 경쟁 단계에 들어서면서 국내 기업을 AWS 클라우드 생태계 안으로 끌어들이려는 전략으로 풀이된다. AWS는 20일 ‘AWS 코리아 피지컬 AI 프론티어 프로그램’을 공식 발표했다. 지난 AWS 서밋 서울 2026에서 공개한 프로그램으로, 7월부터 12월까지 6개월간 운영된다. 참여 기업에는 클라우드 인프라와 AI 서비스, 기술 자문, 비즈니스 모델 개발, 글로벌 시장 진출 등을 지원한다. 핵심은 단순한 기술 개발 지원이 아니라 개념검증(PoC)에서 실제 현장 실증과 사업화까지 연결하는 것이다. 참여 기업은 AWS 크레딧을 활용해 데이터를 수집·처리하고 AI 모델을 학습시키는 한편 가상환경에서 로봇을 훈련한 뒤 현실에 적용하는 ‘심투리얼(Sim-to-Real)’ 기술을 검증할 수 있다. 엣지 환경에 AI를 배포하는 과정까지 AWS 전문가의 지원을 받을 예정이다. 사용되는 기술도 클라우드에 국한되지 않는다. 아마존 EC2와 S3, 세이지메이커, 베드록, AWS IoT 그린그래스 등 AWS의 AI·데이터·IoT 서비스를 묶어 로봇의 학습과 추론, 데이터 관리, 현장 배포를 하나의 개발 환경에서 지원한다. 1기에는 대기업과 스타트업을 합쳐 15개사가 참여한다. 엔터프라이즈 트랙에는 △SK에코플랜트 △NC AI △알체라 △LG CNS가 선정됐다. 건설 현장 자율 로봇과 휴머노이드용 VLA(비전·언어·행동) 모델, 피지컬 AI 데이터 플랫폼, 산업용 로봇 운영 소프트웨어 등이 주요 개발 대상이다. 스타트업 트랙에는 △본에이아이 △투모로로보틱스 △고레로보틱스 △디든로보틱스 △ 로보에테크놀로지 △케어링 △위로보틱스 △컨피그 △리얼월드 △큐픽스 △니어스랩 등이 참여한다. 자율비행 드론과 건설·물류 로봇, 휴머노이드, 돌봄 로봇, 로봇 학습 데이터, 3D 디지털 트윈 등 적용 분야도 다양하다. 이번 프로그램에서 주목할 부분은 AWS가 직접 로봇을 만드는 것이 아니라 로봇 기업의 개발·상용화 기반을 장악하려 한다는 점이다. 피지컬 AI는 실제 공간에서 움직여야 하기 때문에 막대한 학습 데이터와 시뮬레이션, 고성능 컴퓨팅, 엣지 인프라가 필요하다. 로봇 제조사 입장에서는 개별적으로 이 인프라를 구축하는 것보다 클라우드 사업자의 개발환경을 활용하는 편이 비용과 시간을 줄일 수 있다. 특히 한국은 삼성전자·현대차·LG전자 등 제조업 기반과 로봇·자동화 기술을 동시에 갖춘 만큼 피지컬 AI의 실제 적용처가 많은 시장이다. AWS가 국내 대기업과 스타트업을 연결하는 것도 이 때문이다. 로봇 기술을 보유한 스타트업이 대기업의 제조·건설·물류 현장에서 데이터를 확보하고 실증할 수 있다면 기술의 상용화 속도를 높일 수 있다. 경쟁 구도도 치열해지고 있다. 엔비디아가 GPU와 시뮬레이션 플랫폼을 앞세워 로봇 개발 생태계를 확대하고 있고, 구글·마이크로소프트 등도 AI 에이전트와 로보틱스 분야의 결합을 강화하고 있다. AWS로서는 생성형 AI 이후 새로운 성장축으로 떠오른 피지컬 AI 시장에서 클라우드 인프라의 영향력을 선점해야 하는 상황이다. 다만 이번 프로그램이 실제 산업 성과로 이어질지는 참여 기업들이 얼마나 많은 현장 데이터를 확보하고 이를 유료 서비스로 전환하느냐에 달렸다. AWS는 기업별 지원 규모와 크레딧 규모를 공개하지 않았다. 결국 6개월간의 프로그램 이후 실제 고객사 도입과 매출로 이어지는 사례가 얼마나 나올지가 성패를 가를 전망이다. 함기호 AWS코리아 대표는 “한국은 제조 경쟁력과 로보틱스 생태계를 바탕으로 피지컬 AI 분야를 이끌 수 있는 기반을 갖추고 있다”며 “참여 기업이 기술을 실제 사업으로 연결할 수 있도록 기술과 전문성, 글로벌 네트워크를 지원하겠다”고 말했다.
2026-08-20 13:50:44
-
KT, '모두의 AI' 출사표…서비스·모델·인프라 국산 AI 연합 구축
[경제일보] KT가 국내 AI 서비스·모델·인프라 기업을 한데 묶어 정부의 '모두의 AI' 사업에 참여한다. 검색·쇼핑·주거·교육·금융 등 국민 생활과 맞닿은 서비스부터 AI 모델과 국산 반도체까지 연결해 국내 AI 기술의 실제 서비스 적용을 확대한다는 전략이다. 19일 KT는 국내 AI 서비스, 모델·플랫폼, 인프라 분야 기업·기관과 컨소시엄을 구성해 과학기술정보통신부가 추진하는 '모두의 AI' 사업 공모에 참여한다고 밝혔다. 이번 컨소시엄은 AI 기술을 개발하는 기업뿐 아니라 이를 실제 국민 서비스에 적용할 수 있는 기업과 인프라 기업까지 참여한 것이 특징이다. KT는 통신·클라우드·AI 플랫폼과 대규모 서비스 운영 경험을 바탕으로 각 참여사의 기술을 연결하고 안정적인 AI 서비스 기반을 구축한다는 계획이다. AI 서비스 분야에는 다음, 솔트룩스, 무신사, 직방, 커넥트웨이브, 매스프레소, EBS, BC카드, 딥서치 등이 참여한다. 검색과 쇼핑, 주거, 교육, 금융 등 국민이 일상에서 사용하는 서비스에 AI를 접목해 활용 범위를 넓힌다는 구상이다. AI 모델·플랫폼 분야에서는 업스테이지, 모티프테크놀로지스, NC AI, 액션파워 등이 참여한다. 각 기업이 보유한 AI 모델과 플랫폼 기술을 활용해 생활 서비스에 적용할 수 있는 AI 기능을 개발하고 확산하는 역할을 맡는다. AI 인프라 분야에는 래블업, 리벨리온, 베슬AI코리아 등이 합류한다. AI 서비스가 실제 대규모 이용 환경에서 안정적으로 작동하려면 모델뿐 아니라 연산 인프라와 운영 기술이 필요하다는 판단에 따른 것으로 풀이된다. 이번 컨소시엄은 국내 AI 기업의 기술을 실제 이용자가 사용하는 서비스로 연결하는 것에 중점을 두고 진행된다. 기존 국내 AI 산업이 모델 개발과 기술 경쟁에 집중했다면, 이번 사업을 통해 검색·교육·금융·쇼핑 등 구체적인 서비스에 AI를 적용해 활용성을 검증하겠다는 것이다. 특히 생성형 AI 확산으로 AI 모델의 성능뿐 아니라 이를 안정적으로 운영할 수 있는 인프라와 서비스 접점의 중요성도 커지고 있다. 아무리 성능이 높은 AI 모델을 확보하더라도 이용자가 접근할 수 있는 서비스와 충분한 연산 인프라가 뒷받침되지 않으면 실제 시장 확산으로 이어지기 어렵기 때문이다. KT는 통신과 클라우드 사업을 통해 확보한 인프라와 AI 플랫폼 역량을 컨소시엄의 연결고리로 활용한다. 다양한 기업이 개발한 AI 기술을 하나의 서비스 환경에서 구현하고 대규모 이용자를 대상으로 안정성과 활용성을 검증하는 역할을 맡는 것으로 분석된다. 이번 컨소시엄을 통해 KT는 기존 AI·클라우드 사업과 연결할 수 있을 것으로 전망된다. AI 서비스가 확대될수록 추론 연산과 데이터 처리 수요도 증가하는 만큼 통신망과 클라우드, AI 인프라를 함께 확보한 KT가 서비스 운영 기반을 제공할 수 있다. KT는 이번 사업을 통해 국민의 AI 접근성을 높이는 동시에 국내 AI 기업의 기술 활용 기회를 확대하고 AI 생태계 활성화에 나선다는 방침이다. 이진형 KT AX사업본부장 상무는 "KT는 국내 대표 AI 기업들과 함께 '모두의 AI' 사업을 제안하며, 국민 누구나 쉽고 신뢰할 수 있는 AI의 혜택을 누릴 수 있도록 기여할 계획"이라며 "국내 대표 AI 기업들의 역량과 KT의 통신·AI 운영 역량을 결합해 안정적이고 신뢰할 수 있는 대한민국 AI 서비스를 준비해 나가겠다"고 말했다.
2026-08-19 17:13:15
-
"AI의 무대가 바뀐다"…데이터센터서 단말·공장으로 옮겨가는 AI
[경제일보] 생성형 인공지능(AI) 확산으로 대규모 연산을 데이터센터에서 처리하는 방식이 주류로 자리 잡은 가운데 AI를 단말과 산업 현장에 직접 배치하는 '온디바이스 AI'와 '엣지 AI'가 새로운 경쟁 영역으로 부상하고 있다. 영상 분석과 로봇, 자동차, 스마트팩토리 등 실시간 대응과 데이터 보안이 중요한 분야에서는 모든 데이터를 중앙 데이터센터로 전송하는 방식에 한계가 있기 때문이다. 국내 기업들도 AI 반도체와 경량화된 AI 모델을 결합해 현장에서 AI를 구동하는 사업에 속도를 내고 있다. 19일 업계에 따르면 최근 AI 산업의 경쟁 구도가 대규모 데이터센터와 GPU 확보에서 AI 연산을 실제 서비스가 발생하는 현장으로 분산하는 방향으로 확대되고 있다. 생성형 AI 서비스가 고도화하면서 데이터센터의 대규모 GPU 연산 능력이 중요해졌지만, 모든 데이터를 클라우드나 데이터센터로 보내 처리할 경우 네트워크 지연과 데이터 전송 비용, 보안 등의 문제가 발생할 수 있기 때문이다. 특히 카메라와 센서를 통해 주변 환경을 실시간으로 인식해야 하는 로봇과 자동차, 산업 현장에서는 AI 연산을 가까운 곳에서 처리하는 것이 중요하다. 이에 AI 모델과 연산 장치를 단말이나 현장에 배치하는 온디바이스 AI와 엣지 AI가 주목받고 있다. 온디바이스 AI는 스마트폰이나 로봇, 자동차 등 기기 자체에서 AI 연산을 수행하는 방식이며, 엣지 AI는 데이터가 발생하는 현장과 가까운 서버나 장비에서 AI 연산을 처리하는 개념이다. 두 방식 모두 중앙 데이터센터에 대한 의존도를 낮추고 민감한 데이터를 외부로 전송하지 않으면서 실시간으로 AI를 구동할 수 있는 것으로 평가된다. 이에 AI 반도체 경쟁도 단순히 GPU와 NPU 가운데 어느 쪽이 우위에 있느냐를 넘어 사용처에 맞는 연산 구조를 확보하는 방향으로 바뀌고 있다. 대규모 AI 모델 학습에는 GPU가 활용되고, 현장에서 반복적으로 수행되는 추론 작업은 전력 효율과 지연 시간 등을 고려해 NPU를 활용하는 방식이다. KT는 국산 AI 반도체와 자체 대규모 언어 모델(LLM)을 결합한 기업용 AI 어플라이언스를 출시하며 이 같은 시장 변화에 대응하고 있다. KT가 선보인 'KT NPU LLM 스테이션'은 국내 AI 반도체 기업 리벨리온의 추론 특화 신경망 처리 장치(NPU) 'ATOM-MAX'와 KT의 독자 LLM '믿음 K 2.5 Pro', 운영 API 플랫폼을 하나의 서버에 통합한 완제품형 장치다. 기업 내부에 장비를 설치해 데이터와 AI 연산을 사내에서 처리할 수 있도록 한 것이 특징이다. 망 분리 등 보안 규제가 적용되는 공공·국방·제약·제조·금융 분야에서 외부 클라우드 기반 생성형 AI를 활용하기 어려운 기업을 겨냥한 것으로 풀이된다. KT는 향후 이를 피지컬 AI를 위한 엣지 데이터 센터로 확대해 저전력·저지연 AI 인프라로 활용한다는 계획이다. 제조 현장에서도 AI 연산을 현장 가까이에서 처리하려는 움직임이 나타나고 있다. 포스코DX는 국산 AI 반도체를 활용해 산업 현장에서 발생하는 비정형 데이터를 분석하는 플랫폼 개발에 나섰다. 공장 내 카메라와 센서 등에서 발생하는 데이터를 현장에서 AI로 분석해 설비와 작업 환경을 실시간으로 판단하는 방식으로, 제조 현장의 AI 적용 범위를 확대하려는 시도다. 특히 제조업에서는 생산 과정에서 발생하는 영상·센서 데이터의 양이 많고 외부 전송이 제한되는 경우도 있어 모든 데이터를 중앙 서버로 보내 분석하는 데 비용과 시간이 발생한다. 포스코DX는 현장에서 AI 추론을 수행하면 필요한 데이터만 선별해 처리할 수 있어 실시간성이 중요한 품질 검사와 이상 징후 탐지 등에서 활용도가 높아질 것으로 전망하고 있다. AI가 실제 공간에서 움직이는 피지컬 AI 시장이 커질수록 이러한 엣지 AI 수요도 확대될 전망이다. 로봇과 드론, 자율주행차 등이 주변 환경을 실시간으로 인식하고 판단하려면 카메라와 각종 센서에서 발생하는 데이터를 빠르게 처리해야 한다. 자동차 역시 운전자 상태 분석이나 주행 환경 판단 등 일부 AI 연산을 차량 내부에서 처리하는 구조가 확대될 것으로 분석된다. 이 과정에서 AI 반도체 성능뿐 아니라 AI 모델 최적화와 소프트웨어 생태계 구축도 중요해지고 있다. 같은 NPU를 사용하더라도 AI 모델을 하드웨어 특성에 맞게 최적화하지 못하면 기대한 성능과 전력 효율을 확보하기 어렵기 때문이다. 온디바이스 AI 시장의 경쟁은 'GPU 대 NPU'의 단순한 대결보다는 AI 연산을 어디에서, 어떤 방식으로 처리할 것인지에 대한 경쟁으로 확대될 전망이다. 데이터센터에서 단말과 공장, 자동차, 로봇 등으로 AI의 무대가 넓어지면서 AI 반도체 기업뿐 아니라 통신사와 제조·플랫폼 기업까지 새로운 시장을 둘러싼 경쟁에 뛰어들고 있다. 이진형 KT AX사업본부장 상무는 "'KT NPU LLM 스테이션'은 KT의 AX 풀스택 역량과 국산 반도체를 결합해 소버린 AI를 실제 산업 현장에서 즉시 사용할 수 있도록 만든 것"이라며 "데이터 주권을 지키면서 AI 전환을 시작하려는 기업과 기관에 가장 현실적인 선택지가 될 것"이라고 말했다.
2026-08-19 14:30:55
-
SKT, '모두의AI' 출사표…A.X K2·AI 데이터센터·2250만 회선 총동원
[경제일보] SK텔레콤이 정부의 '모두의AI' 사업에 참여해 통신 가입자 기반의 대규모 AI(인공지능) 서비스 확산에 나선다. 자체 AI 모델과 데이터센터 등 인프라뿐 아니라 금융·의료·교육·모빌리티 등 생활 영역별 전문기업을 묶어 단순 챗봇을 넘어 공공서비스 신청과 결제까지 대신하는 AI 에이전트로 서비스를 확대한다는 전략이다. 19일 SK텔레콤은 과학기술정보통신부와 정보통신산업진흥원이 추진하는 '모두의AI' 사업 공모에 참여한다고 밝혔다. SK텔레콤은 AI 모델·인프라·서비스를 모두 자체 보유한 역량을 기반으로 금융, 의료, 교육, 공공, 모빌리티 등 다양한 분야의 기업·기관과 컨소시엄을 구성했다. SK텔레콤은 이번 사업을 'AI를 누구나 쉽게 사용하는 서비스'를 목표로 진행한다. AI에 익숙하지 않은 이용자도 별도의 전문 지식 없이 일상적인 대화 방식으로 필요한 정보를 찾고 실제 업무까지 처리할 수 있도록 서비스 범위를 확대한다는 구상이다. SK텔레콤은 우선 대화와 검색·요약, 문서·이미지 분석, 일정 관리 등을 지원하는 AI 챗봇을 구축한 뒤 공공서비스 탐색·신청과 증명서 발급, 금융·의료·교통·교육 분야의 예약과 신청·결제 등을 수행하는 AI 에이전트로 발전시킬 계획이다. 기존 AI 서비스가 질문에 대한 답변이나 정보 검색에 집중했다면, SK텔레콤은 이용자의 요청을 실제 행동으로 연결하는 데 초점을 맞춘다. 이용자가 AI에 특정 서비스를 찾으면 AI가 관련 정보를 제공하는 데서 끝나는 것이 아니라 예약이나 신청 등 후속 절차까지 AI가 수행하는 방식이다. 이를 위해서는 AI 모델의 성능뿐 아니라 외부 서비스와 연동할 수 있는 인프라와 이용자 인증·권한 관리, 개인정보 보호 등 운영 체계가 필요한 것으로 꼽힌다. SK텔레콤이 금융·의료·공공 등 각 분야 전문기업을 컨소시엄에 포함한 것도 이 같은 서비스 실행력을 확보하기 위한 것으로 풀이된다. SK텔레콤은 자체 AI 모델인 'A.X K2'도 이번 사업에 활용한다. A.X K2는 매개변수 6880억개 규모의 자체 AI 모델로, 정부의 '독자 AI 파운데이션 모델' 프로젝트를 통해 개발됐다. SK텔레콤은 단순 질의에는 상대적으로 가벼운 모델을 활용하고 복잡한 작업에는 고성능 모델을 적용하는 방식으로 서비스 품질과 운영 효율을 동시에 확보한다는 계획이다. AI 서비스 확산의 기반으로는 약 2250만개에 달하는 통신 회선과 기존 고객 접점이 활용된다. 과학기술정보통신부에 따르면 지난 6월 기준 SK텔레콤의 이동통신 회선은 2249만8579개로, 사물인터넷(IoT)과 알뜰폰(MVNO)을 제외한 수치다. 기존 통신 서비스와 온·오프라인 채널을 통해 AI 서비스를 확산할 수 있어, AI를 통신 서비스의 부가 기능으로 제공하는 수준을 넘어 대규모 고객 기반을 활용해 AI 서비스의 초기 이용자를 확보할 수 있다는 점이 강점으로 꼽힌다. AI 인프라 확보에도 속도를 내고 있다. 앞서 SK텔레콤은 지난달 AI 데이터센터 사업을 전담하는 'SK하이퍼'를 설립하고 오는 2029년까지 5기가와트(GW) 규모의 AI 데이터센터를 단계적으로 구축하겠다는 계획을 밝힌 바 있다. AI 모델부터 데이터센터, 서비스까지 직접 확보하는 구조를 구축하면서 AI 사업의 수직계열화를 강화하고 있는 것이다. 특히 AI 에이전트가 본격적으로 확산될 경우 추론 수요가 크게 늘어날 수 있는 만큼 서비스 이용자 확대와 함께 AI 연산 인프라를 확보하는 것이 경쟁력으로 이어질 수 있다는 판단이다. 이번 '모두의AI' 컨소시엄에는 20여개 기업과 기관이 참여한다. 라이너와 페르소나AI 등은 특화 검색과 공공 데이터 연계 분야를 맡고, 신한카드와 하나카드는 금융·결제 서비스를 담당한다. 티맵모빌리티는 모빌리티, SK브로드밴드는 콘텐츠·미디어, 엘리스그룹은 교육 분야에서 협력한다. 의료·헬스케어 분야에서는 굿닥과 사운더블헬스가 참여하고 해빗팩토리는 보험 분야 서비스를 담당한다. 독거노인종합지원센터와 채널코퍼레이션, 알프레드, 한국세무사회전산법인 등도 공공·돌봄·중소사업자·세무 관련 AI 서비스 개발에 참여한다. AI 모델과 인프라 분야에서는 노타, 셀렉트스타, 에이투시스가 참여한다. 모델 최적화와 데이터 기반 학습, 모델 라우팅 등을 지원하며 에임인텔리전스는 인증·권한 관리와 AI 에이전트 실행 통제 등 보안 분야를 맡는다. 해시드벤처스는 AI 서비스와 기술 제휴 대상을 발굴하는 역할을 담당한다. AI 활용 격차를 줄이는 것도 이번 사업의 주요 목표다. AI 기술이 빠르게 확산하고 있지만 서비스별로 이용 방법을 익혀야 하거나 복잡한 프롬프트를 작성해야 하는 경우 일반 이용자의 접근성이 떨어질 수 있다. SK텔레콤은 기존 통신 서비스처럼 익숙한 이용 환경에서 AI를 제공해 이러한 진입장벽을 낮추겠다는 구상이다. SK텔레콤 역시 컨소시엄 참여 기업을 확대하고 사업 영역을 넓혀 AI 생태계를 구축한다는 계획이다. 통신 가입자 기반과 AI 모델, 데이터센터를 연결하고 외부 전문기업의 서비스를 결합해 국민이 일상에서 실제로 사용할 수 있는 AI 서비스 확보를 목표로 진행된다. 김지훈 SK텔레콤 AI사업본부장은 "AI 활용 격차가 사회적 격차로 이어지지 않도록 누구나 AI의 혜택을 누릴 수 있는 환경이 필요하다"며 "SK텔레콤은 AI 모델부터 인프라, 서비스 운영까지 아우르는 풀스택 AI 역량과 전국 통신 고객 접점을 바탕으로 국민 모두가 쉽게 사용할 수 있는 '모두의 AI' 서비스 구현에 힘쓰겠다"고 말했다.
2026-08-19 09:54:35
-
KAIST 찾은 '구글의 전설' 제프 딘…"AI 경쟁, 결국 컴퓨팅 효율 싸움"
[경제일보] 인공지능(AI) 산업의 경쟁 구도가 거대언어모델(LLM)의 성능 경쟁에서 컴퓨팅 자원을 얼마나 확보하고 효율적으로 활용하느냐의 경쟁으로 이동하고 있다. 구글에서 27년간 AI와 컴퓨팅 인프라의 발전을 이끌었던 제프 딘이 한국에서 던진 메시지도 여기에 집중됐다. 딘은 지난 13일 서울 AI 허브에서 열린 특별강연에서 “향후 몇 년간 AI 발전의 핵심은 하드웨어와 컴퓨팅 자원을 얼마나 확보하고 효율적으로 사용하는가에 달려 있다”고 강조했다. 단순히 더 큰 모델을 만드는 것만으로 AI 경쟁력을 확보하기 어려워지고 있다는 의미다. 이번 강연은 딘이 구글을 떠난 뒤 사실상 첫 공식 행보라는 점에서도 주목받았다. KAIST와 국가AI연구거점의 공동 초청으로 마련된 행사에는 KAIST를 비롯해 고려대·연세대·포스텍 등 컨소시엄 대학의 연구진과 학생, 기업 관계자 등 150여명이 참석했고 온라인으로도 220여명이 참여했다. 딘은 1999년 구글에 합류한 이후 검색 인프라를 비롯해 구글의 AI 연구 기반을 구축한 핵심 인물이다. 분산 시스템 연구를 기반으로 대규모 연산을 효율적으로 처리하는 기술을 발전시켰고, 텐서플로와 구글의 AI 전용 반도체인 TPU 개발에도 관여했다. 최근까지는 구글 수석과학자로 차세대 AI 모델 제미나이 개발을 이끌었다. 그런 그가 구글을 떠나 과학 연구를 위한 AI 스타트업 ‘디스커버리 루프’를 창업하면서 업계의 관심이 집중됐다. 구글과 같은 빅테크의 최고 수준 연구 환경을 떠나 새로운 회사를 선택한 만큼, 그의 이번 발언은 단순한 기술 전망 이상의 의미를 갖는다. ◆ AI의 다음 병목은 ‘모델’보다 ‘연산’ 딘이 강조한 것은 AI 발전을 바라보는 시각 자체의 변화다. 그는 학부 시절 신경망 학습을 연구했지만 당시 컴퓨팅 성능의 한계 때문에 연구 성과를 내기 어려웠고, 20여년이 지나 충분한 연산 자원이 확보되면서 당시 아이디어가 현실화됐다고 설명했다. 지난 15년간 AI의 발전 역시 특정한 알고리즘 하나가 등장했기 때문이라기보다 연산 능력·데이터·모델 규모가 함께 확대된 결과라는 것이 그의 설명이다. 이 발언은 현재 AI 산업의 경쟁 구도를 정확히 관통한다. 챗GPT를 비롯한 생성형 AI가 대중화된 이후 기업들은 더 많은 데이터를 학습시키고 더 큰 모델을 구축하는 방식으로 경쟁해왔다. 그러나 모델 규모가 커질수록 학습과 추론에 필요한 컴퓨팅 비용도 폭증한다. 결국 AI 모델을 얼마나 잘 만드는가와 동시에 필요한 연산량을 얼마나 적은 비용으로 처리할 수 있는가가 기업 경쟁력의 핵심이 된다. 엔비디아가 AI 가속기 시장을 장악한 것도 같은 맥락이다. 구글이 자체 TPU를 개발한 이유 역시 외부 반도체에만 의존하지 않고 AI 연산 구조에 맞는 하드웨어와 소프트웨어를 함께 최적화하기 위해서였다. 딘의 경력 자체가 이를 보여준다. 대규모 분산 시스템을 연구하던 컴퓨터과학자가 구글에서 TPU와 AI 시스템 개발에 참여한 것은 AI가 발전할수록 모델과 반도체, 데이터센터, 소프트웨어를 하나의 시스템으로 설계해야 한다는 흐름과 맞닿아 있다. ◆ 한국 AI도 ‘모델 개발’ 이후를 준비해야 이번 딘의 KAIST 방문은 국내 AI 산업에도 시사하는 바가 크다. 한국의 AI 전략은 그동안 자체 파운데이션 모델 확보와 GPU 확보에 상당한 무게가 실렸다. 하지만 모델을 하나 확보한다고 AI 경쟁력이 완성되는 것은 아니다. 대규모 모델을 학습시키고 실제 서비스에 적용하기 위해서는 GPU와 AI 반도체, 데이터센터, 네트워크, 저장장치, 소프트웨어 등 전체 시스템을 효율적으로 연결해야 한다. KAIST가 추진하는 ‘AI 시스템 이니셔티브’ 역시 이 지점에 초점을 맞추고 있다. AI 모델 자체뿐 아니라 하드웨어와 시스템 소프트웨어를 함께 최적화해 제한된 컴퓨팅 자원을 최대한 활용하는 것이 목표다. 최근 글로벌 빅테크와 KAIST의 협력이 이어지는 것도 주목할 부분이다. 엔비디아가 KAIST와 AI 공동연구소 및 피지컬AI센터 설립을 추진한 데 이어 구글의 핵심 AI 연구자가 직접 KAIST를 찾아 연구진과 분산 시스템과 AI 인프라를 논의했다. 이는 한국이 AI 모델 경쟁에서 단순히 해외 기술을 활용하는 수준을 넘어 AI 시스템 전체를 연구할 수 있는 기반을 확보해야 한다는 신호로 해석할 수 있다. 딘이 강연에서 “AI가 인간을 대체하느냐”는 질문에 인간과 AI가 각자의 강점을 활용하는 것이 중요하다고 답한 것도 같은 맥락이다. AI를 인간의 대체재로만 볼 것이 아니라 인간이 해결하지 못했던 문제를 풀기 위한 연구 도구로 활용해야 한다는 것이다. 그가 창업한 디스커버리 루프가 과학 연구를 AI의 주요 적용 분야로 삼은 것도 의미가 있다. AI가 검색과 문서 작성, 코딩을 넘어 신약과 소재, 물리학 등 과학적 발견의 속도를 높이는 방향으로 확장될 경우 필요한 컴퓨팅 규모는 지금보다 더욱 커질 수밖에 없다. 한편 딘이 한국에서 던진 메시지는 명확하다. AI 경쟁의 다음 승부처는 더 큰 모델을 만드는 데서 끝나지 않는다. 얼마나 많은 연산 자원을 확보하고, 이를 얼마나 효율적으로 연결하고 활용하느냐가 관건이다. 한국이 AI 강국을 목표로 한다면 GPU 확보량이나 국산 모델 개발 성과만을 경쟁력의 기준으로 삼아서는 안 된다. 반도체부터 데이터센터, 네트워크, 분산 시스템, 모델까지 이어지는 ‘AI 풀스택’ 경쟁력을 확보해야 한다. 27년간 구글의 AI 역사를 만들어온 연구자가 퇴사 직후 한국에서 가장 먼저 강조한 것도 결국 이 지점이었다. AI 시대의 진짜 경쟁은 모델의 크기가 아니라 그것을 움직이는 시스템의 경쟁으로 넘어가고 있다.
2026-08-19 07:55:41
-
네이버, '모두의 AI' 끝내 불참…국가 AI 사업 '흥행' 시험대
[경제일보] 네이버가 정부의 전 국민 무료 인공지능(AI) 서비스 ‘모두의 AI’ 사업에 최종 불참한다. 국내 최대 플랫폼 기업이자 자체 AI 모델을 보유한 네이버가 빠지면서 정부가 추진하는 대국민 AI 서비스 사업이 어떤 형태로 진용을 꾸릴지 관심이 커지고 있다. 네이버 관계자는 18일 “‘모두의 AI’ 사업자 공모에 참여하지 않는다”며 “현재 추진 중인 기존 AI 사업에 집중할 예정”이라고 밝혔다. 이날 오후 5시 공모 마감을 앞두고 컨소시엄 구성 가능성을 검토했지만 최종적으로 참여하지 않기로 결정했다. ‘모두의 AI’는 과학기술정보통신부와 정보통신산업진흥원(NIPA)이 추진하는 사업이다. 국민 누구나 비용과 이용량 제한 없이 사용할 수 있는 국산 범용 AI 챗봇을 구축하고, 공공서비스 신청 등을 대신 처리하는 AI 에이전트까지 제공하는 것이 핵심이다. 정부는 9월 베타서비스를 거쳐 12월 정식 서비스를 시작한다는 계획이다. 당초 8월 11일이던 공모 마감은 사업자들의 준비 기간을 확보하기 위해 18일 오후 5시로 일주일 연장됐다. 정부가 이 사업을 추진하는 이유는 단순히 ‘한국판 챗GPT’를 하나 더 만들기 위해서가 아니다. 미국과 중국의 AI 서비스에 대한 의존도를 낮추면서 국민 누구나 AI를 사용할 수 있는 기반을 마련하고, 국산 AI 모델을 실제 대국민 서비스로 연결하겠다는 전략이다. 정부는 장기적으로 자산관리와 학습코칭, 노후설계 등을 지원하는 ‘전 국민 1인 1 AI 에이전트’ 체계로 확대한다는 구상도 내놨다. 사업자로 선정되면 상당한 지원도 받을 수 있다. 올해에는 엔비디아의 최신 AI 가속기인 B200 그래픽처리장치(GPU)가 기업별로 최대 256장 또는 128장 지원되고, 2030년까지 운영비 지원도 이어질 예정이다. 다만 대가도 있다. 독자 AI 파운데이션 모델 기준을 충족하는 국산 모델을 최소 50% 이상 사용해야 하고, 자체 모델을 가진 기업도 다른 국내 기업의 국산 모델을 30% 이상 결합해야 한다. 사실상 기업 간 협업과 컨소시엄 구성이 필수적인 구조다. ◆ 네이버가 빠진 이유는 네이버의 불참 배경은 이 같은 사업 구조와 현재 네이버의 AI 전략을 함께 볼 필요가 있다. 네이버는 자체 대규모언어모델(LLM)인 ‘하이퍼클로바X’를 중심으로 검색과 쇼핑, 지도, 광고 등 기존 플랫폼 서비스에 AI를 결합하는 전략을 추진하고 있다. 이미 자체 서비스 안에서 AI 이용자를 확보하고 있는 만큼 정부가 주도하는 별도 무료 플랫폼에 참여해 새로운 서비스를 구축해야 할 유인이 상대적으로 크지 않다는 분석이 나온다. 특히 ‘모두의 AI’는 자체 모델만으로 서비스를 구성할 수 없다는 점이 변수다. 네이버처럼 자체 AI 기술과 플랫폼을 동시에 보유한 기업 입장에서는 다른 기업의 모델을 일정 비율 결합해야 하는 사업 조건이 오히려 기술 전략과 맞지 않을 수 있다. 올해 초 정부의 ‘독자 AI 파운데이션 모델’ 프로젝트에서도 네이버클라우드는 재공모에 참여하지 않았다. 당시에도 업계에서는 기업들이 정부 사업의 타이틀보다 자체 AI 기술과 서비스 경쟁력 확보에 집중하는 방향으로 전략을 바꾸고 있다는 분석이 나왔다. 결국 네이버 입장에서는 정부가 제공하는 GPU와 운영비보다 자체 플랫폼 안에서 AI 사용자를 늘리고 수익모델을 만드는 것이 장기적으로 더 중요하다고 판단했을 가능성이 크다. 네이버가 공식적으로 밝힌 불참 이유는 ‘기존 사업 집중’이지만, 사업 조건과 현재 전략을 종합하면 충분히 예상 가능한 선택이라는 평가다. ◆ 카카오·통신3사는 왜 뛰어드나 반면 카카오와 이동통신 3사의 셈법은 다르다. 카카오는 자체 AI 모델 ‘카나나’를 카카오톡과 연결해 생활밀착형 AI 서비스로 확대할 수 있는 기회로 보고 있다. 이미 5000만명 규모의 이용자를 확보한 카카오톡이라는 플랫폼이 있어 ‘모두의 AI’를 통해 AI 서비스를 대중화할 경우 기존 플랫폼과의 결합 효과를 기대할 수 있다. 카카오는 행정안전부와 공공서비스 예약과 전자증명서 발급 등을 지원하는 ‘AI 국민비서’ 시범 서비스도 운영하고 있다. 통신 3사도 각자의 강점이 뚜렷하다. SK텔레콤은 자체 AI 모델과 AI 서비스 ‘에이닷’, AI 데이터센터를 모두 갖추고 있어 모델부터 인프라, 서비스까지 연결할 수 있다는 점이 강점이다. KT는 AI와 클라우드, 공공·기업 시장에서 쌓은 사업 경험을 활용할 수 있고, LG유플러스는 LG AI연구원과의 협업을 통해 그룹 차원의 AI 역량을 결집하는 전략을 내세우고 있다. 당초 세 회사 모두 참여를 검토했고 LG유플러스는 일찌감치 참여를 공식화했다. 특히 통신사들에게 ‘모두의 AI’는 단순한 무료 서비스 사업 이상의 의미가 있다. 통신 가입자와 기업 고객 중심이었던 AI 사업을 전 국민 서비스로 확장하고, 향후 공공기관과 지방자치단체 등으로 AI 사업 영역을 확대할 수 있는 레퍼런스를 확보할 수 있기 때문이다. ◆ 결국 승부는 ‘컨소시엄’에서 갈린다 네이버가 빠지면서 이제 업계의 관심은 어떤 기업들이 손을 잡느냐로 옮겨가고 있다. 사업 구조상 한 기업이 모든 조건을 충족하기보다 모델·클라우드·데이터·플랫폼·서비스 역량을 가진 기업들이 결합하는 것이 유리하다. 실제 공모 초기부터 카카오와 LG유플러스 외에도 SK텔레콤, KT, 업스테이지, 엔씨(NC) AI, 이스트소프트, 라이너, 코난테크놀로지 등 다양한 기업이 참여를 검토해왔다. 이 때문에 이번 공모는 사실상 국내 AI 기업들의 ‘연합전’ 성격을 띠게 될 가능성이 높다. 어느 기업이 어떤 AI 모델을 제공하고, 누가 GPU와 클라우드를 맡으며, 누가 이용자 접점을 확보하느냐에 따라 향후 국내 AI 생태계의 주도권도 달라질 수 있다. 다만 사업 자체에 대한 우려도 있다. 사업자 선정부터 9월 베타서비스까지 한 달 남짓밖에 남지 않았다. 전 국민이 이용하는 서비스인 만큼 초기부터 대규모 접속에 대응할 인프라와 서비스 안정성을 확보해야 하지만 개발 기간이 빠듯하다. 실제 공모 마감이 연장된 것도 기업들의 준비 부담을 고려한 조치였다. 무엇보다 ‘무료’ 서비스의 지속 가능성이 관건이다. 정부가 2030년까지 운영비를 지원하더라도 장기적으로 국민이 무료로 사용하는 AI 서비스의 비용을 누가 얼마나 부담할지에 대한 구조가 필요하다. 이용자가 늘어날수록 추론 비용도 증가하기 때문이다. ‘모두의 AI’가 성공한다면 정부가 GPU와 데이터를 지원하고 민간이 서비스 경쟁력을 결합하는 새로운 국가 AI 모델이 자리 잡을 수 있다. 반대로 이용자 확보와 서비스 품질, 수익구조를 만들어내지 못한다면 정부 주도 AI 사업의 한계를 보여주는 사례가 될 수도 있다. 한편 네이버가 빠진 자리를 누가 채울지가 중요한 이유다. 이제 ‘모두의 AI’의 경쟁은 참여 기업 숫자가 아니라 누가 국민의 일상 속에서 실제로 쓰이는 AI를 만들어내느냐로 넘어가고 있다.
2026-08-18 16:10:20
-
포스코DX, '국산 NPU' 산업현장 투입…AI 추론 비용 50% 낮춘다
[경제일보] 포스코DX가 국산 AI 반도체를 산업현장의 비정형 데이터 분석에 활용하는 플랫폼을 개발해 기존 GPU 기반 '비전 AI' 적용 영역에 국산 NPU 기반을 확대한다. AI 모델 학습에는 GPU를, 현장 추론에는 국산 NPU를 사용하는 하이브리드 구조를 적용해 제조 현장의 AI 인프라 비용과 전력 부담을 낮추고, 데이터 외부 반출 없이 실시간으로 AI를 운영하도록 구성됐다. 18일 포스코DX는 국산 NPU를 활용한 '비전 AI 플랫폼'을 개발했다고 밝혔다. 산업현장에서 수집되는 영상 등 비정형 데이터를 AI로 분석하고, 실제 현장에서 발생하는 상황을 실시간으로 판단할 수 있도록 AI 모델 개발부터 운영까지 필요한 기능을 하나의 플랫폼으로 표준화한 것이 특징이다. NPU는 딥러닝과 머신러닝 등 AI 연산에 특화된 반도체로 GPU를 대체할 수 있을 것으로 전망되고 있다. 특히 학습보다 이미 학습된 AI 모델을 실제 서비스에 적용하는 추론 과정에 최적화돼 GPU 대비 전력과 비용을 낮출 수 있도록 설계됐다. 포스코DX는 이 같은 NPU의 특성을 산업현장에 적용했다. 제조 현장에서 발생하는 영상 데이터를 원거리 데이터센터나 서버로 전송하지 않고 설비나 현장에 설치된 엣지 장비에서 직접 분석하는 방식이다. 포스코DX는 외부 네트워크를 거치지 않고 현장에서 데이터를 처리할 수 있어 제조업에서 중요도가 높은 데이터 보안과 실시간 대응에도 유리하다고 설명했다. 특히 포스코DX는 AI 모델을 개발하는 단계와 실제 현장에서 AI가 데이터를 분석하는 추론 단계를 분리했다. 모델 학습과 개발에는 기존처럼 GPU를 활용하고, 완성된 AI 모델을 산업 현장에서 구동할 때는 국산 NPU를 사용하는 하이브리드 구조다. NPU를 실제 현장에 적용하기 전에 연구·검증 단계에서도 활용할 수 있도록 한 것도 특징이다. AI 모델의 정확도와 처리 속도뿐 아니라 전력 사용량과 운영 비용 등을 사전에 비교해 현장 특성에 맞는 모델과 NPU 적용 방식을 결정할 수 있도록 구축했다. 기존에는 AI 모델을 개발한 뒤 실제 산업 현장에 적용하면서 성능이나 비용을 검증해야 했다면, 이번 플랫폼에서는 개발 단계에서부터 NPU 기반 추론 성능을 확인할 수 있어 현장 적용 과정에서 발생할 수 있는 시행착오를 줄일 수 있을 것으로 평가된다. 비전 AI 플랫폼에는 산업 현장에서 반복적으로 필요한 기능도 표준화했다. 영상 데이터를 학습 데이터로 관리하고 AI 모델을 관리하는 기능을 비롯해 모델별 성능 지표와 적용 이력 등을 하나의 환경에서 관리할 수 있도록 구성했다. 해당 기능 표준화는 제조 현장마다 AI 시스템을 새로 구축하는 방식에서 벗어나 기존에 검증된 AI 모델과 플랫폼을 다른 현장에 재활용하기 위한 기반으로 알려졌다. 포스코DX는 플랫폼을 통해 신규 AI 프로젝트의 개발 기간을 단축하고 여러 산업 현장으로 AI 서비스를 확산할 수 있을 것으로 전망하고 있다. 포스코DX는 앞서 국내 NPU 개발사인 딥엑스, 모빌린트 등과 협력해 화재 감시, 작업자 안전 모니터링, 물류 환경의 상품 적재 상태 확인 등에 국산 NPU를 적용해 비용 절감 효과도 확인했다. 그 결과 동일한 추론 성능을 기준으로 GPU를 사용하는 경우와 비교해 인프라 구축·운영 비용을 약 50% 절감하고, 전력 사용량은 약 90% 줄이는 효과를 기록했다. 산업 현장에서 AI 활용이 늘면서 AI 반도체의 역할도 학습용 GPU 중심에서 추론용 반도체로 확대될 가능성이 커지고 있다. 특히 제조 현장의 영상 분석처럼 대량의 데이터를 실시간으로 반복 처리해야 하는 분야에서는 모든 데이터를 중앙 데이터센터로 전송해 처리하는 방식보다 현장에서 직접 AI 추론을 수행하는 엣지 AI가 비용과 지연 시간 측면에서 유리할 수 있다. 포스코DX는 향후 다양한 검증 과정을 플랫폼에 포함해 국산 NPU의 산업 적용을 체계화한다는 방침이다. 기존 비전 AI 적용 현장을 단계적으로 국산 NPU 기반으로 전환하고, 화재 감시와 안전 관리, 물류를 넘어 다양한 산업 분야로 적용 영역을 넓힐 계획이다. 포스코그룹 차원의 피지컬 AI 사업 확대와도 연계될 전망이다. 포스코그룹은 철강 생산 과정에서 축적한 설비 자동화 경험과 방대한 현장 데이터를 기반으로 제조 현장에 피지컬 AI를 적용하고, 인텔리전트 팩토리 구축을 확대하고 있다. 포스코DX 관계자는 "NPU 기반 '비전 AI 플랫폼'은 산업 현장에 최적화된 AI를 보다 효율적으로 구현하는 기반이 될 것"이라며 "국산 NPU 활용의 체계화와 산업 현장의 추론 역량 향상에 기여하며 AI 반도체 생태계 활성화에 나설 것"이라고 말했다.
2026-08-18 16:00:26
-
통신보다 AI가 더 큰다…이통3사, 데이터센터에 미래 건다
[경제일보] 이동통신 3사의 실적을 읽는 공식이 달라지고 있다. 과거 가입자 수와 5G 보급률, 가입자당평균매출(ARPU)이 핵심 지표였다면 이제는 인공지능(AI) 데이터센터(AIDC)와 AI 전환(AX) 사업이 새로운 성장 지표로 등장했다. 통신 본업의 성장성이 둔화하는 가운데 AI 연산 인프라를 새로운 먹거리로 키우는 모습이다. 18일 통신업계에 따르면 SK텔레콤의 2분기 AI 데이터센터 매출은 1362억원으로 전년 동기 대비 92.5% 증가했다. KT와 KT클라우드의 AX 매출은 3678억원으로 22.3% 늘었고, KT클라우드 매출도 2654억원으로 19.8% 성장했다. LG유플러스의 AIDC 매출은 1241억원으로 28.9% 증가했다. 반면 기존 통신사업의 성장 속도는 상대적으로 더뎠다. 같은 기간 KT 무선서비스 매출은 1.8% 감소했고 LG유플러스 모바일 수익은 0.9% 증가하는 데 그쳤다. AI 사업이 아직 통신 본업을 대체할 수준은 아니지만, 성장률만 보면 통신사가 어디에 다음 승부를 걸고 있는지는 분명해진다. ◆ 데이터 저장소에서 AI 연산 인프라로 AIDC 시장이 커지는 배경에는 생성형 AI 확산이 있다. AI는 모델을 학습할 때뿐 아니라 이용자가 질문하고 답변을 받는 추론 과정에서도 막대한 연산 자원을 필요로 한다. AI 서비스가 일상화될수록 GPU 연산과 전력 수요도 함께 증가할 수밖에 없다. 기존 데이터센터보다 AIDC의 설비 부담이 큰 이유다. 고성능 GPU를 밀집해 운용하려면 더 많은 전력과 고도화된 냉각설비가 필요하다. 대신 통신사 입장에서는 기존 데이터센터 운영 경험에 통신망, 클라우드, 보안, 기업 고객을 결합해 단순 상면 임대 이상의 사업으로 확장할 수 있다. 통신 3사의 투자 방식은 서로 다르다. SK텔레콤은 대규모 용량 선점에 나섰다. 2029년부터 5GW 규모의 AIDC를 단계적으로 확보하고 2035년까지 15GW로 확대한다는 목표다. AIDC 사업개발을 전담할 SK하이퍼도 출범시켜 2030년까지 최대 7500억원을 출자할 계획이다. 다만 대규모 프로젝트마다 고객을 먼저 확보하고 전략적·재무적 투자자와 프로젝트파이낸싱(PF)을 활용해 자본 부담을 낮춘다는 전략이다. KT는 AIDC를 플랫폼으로 확장한다. 향후 5년간 5조원을 투입해 1GW 규모의 AIDC 용량을 확보하고 기존 데이터센터와 지역 거점, 전국 국사를 AI 인프라로 연결한다. 특히 ‘토큰 팩토리’를 통해 AI 연산량을 측정하고 과금하는 구조를 구축해 데이터센터에서 발생하는 연산을 직접 매출로 연결한다는 구상이다. LG유플러스는 파주를 중심으로 자체 투자와 자산경량화를 병행한다. 200MW급 하이퍼스케일 AIDC를 구축하는 가운데 최근 1조3489억원을 추가 투자해 2·3단계 시설 확대에 나섰다. 동시에 임차와 DBO 방식을 활용해 자본 부담을 관리한다. ◆ 결국 승부는 ‘전력’과 ‘고객’ AIDC 경쟁의 핵심은 단순한 규모가 아니다. 부지와 전력, GPU, 냉각설비를 확보하는 동시에 데이터센터를 채울 장기 고객을 확보해야 한다. 특히 AI 데이터센터는 전력 소모가 큰 만큼 전력망 확보가 사업의 병목으로 떠오르고 있다. 통신 3사가 최근 정부에 AIDC 투자세액공제 확대와 전력·인허가 제도 개선 등을 요구한 것도 같은 이유다. 한편 앞으로의 경쟁은 ‘누가 가장 큰 데이터센터를 짓느냐’보다 ‘누가 AI 연산을 안정적인 수익으로 바꾸느냐’에 달렸다. 막대한 투자비를 투입한 AIDC가 실제 고객과 매출, 이익으로 이어질 수 있을지가 통신 3사의 AI 베팅 성패를 가를 전망이다. [아주경제 2026년 08월 18일자 13면에 게재된 기사입니다.]
2026-08-18 09:42:20
-
독파모 2차 관문 앞…3팀 압축 임박…LG '몸집 키우기' VS '효율형 AI 효율·에이전트'
[경제일보] 정부의 독자 인공지능(AI) 파운데이션 모델 프로젝트(독파모) 2차 평가 결과 발표가 임박했다. LG AI연구원과 SK텔레콤, 업스테이지, 모티프테크놀로지스 4개 팀 가운데 3개 팀만 다음 단계에 진출한다. 독파모는 새 정부의 'AI 3대 강국 도약' 전략 핵심 과제로 지난해 8월 시작됐다. 해외 AI 모델 의존도를 낮추고 기술·경제·안보 리스크를 줄이겠다는 목적으로, 총사업비 1576억원을 들여 팀당 데이터 구축비 30억~50억원과 연간 20억원가량의 연구비, 컴퓨팅 자원을 지원한다. 6개월 단위 평가로 매번 팀을 떨어뜨려 2027년 상반기까지 최종 1~2개 팀만 남기는 구조다. 첫 단추부터 순탄치 않았다. 애초 선정된 5개 팀(네이버클라우드·NC AI·LG AI연구원·SK텔레콤·업스테이지) 가운데 지난 1월 15일 발표된 1차 평가에서 네이버클라우드와 NC AI가 동반 탈락했다. 네이버클라우드는 오픈소스 모델을 차용했다는 의혹이 불거지며 독자성 기준에 부합하지 못한다는 판정을 받았고, NC AI는 종합 점수 경쟁에서 밀렸다. 당초 계획보다 1개 팀이 더 빠지자 정부는 패자부활전을 열었지만 네이버클라우드와 NC AI, 그리고 최초 선정에서 탈락했던 카카오까지 국내 IT 양강이 모두 재도전을 거부했다. 결국 2월 20일 모티프테크놀로지스 컨소시엄이 새 정예팀으로 뽑히며 4개 팀 체제가 만들어졌다. 과학기술정보통신부는 독파모 2차 단계평가를 마무리하고 조만간 결과를 발표할 예정이다. 대상은 △LG AI연구원 'K-엑사원 2.0' △SK텔레콤 '에이닷엑스 케이투(A.X K2)' △업스테이지 '솔라 오픈 2' △모티프테크놀로지스 '모티프3'다. 평가는 벤치마크 40점(글로벌 평가기관 아티피셜 애널리시스 25점, NIA 자체 벤치마크 15점), 전문가 평가 35점, 국민 평가단 200명이 참여하는 사용자 평가 25점으로 구성된다. 외부에 공개된 벤치마크 지표만으로 결과를 예단하기 어려운 것도 이 때문이다. 네 팀의 전략은 두 갈래로 갈린다. 규모로 밀어붙인 쪽은 LG와 SKT다. LG AI연구원의 K-엑사원 2.0은 파라미터 7500억 개(750B)로 1차 모델(236B)보다 3배 이상 커졌고, 코딩·에이전틱 코딩 지표를 이전 대비 약 30% 개선했다고 밝혔다. 장문 이해 평가 OpenAI-MRCR 94.4점, 한국어 장문 이해 Ko-LongBench 89.6점을 기록했고 지원 언어도 10개로 늘렸다. SKT의 에이닷엑스 케이투(688B)는 수학·한국어 추론에 집중해 2026년 국제수학올림피아드(IMO) 평가에서 42점 만점에 29점으로 금메달 기준선을 넘겼고, 고난도 수학 추론 평가 MathArena AIME 2026에서는 97.1% 정확도로 싱킹 머신스랩의 오픈웨이트 모델 '잉클링'과 공동 최고점을 기록했다. 업스테이지와 모티프테크놀로지스는 작은 몸집으로 효율을 택했다. 업스테이지의 솔라 오픈 2(250B)는 실제 연산에는 150억 개만 쓰는 전문가 혼합(MoE) 구조로, 양자화 시 엔비디아 H200 GPU 2장으로 구동할 수 있다. 모티프3(314B)는 은행 업무 처리와 IT 장애 진단 등 실무형 평가에서 강점을 보였다. 공개된 AAII(Artificial Analysis Intelligence Index) 지표에서는 이 구도가 뒤집힌다. 모티프3가 47점으로 1위, 업스테이지 솔라 오픈 2가 37점으로 뒤를 이었고 SKT 35점, LG 31점 순이었다. 모델 규모는 LG와 SKT가 앞서지만 공개 지표에서는 상대적으로 작은 모티프와 업스테이지가 높은 점수를 받은 셈이다. 다만 AAII는 전체 평가의 25%에 불과해 이 순위가 곧 정부 최종 순위로 이어지지는 않는다. 2차 평가를 통과한 3개 팀은 추가 단계평가를 거쳐 최종 2개 팀으로 압축된다. 정부는 이 과정에서 확보한 고성능 GPU 배분과 국가기록원·대법원 판결문 등 공공데이터 제공을 병행해 2027년까지 글로벌 톱10 수준의 모델을 만들겠다는 목표를 세웠다.
2026-08-18 09:40:27
-
딥엑스, 온디바이스 AI 반도체 77건 수주…로봇·드론·제조로 사업 확대
[경제일보] 인공지능(AI)이 클라우드를 넘어 로봇·드론·스마트팩토리 등 실제 산업 현장으로 확산되면서 전력 효율이 높은 온디바이스 AI 반도체의 중요성이 커지고 있다. 대규모 연산을 처리하는 데이터센터용 그래픽처리장치(GPU)와 달리 제한된 전력과 공간에서 AI를 구동해야 하는 피지컬 AI 분야에서는 저전력 신경망처리장치(NPU)가 핵심 부품으로 부상하고 있다. 국내 초저전력 AI 반도체 기업 딥엑스는 양산 제품을 앞세워 로봇과 제조, 모빌리티, 의료 등 글로벌 피지컬 AI 시장을 정조준하고 있다. 14일 딥엑스는 지난해 8월 온디바이스 AI용 NPU 'DX-M1' 양산을 시작한 이후 한국을 비롯해 미국, 중국, 유럽, 대만, 홍콩, 일본, 싱가포르, 인도 등 10개 국가·지역에서 총 77건, 1300만 달러(약 183억원) 이상의 상업용 구매주문(PO)을 확보했다고 밝혔다. 특히 최근 들어 주문 증가 속도가 빨라지고 있다. 딥엑스에 따르면 DX-M1 양산을 시작한 지난해 3분기 누적 PO는 2건에 그쳤지만 4분기 6건, 올해 3월 말 29건, 5월 말 56건, 7월 말 77건으로 늘었다. 전체 주문의 62%에 해당하는 48건이 지난 4월부터 7월까지 4개월 동안 발생한 것으로 집계됐다. 딥엑스는 양산 초기 제품 평가와 개념검증(PoC)에 머물던 고객들이 실제 제품 개발과 구매 단계로 이동하면서 상업화 속도가 빨라지고 있다고 설명했다. 생성형 AI가 주로 데이터센터에서 대규모 연산을 수행하는 것과 달리 로봇이나 드론, 자율주행·스마트모빌리티 장비, 산업용 카메라 등은 데이터를 현장에서 즉각 처리해야 하는 제한 사항이 있는 것으로 알려졌다. 이들 기기는 배터리 용량이나 전력 공급에 제약이 있고 발열과 장착 공간도 제한적이며 모든 데이터를 클라우드로 전송해 처리하는 방식 역시 통신 지연과 네트워크 비용 등의 문제가 발생할 수 있는 것으로 꼽힌다. 이에 기기 자체에서 AI 추론을 수행하면서도 전력 소비를 최소화할 수 있는 온디바이스 NPU가 대안으로 떠오르고 있다. 딥엑스가 양산한 DX-M1 역시 이 같은 엣지 AI 시장을 겨냥한다. 삼성전자 5나노 공정을 기반으로 제작된 DX-M1은 클라우드 연결 없이 디바이스 자체에서 AI 연산을 수행하도록 설계됐다. CCTV와 스마트팩토리, 머신비전, 로봇 등 저전력 환경에서 영상·비전 AI를 구동해야 하는 장비가 주요 적용 대상이다. 실제 사업화 영역도 특정 산업에 집중되지 않고 있다. 딥엑스는 로보틱스, 스마트팩토리·제조자동화, 스마트모빌리티·지능형교통체계(ITS), 미션 크리티컬·항공, AIoT, 의료, AI IT서비스·엣지컴퓨팅, 영상감시·보안 등 8개 분야에서 사업을 진행하고 있다. 적용 제품도 드론과 머신비전 카메라, AI 박스부터 로봇과 산업용 장비, 의료 AI 기기, 문서 인식용 광학문자인식(OCR) 서버, 영상관제용 VMS 서버, 보안 카메라용 엣지박스 등으로 확대됐다. 딥엑스는 개발키트나 평가용 제품을 공급하는 초기 단계를 넘어 고객사의 실제 제품 개발과 생산, 일부 납품으로 이어지는 사례도 나오고 있다고 설명했다. 글로벌 시장에서도 적용처를 넓히고 있다. 중국에서는 바이두 관련 OCR·머신비전 프로젝트와 레노버 등 글로벌 IT·서버 기업 관련 엣지 서버 프로젝트를 진행하고 있으며, 대만에서는 산업용 컴퓨팅 기업 AAEON 등을 통해 적용처를 확대하고 있다. 북미와 유럽에서는 글로벌 유통망과 현지 파트너를 통한 공급을 이어가는 동시에 일본에서는 제조·산업 분야를 중심으로 신규 프로젝트를 늘리고 있는 것으로 알려졌다. 양산 이후에는 27개 글로벌 반도체 유통 파트너와 계약해 해외 공급망을 구축하고 50여개 글로벌 하드웨어·모듈 기업과 협력하고 있다. 라즈베리파이와 바이두의 패들패들, 울트라리틱스 등 개방형 플랫폼 생태계와도 연계해 NPU 적용 장벽을 낮추고 있다. 기술 경쟁력 확보도 병행한다. 딥엑스는 NPU 설계와 저전력 AI 연산 분야에서 500건 이상의 특허를 확보했으며 DX-M1 양산 과정에서 약 90% 수준의 수율을 달성했다고 밝혔다. 단순히 AI 반도체를 설계하는 데 그치지 않고 실제 대량 생산과 공급까지 이어갈 수 있는 제조 경쟁력을 확보하겠다는 전략이다. 특히 피지컬 AI 시장이 본격적으로 확대되면 NPU 경쟁도 단순한 연산 성능보다 전력 효율과 크기, 가격, 소프트웨어 호환성 등 종합적인 성능으로 옮겨갈 것으로 전망된다. 로봇과 드론처럼 배터리를 사용하는 기기에서는 동일한 AI 성능을 얼마나 적은 전력으로 구현할 수 있는지가 제품 경쟁력과 직결되는 것이다. 딥엑스는 차세대 제품을 통해 생성형 AI 영역까지 온디바이스 AI 반도체 적용 범위를 넓힌다는 계획이다. 삼성전자 2나노 공정을 기반으로 개발 중인 'DX-M2'는 칩 기준 최대 5W 수준의 전력으로 생성형 AI를 구동하는 것을 목표로 한다. DX-M2의 주요 적용 대상으로는 로봇과 드론, 지능형 산업 장비, 배터리 기반 스마트 디바이스 등이 거론된다. 딥엑스는 내년 3월 시제품 웨이퍼를 확보한 뒤 4~5월 칩 구동과 성능 검증을 위한 브링업을 진행하고 6월부터 초기 고객 제공을 위한 준비에 착수한다는 계획이다. 김녹원 딥엑스 대표는 "양산 첫 1년 동안 가장 의미 있게 보고 있는 것은 특정 국가나 산업에 국한되지 않고 세계 여러 시장에서 실제 주문과 반복 주문이 발생하고 있다는 점"이라며 "AI 반도체의 경쟁력은 고객의 실제 제품에 적용되고 지속적인 주문으로 이어질 때 비로소 증명된다"고 말했다.
2026-08-14 14:52:32
-
"출시 3일만 1000억 토큰 썼다"…업스테이지 '솔라 프로 4', 글로벌 실사용 시험대
[경제일보] 업스테이지가 '솔라 프로 4'를 앞세워 글로벌 AI 모델 시장에서 실사용 경쟁에 본격적으로 뛰어든다. 글로벌 개발자 플랫폼에 이름을 올린 데 이어 출시 직후 실제 사용량도 빠르게 늘면서, 단순 벤치마크 성능 경쟁을 넘어 AI 에이전트와 기업 업무 영역을 중심으로 상용화 확대에 나서고 있다. 14일 업스테이지는 자체 개발한 거대언어모델(LLM) '솔라 프로 4'를 공개했다고 밝혔다. 솔라 프로 4는 전작 '솔라 프로 3'보다 추론 능력과 에이전트 역량을 강화한 차세대 상용 AI 모델로, 단순 질의에 답하는 것을 넘어 문서 이해와 정보 추출, 긴 맥락 추론, 여러 단계의 의사결정 등 실제 업무 수행에 초점을 맞춰 설계됐다. 특히 솔라 프로 4는 공개 직후 미국 누스 리서치가 개발한 AI 에이전트 '헤르메스 에이전트'와 API 라우팅 플랫폼 '오픈라우터'에 등재됐다. 업스테이지는 한국 모델 최초로 등재된 것으로 오픈AI, 앤스로픽, 구글, 엔비디아 등 글로벌 빅테크와 딥시크, 문샷, 미니맥스 등 중국 AI 기업들이 이름을 올린 플랫폼에 국내 기업 모델이 정식 프로바이더로 참여하면서 글로벌 개발자 시장에서 실사용 기회를 확보했다고 설명했다. 실제 사용량도 빠르게 늘고 있다. 업스테이지에 따르면 솔라 프로 4는 오픈라우터 등재 3일 만에 누적 토큰 소비량 800억 토큰을 넘어섰고, 이날 오전 8시 오픈라우터 기준 누적 토큰 소비량 1000억 토큰을 넘겼다. 단순히 모델을 공개하는 데 그치지 않고 글로벌 개발자들이 API를 통해 실제 모델을 사용하는 단계로 진입한 것으로 평가된다. 에이전트 성능에서도 전작 대비 개선 폭을 키웠다. 여러 단계의 작업을 터미널 환경에서 끝까지 수행하는 능력을 평가하는 '터미널벤치(Terminal-Bench v2.1)'에서 57점을 기록해 전작보다 4.8배 높아졌다. 대화를 이어가면서 도구를 사용하는 능력을 평가하는 '타우3-뱅킹(τ³-Banking)'에서는 23점을 기록해 전작 대비 2.6배 개선됐다. 긴 문서를 이해하고 필요한 정보를 추출하는 능력도 강화했다. 대량의 장문 문서에서 정보를 찾아내고 이를 근거로 답변하는 능력을 평가하는 장문 이해 벤치마크(AA-LCR)에서는 71점을 기록해 전작보다 2.3배 이상 높은 성능을 보였다. 업스테이지는 문서 중간의 맥락을 놓치는 실패를 줄이면서 정확도를 높이는 동시에 토큰 소모량도 줄여 운영 비용 측면에서도 경쟁력을 확보했다고 설명했다. 글로벌 평가에서도 성능 개선을 내세웠다. 글로벌 AI 평가기관 아티피셜 애널리시스 기준 솔라 프로 4의 종합 성능은 42점으로 전작 대비 3배 이상 개선됐다. 업스테이지는 엔비디아 '네모트론 3 울트라'(38점), 구글 '제미나이 3.5 플래시-라이트'(37점) 등 일부 글로벌 모델보다 높은 점수를 기록했다고 밝혔다. 국내 기업과 공공기관을 겨냥한 문서 처리 기능도 강화했다. 솔라 프로 4는 업스테이지의 에이전트 문서 처리 통합 솔루션 '업스테이지 스튜디오'에 탑재돼 한글 문서를 비롯한 다양한 형식의 문서에서 정보를 추출하고 요약, 분석, 번역 등의 작업을 수행할 수 있다. 이를 통해 업스테이지는 LLM 자체의 성능 경쟁뿐 아니라 기업이 실제 업무에 AI를 적용하는 영역까지 사업 범위를 확대한다는 전략이다. 특히 국내 기업과 공공기관에서 활용도가 높은 한글 문서 처리와 업무 자동화를 앞세워 글로벌 범용 모델과 차별화된 시장을 확보하려는 움직임으로 풀이된다. 글로벌 시장에서는 AI 모델 자체를 공급하는 방식과 함께 에이전트 생태계 확대가 새로운 경쟁 영역으로 떠오르고 있다. 개발자가 특정 모델을 직접 선택해 사용하는 것을 넘어 AI가 문서를 읽고 필요한 정보를 찾아내며 외부 도구를 호출해 여러 단계의 업무를 수행하는 형태로 활용 범위가 넓어지고 있기 때문이다. 업스테이지 역시 솔라 프로 4를 통해 이러한 시장 변화에 대응한다는 구상이다. 글로벌 개발자 플랫폼에 모델을 공급하면서 해외 개발자와의 접점을 확대하는 동시에 국내에서는 문서 처리 솔루션과 결합해 기업 고객 확보에 나서는 방식이다. 김성훈 업스테이지 대표는 "실무에서 AI에게 필요한 것은 시험을 잘 보는 능력이 아니라 맡은 일을 끝까지 해내는 신뢰성"이라며 "솔라 프로 4가 글로벌 개발자 플랫폼에 한국 모델 최초로 이름을 올린 것은 우리 AI 기술이 세계 현장에서 통한다는 증거로, 앞으로도 현장에서 검증된 기술력을 바탕으로 한층 더 활용성 높은 AI를 만들어 나가겠다"고 말했다.
2026-08-14 08:55:12
-
-
바운드포, AI API 비용 폭증 막는다…'파레토'로 토큰 지출 사전 통제
[경제일보] 생성형 인공지능(AI)과 AI 에이전트 도입이 확산하면서 기업들의 관심이 'AI를 얼마나 많이 활용하느냐'에서 'AI를 얼마나 효율적으로 활용하느냐'로 옮겨가고 있다. 이에 데이터 파운드리 기업 바운드포가 AI 토큰 비용을 사전에 통제하는 서비스를 선보이며 기업용 AI 비용 관리 시장 공략에 나섰다. 단순히 사용량과 비용을 보여주는 기존 모니터링 방식에서 나아가 예산을 초과할 것으로 예상되는 AI API 호출을 실행 단계에서 차단하는 방식이다. 12일 바운드포는 자사 AI 데이터 운영 플랫폼 '드로파이'에 AI 토큰 지출 관리 서비스 '파레토'를 새롭게 추가했다고 밝혔다. 최근 기업들은 하나의 AI 모델만 사용하는 것이 아니라 업무 성격에 따라 여러 생성형 AI 모델과 API를 동시에 활용하고 있다. 고성능 모델을 적극적으로 활용해 AI 사용량 자체를 늘리는 이른바 '토큰맥싱'이 확산하는 등 AI 활용 확대가 기업 경쟁력으로 여겨지고 있지만, 사용량이 늘어날수록 비용 부담 역시 커지는 구조다. 특히 AI 에이전트가 확산하면서 토큰 비용의 성격도 달라지고 있다. 사람이 직접 AI를 사용하는 경우에는 사용 시간이나 빈도에 일정한 한계가 있지만, AI 에이전트는 업무가 완료될 때까지 API를 자동으로 호출할 수 있다. 로봇이나 각종 디바이스에 AI가 탑재되면 24시간 작동하면서 지속적으로 모델을 호출하는 환경도 가능하다. 이 과정에서 오류가 발생해 같은 요청을 반복하거나, 단순한 작업에 고성능 모델을 계속 사용하는 경우 예상하지 못한 비용이 누적될 수 있다. AI 사용량을 늘리는 것 자체가 목표였던 단계에서 벗어나 기업이 AI 비용의 발생 구조까지 관리해야 하는 단계로 넘어가고 있는 것이다. 기존 기업용 비용 관리 방식만으로는 해당 변화에 대응하기 어렵다는 지적도 나온다. 일반적으로 기업은 월말 청구서나 사용량 데이터를 통해 어느 서비스에서 비용이 발생했는지를 확인한다. 다만 AI API는 호출량과 토큰 사용량에 따라 비용이 실시간으로 증가하기 때문에 사후에 비용을 확인하는 것만으로는 이미 발생한 지출을 되돌리기 어려운 것으로 평가된다. 바운드포는 파레토를 내놓은 것도 해당 문제를 겨냥했다. 바운드포는 파레토가 관리자가 설정한 예산 한도와 정책을 AI API 호출 과정에 적용해 일정 수준을 넘어서는 요청을 실행 전에 차단할 수 있도록 설계됐다고 설명했다. 사용 이후 비용을 분석하는 '사후 관측'보다 비용이 발생하기 전에 통제하는 '사전 통제'에 초점을 맞춘 것이 특징이다. 기업은 팀이나 프로젝트별로 AI 사용 예산을 설정할 수 있으며 현재 사용량과 예상 지출을 확인할 수 있도록 구성됐다. AI 에이전트가 자동으로 API를 호출하는 환경에서도 정해진 예산 범위 안에서 서비스를 운영할 수 있도록 하는 방식이다. 비용이 발생하는 패턴을 분석해 불필요한 지출을 찾아내는 기능도 제공한다. 실패한 API 요청이 반복되면서 비용이 누적되는 재시도, 사실상 동일한 요청을 반복 처리하는 중복 호출, 상대적으로 단순한 작업에 고성능 모델을 사용하는 과사양 모델 사용 등을 분석해 절감 가능성이 있는 영역을 리포트로 제공한다. 기업 입장에서는 어떤 모델을 얼마나 사용했는지를 확인하는 것뿐 아니라 어떤 업무에 어떤 모델을 사용했는지, 불필요한 호출이 발생하고 있는지, 설정한 예산을 넘어설 가능성이 있는지까지 관리해야 하기 때문에 AI 에이전트가 업무 자동화의 중심으로 자리 잡을수록 비용 통제의 중요성은 더욱 커질 전망이다. AI 에이전트가 여러 단계의 업무를 수행하는 과정에서 하나의 요청에 그치지 않고 여러 모델과 API를 연속적으로 호출할 수 있기 때문이다. 피지컬 AI 확산도 변수다. 로봇이나 자율 시스템 등이 AI 모델을 활용해 주변 상황을 판단하고 행동하는 환경에서는 서비스가 작동하는 동안 지속적인 AI 추론과 API 호출이 발생할 수 있다. AI가 소프트웨어 안에서만 사용되는 것이 아니라 현실 세계의 기기와 연결될수록 토큰 비용이 기업의 운영비와 직접 연결될 가능성도 커지고 있다. AI 시장의 경쟁 기준이 변하고 있다. 기존에는 더 뛰어난 성능의 모델을 확보하거나 이를 다양한 업무에 빠르게 적용하는 것이 기업의 AI 경쟁력으로 평가됐다면, 앞으로는 동일한 업무를 얼마나 적은 비용으로 처리할 수 있는지까지 중요한 요소가 될 전망이다. 바운드포는 파레토를 자사 AI 데이터 운영 플랫폼인 드로파이에 결합하면서 데이터 관리와 AI 비용 통제를 하나의 플랫폼에서 제공하는 방향으로 사업을 확대한다는 구상이다. AI 활용 과정에서 발생하는 데이터를 관리하는 동시에 해당 데이터를 바탕으로 AI 사용 패턴과 비용 구조를 분석해 운영 효율까지 높이겠다는 것이다. 황인호 바운드포 대표는 "로봇과 디바이스가 24시간 AI를 호출하는 환경에서는 비용을 사후에 분석하는 방식만으로는 한계가 있었고, 파레토는 피지컬 AI 현장에서 바운드포가 직접 겪은 문제를 해결하는 과정에서 탄생한 서비스"라며 "앞으로도 현장에서 검증한 운영 경험을 서비스로 고도화해 AI 데이터 관리부터 비용 통제까지 기업의 AI 운영 전반을 지원해 나가겠다"고 말했다.
2026-08-12 11:05:01
-
삼성SDS, 국가 AI 연구용 GPU 공급…B300 앞세워 AI 인프라 사업 확대
[경제일보] 삼성SDS가 국가 AI 연구용 컴퓨팅 사업에 엔비디아 최신 B300 기반 GPU 클러스터를 공급한다. 대학과 정부출연연구기관 등 자체적으로 대규모 AI 인프라를 확보하기 어려운 연구기관에 최신 GPU를 제공해 국내 AI 연구 인프라 고도화를 지원하는 동시에 GPU와 국산 NPU를 아우르는 클라우드 사업 확대에도 속도를 낸다. 11일 삼성SDS는 과학기술정보통신부와 정보통신기획평가원(IITP)이 지원하는 '2026년 AI 연구용 컴퓨팅 지원 프로젝트'의 GPU 자원 공급사로 선정돼 지난달 20일부터 서비스를 시작했다고 밝혔다. 이번 사업은 국내 학계와 연구기관에 AI 연구에 필요한 GPU 컴퓨팅 자원을 지원하는 국가 AI 연구 지원 사업이다. 초거대 AI 모델과 대규모 언어 모델(LLM) 연구가 확대되고 있지만 대학과 정부출연연구기관 등이 최신 GPU를 직접 대규모로 확보하기에는 비용과 운영 부담이 큰 만큼 민간 인프라를 활용해 연구자들의 접근성을 높이는 것이 목적이다. 사업 규모는 약 153억원이며 서비스는 지난 7월부터 내년 3월까지 제공된다. 삼성SDS를 포함한 복수 사업자가 공급사로 선정됐으며 삼성SDS는 GPU 공급 계획과 보유 자원 규모, 연구 환경, 운영 지원 체계, 보안 역량 등을 평가하는 입찰에서 1순위 사업자로 선정됐다. 삼성SDS는 이번 사업에 엔비디아 H100뿐 아니라 최신 B300(블랙웰 울트라) 기반 GPU 클러스터를 투입한다. B300은 엔비디아의 최신 블랙웰 울트라 아키텍처 기반 GPU로, 이번 사업에서 요구한 호퍼급 이상의 사양을 충족하는 동시에 대규모 AI 모델의 학습과 추론에 필요한 성능과 메모리를 제공한다. AI 모델이 대형화하면서 최신 GPU 확보 여부가 AI 연구의 속도와 규모를 좌우하는 요소로 떠오르고 있다. 특히 대규모 모델을 학습하려면 여러 GPU를 동시에 연결해야 하는 만큼 GPU 자체의 성능뿐 아니라 GPU 간 데이터를 빠르게 주고받을 수 있는 네트워크와 스토리지 등 전체 인프라 구성이 중요하다. 삼성SDS는 다수의 GPU를 하나의 자원 풀로 묶는 대규모 클러스터 구성과 고속 인터커넥트 네트워크를 함께 제공한다. CPU와 메모리, 스토리지, 네트워크, 개발 환경 등도 사전 구성해 연구자가 별도의 인프라 구축 과정 없이 AI 연구에 필요한 컴퓨팅 환경을 사용할 수 있도록 지원한다. 최신 GPU는 단순히 장비를 구매하는 것뿐 아니라 데이터센터 공간과 전력, 냉각, 네트워크, 운영 인력 등이 함께 필요해 연구기관이 독자적으로 대규모 클러스터를 구축하기 어려운 것으로 평가된다. 이를 민간 클라우드 방식으로 보완해 국내 AI 연구 현장에서 제기되던 최신 GPU 접근성 문제를 해결한다는 구상이다. 정부 역시 이러한 인프라 격차를 줄이기 위해 국가 AI 연구용 컴퓨팅 지원 사업을 추진하고 있다. 연구자가 직접 고가의 GPU와 서버 인프라를 확보하지 않아도 클라우드를 통해 필요한 컴퓨팅 자원을 사용할 수 있도록 해 연구기관의 AI 개발 접근성을 높이는 방식이다. 앞서 삼성SDS는 지난 3월에 국내 최초로 SCP를 통해 엔비디아 B300 기반 GPUaaS를 출시했다. 고객이 고가의 GPU를 직접 구매하지 않고도 클라우드를 통해 AI 학습과 추론에 필요한 GPU 자원을 사용할 수 있도록 한 서비스다. 이번 사업을 통해 삼성SDS는 단순한 공공 사업을 넘어 AI 클라우드 사업의 적용 범위를 확대하는 것으로 분석된다. 또한 지난달에는 국산 AI 반도체 기업 퓨리오사AI의 2세대 NPU '레니게이드(RNGD)' 기반 NPUaaS도 SCP에 탑재했다. 엔비디아 GPU 중심의 AI 인프라뿐 아니라 AI 추론에 특화된 국산 NPU까지 클라우드에서 제공하면서 AI 가속기 선택지를 넓히고 있다. AI 인프라 시장이 GPU 중심에서 다양한 가속기를 활용하는 방향으로 확대될 가능성도 삼성SDS가 GPU와 NPU를 함께 제공하는 배경으로 꼽힌다. AI 서비스가 학습 중심에서 실제 서비스 운영과 추론 단계로 확대되면서 모든 작업에 고성능 GPU를 사용하는 것보다 작업 특성에 맞춰 GPU와 NPU 등 가속기를 선택하는 것이 비용과 효율 측면에서 중요해질 수 있기 때문이다. 삼성SDS가 GPU와 NPU를 모두 클라우드 서비스 형태로 제공할 경우 기업과 연구기관은 직접 하드웨어를 구매하지 않고 필요한 가속기를 선택해 사용할 수 있다. AI 인프라 구축에 필요한 초기 투자 부담을 줄이는 동시에 기술 변화에 따라 새로운 가속기로 전환하기도 상대적으로 용이하다. 이번 국가 AI 연구용 컴퓨팅 사업에서 B300을 실제 연구 현장에 공급하는 것도 삼성SDS의 AI 인프라 사업을 확대하는 데 레퍼런스로 활용될 수 있다. 대학과 출연연 등 연구기관을 대상으로 최신 GPU 클러스터를 운영하면서 대규모 AI 연구에 필요한 인프라 구축과 운영 역량을 확보할 수 있기 때문이다. 삼성SDS는 이번 국가 AI 연구용 컴퓨팅 사업을 통해 연구기관의 최신 GPU 접근성을 높이는 동시에 GPUaaS와 NPUaaS 등 AI 인프라 서비스의 적용 분야를 확대한다는 계획이다. 향후 공공·연구 분야를 넘어 기업의 AI 모델 개발과 서비스 운영 수요까지 AI 가속기 클라우드 사업을 확대할 수 있을지 주목된다. 이호준 삼성SDS 클라우드서비스사업부장 부사장은 "이번 사업을 통해 국내 연구자들이 세계 최고 수준의 AI 인프라를 바탕으로 혁신적인 성과를 낼 수 있도록 안정적인 서비스를 제공할 것"이라며 "앞으로도 국가 AI 연구 인프라의 저변을 확대하고 대한민국의 AI 경쟁력을 높이는 데 기여하겠다"고 말했다.
2026-08-11 08:27:46