검색결과 총 4건
-
카톡·전화·포털이 AI 비서로…'모두의 AI' SKT·카카오·KT 3파전 본격화
[경제일보] 국민이 일상에서 사용하는 통신·메신저·포털이 인공지능(AI) 비서로 바뀌는 경쟁이 본격화한다. 정부가 추진하는 대국민 AI 서비스 ‘모두의 AI’ 사업에 SK텔레콤과 카카오, KT가 최종 선정됐다. 세 사업자는 정부가 지원하는 엔비디아 B200 GPU를 활용해 전 국민이 무료로 사용할 수 있는 범용 AI 챗봇과 공공 AI 에이전트를 개발하고 연내 정식 서비스를 시작할 계획이다. 과학기술정보통신부는 28일 ‘모두의 AI’ 공모에 참여한 6개 사업자를 대상으로 서면·발표평가를 진행한 결과 SK텔레콤·카카오·KT 컨소시엄을 사업 수행기관으로 선정했다고 밝혔다. 이스트소프트·엠케이디·제논은 최종 선정에서 제외됐다. 당초 2~3개 사업자를 선정할 계획이었으며, 평가 점수와 순위는 공개하지 않았다. ◆ SKT는 ‘질문→실행’…카카오는 카톡 안에서 SKT 컨소시엄의 핵심은 답변을 넘어 실제 업무를 대신하는 ‘실행형 AI’다. 이용자의 요청을 이해해 계획을 세우고 검색과 도구 호출을 거쳐 실제 업무를 처리하는 구조다. 앱과 웹뿐 아니라 전화·문자로도 이용할 수 있도록 해 디지털 취약계층까지 이용 범위를 넓힌다. 공공서비스 신청과 증명서 발급, 매장·관공서 전화 대행부터 건강·금융·교통 등 생활 서비스까지 확장하는 것이 목표다. A.X K2를 비롯해 업스테이지 ‘솔라’, 모티프테크놀로지스 ‘모티프3’, LG AI연구원 ‘K-엑사원 2.0’ 등 여러 국산 모델을 활용해 서비스별 최적화를 추진한다. 카카오는 가장 강력한 국민 접점을 무기로 삼는다. 카카오톡에서 범용 챗봇과 AI 에이전트를 이용하고 예약·신청·결제까지 한 번에 처리하는 서비스를 구현한다. LG유플러스·LG CNS·LG AI연구원·루닛·신한은행 등과 협력해 전화 AI와 금융·의료·시니어 케어·세무 등 생애주기별 서비스를 붙인다. 특히 카카오톡이라는 기존 플랫폼 안에 AI를 심는 만큼 별도 앱 설치나 새로운 이용 습관을 요구하지 않는다는 것이 강점이다. AI를 ‘새로운 서비스’가 아니라 기존 디지털 생활 속 기능으로 만드는 전략이다. ◆ KT는 ‘채널 경계 없는 AI’…다음·지니TV까지 KT는 전용 AI 서비스에 이용자를 가두지 않는 전략을 제시했다. 포털 다음과 IPTV ‘지니TV’를 비롯해 쇼핑·부동산 등 기존 서비스 곳곳에 AI 진입점을 배치한다. 이용자가 검색을 시작하면 AI가 정보를 찾고 비교·판단한 뒤 필요한 서비스를 실제로 실행하도록 연결하는 방식이다. 교육·부동산·금융 등 생활 분야의 전문 서비스를 결합하는 것도 특징이다. 다음을 통한 검색과 뉴스, KT의 통신·미디어 고객 기반을 동시에 활용할 수 있다는 점에서 ‘플랫폼 연결형 AI’를 지향한다. 세 회사의 경쟁은 단순한 AI 모델 성능 대결과는 다르다. 이번 사업 평가에서도 AI 모델 자체의 경쟁력뿐 아니라 서비스 편의성, 이용자 확보 전략, 품질·안전성, AI 생태계 기여 등이 주요 평가 대상이었다. 정부가 ‘가장 좋은 모델’을 뽑는 것보다 국민이 실제로 자주 사용할 수 있는 AI 서비스를 만드는 데 무게를 둔 셈이다. ◆ 네이버 빠진 ‘국민 AI’…서비스 경쟁이 승부처 이번 선정에서 네이버의 불참도 눈길을 끈다. 네이버는 독자 AI 모델과 검색·쇼핑·지도 등 강력한 국민 접점을 보유하고 있지만 이번 공모에는 참여하지 않았다. 네이버클라우드는 앞서 “다른 진행 중인 사업에 더 집중하기 위해 참여하지 않기로 했다”고 밝혔다. 정부는 올해 확보한 B200 GPU 최대 512장을 세 사업자에 배분하고 9월 협약을 거쳐 베타서비스를 진행한 뒤 연내 정식 출시할 계획이다. 내년부터는 정부 예산으로 전 국민 서비스 운영에 필요한 비용도 지원한다. 당초 업계에서 운영비 부담을 주요 우려로 제기했던 만큼 장기적으로는 정부 지원에만 의존하지 않고 서비스의 지속가능성을 확보하는 것도 과제다. 궁극적인 경쟁은 ‘누가 더 똑똑한 AI를 만들었느냐’보다 누가 국민의 실제 행동을 가장 많이 바꾸느냐가 될 전망이다. 주민센터 업무를 대신 신청하고, 병원 예약과 결제를 처리하고, 쇼핑과 금융까지 연결하는 AI가 일상에 얼마나 자연스럽게 녹아들지가 관건이다. 특히 행정·금융·의료처럼 오류 비용이 큰 영역에서는 편리함보다 정확성·보안·개인정보 보호가 우선돼야 한다. 세 사업자가 연내 서비스를 내놓는 만큼 이후 경쟁은 모델 성능보다 실제 이용률, 처리 성공률, 재사용률과 같은 ‘AI가 얼마나 많은 일을 끝냈는가’로 옮겨갈 가능성이 크다. ‘모두의 AI’는 정부가 국민에게 AI를 보급하는 사업이지만 동시에 국내 플랫폼과 통신업계가 AI를 국민의 일상에 내재화할 수 있는지를 겨루는 최대 실증 무대가 될 전망이다.
2026-08-28 10:22:05
-
AAII 1위 모티프는 왜 탈락했나…독파모 평가 공개 놓고 논란
[경제일보] 정부의 ‘독자 AI 파운데이션 모델 프로젝트’(독파모) 2차 평가에서 글로벌 성능지표 1위를 기록한 모티프테크놀로지스가 탈락하면서 평가 방식의 투명성을 둘러싼 논쟁이 커지고 있다. 모티프의 ‘Motif 3’는 글로벌 AI 평가기관 아티피셜 애널리시스의 AAII에서 47점을 받아 업스테이지(37점), SK텔레콤(35점), LG AI연구원(31점)을 모두 앞섰다. 하지만 최종 종합평가에서는 4개 팀 중 최하위를 기록했다. 모티프테크놀로지스는 27일 과학기술정보통신부에 공식 이의를 제기하고 전체 평가 항목별·업체별 점수와 판단 근거, 벤치마크 배점 산정 방식, 전문가 평가 기준, 사용자 평가 방법론 및 블라인드 평가 여부 등을 공개해 달라고 요구했다. 이의 제기 결과와 관계없이 독파모 3차에는 참여하지 않겠다는 입장도 밝혔다. ◆ ‘AAII 47점’이 탈락으로 이어진 이유 핵심은 AAII가 독파모 전체 평가의 일부에 불과했다는 점이다. 2차 평가는 벤치마크 40점, 전문가 평가 35점, 사용자 평가 25점 등 총 100점으로 구성됐다. 벤치마크 가운데 AAII가 25점, 한국지능정보사회진흥원(NIA) 평가가 15점이다. 전문가 평가는 AI 전문가 10명이 개발 전략·기술, 개발 성과·계획, 파급효과·기여계획 등을 평가했고 사용자 평가는 AI 스타트업 대표 등 전문 사용자 49명과 일반 국민 185명이 참여했다. 따라서 AAII에서 47점을 받은 것이 곧 독파모 2차 평가에서 가장 높은 점수를 받았다는 의미는 아니다. 실제 정부 발표에서도 4개 팀의 벤치마크 점수 평균은 22.5점이었고 1위와 4위의 격차는 4점에 그쳤다. 전문가 평가의 1·4위 격차는 2.4점, 사용자 평가에서는 5점이었다. 즉 글로벌 벤치마크만 놓고 보면 차이가 있었지만 100점짜리 종합평가에서는 다른 항목이 순위를 충분히 뒤집을 수 있는 구조였다. 과기정통부가 공개한 탈락 사유도 여기에 있다. 류제명 과기정통부 2차관은 모티프가 기술력 측면에서는 뛰어난 성과를 냈지만 “사용성·활용성 측면에서는 다른 모델보다 다소 낮은 평가”를 받았다고 설명했다. 반면 업스테이지는 포털 다음 서비스 실증과 국산 NPU 협업, SK텔레콤은 대규모 상용 서비스 및 산업 특화 에이전트 실증, LG AI연구원은 국제기구 협업과 에이전틱 AI 차별성 및 위험관리 등에서 높은 평가를 받았다. ◆ ‘성능 좋은 모델’과 ‘쓸 수 있는 모델’은 다르다 정부가 사용성과 활용성을 별도로 본 이유도 있다. 이번 독파모 사업의 다음 단계는 단순히 높은 벤치마크 점수를 기록하는 모델을 만드는 데 그치지 않고 실제 국민 서비스와 산업 현장에 적용할 수 있는 AI를 만드는 데 초점이 맞춰져 있기 때문이다. 이에 따라 모델의 답변 성능뿐 아니라 서비스 적용 계획, 산업 생태계 기여, 실제 사용 효용 등을 평가하도록 구조가 바뀌었다. 실제 AAII 역시 모델의 추론·지식·코딩 등 다양한 능력을 종합적으로 보는 글로벌 지표지만 특정 모델의 실제 서비스 안정성이나 한국 산업 환경에서의 활용성을 모두 보여주는 것은 아니다. 모티프 역시 이 점을 인정하면서도 파운데이션 모델의 핵심 가치는 챗봇 사용성보다 여러 분야로 확장 가능한 기반 성능에 있다고 주장하고 있다. 논란은 결국 ‘국가대표 AI를 무엇으로 뽑을 것인가’라는 문제로 이어진다. 글로벌 성능을 우선하면 모티프의 탈락은 납득하기 어렵지만, 실제 국민 서비스와 산업 적용까지 고려한다면 모델 성능 외 평가가 필요하다는 정부 논리에도 일리가 있다. 문제는 어느 쪽이 맞느냐보다 그 판단을 검증할 수 있도록 세부 점수와 평가 기준을 얼마나 공개할 수 있느냐다. 모티프가 제기한 가장 큰 문제도 바로 이 부분이다. 모티프는 AAII 47점과 다른 평가 결과가 크게 엇갈린 이유를 알 수 있도록 세부 점수와 전문가·사용자 평가 근거를 공개해야 한다고 요구하고 있다. 특히 사용자 평가에서 브랜드 인지도나 선입견이 결과에 영향을 줬는지, 블라인드 평가가 적용됐는지도 확인해야 한다는 주장이다. 정부도 평가방식 자체의 한계를 인식하고 있다. 과기정통부는 3차 평가를 앞두고 소수 승자만 뽑는 기존 방식을 넘어 프런티어급 모델 경쟁이 가능하도록 지원체계를 전면 재편하는 방안을 검토하고 있다. 3차 진출팀에는 엔비디아 B200 GPU 지원도 상반기 768장에서 하반기 약 1000장 수준으로 확대할 계획이다. 한편 이번 논란에서 중요한 것은 모티프를 다시 선정하느냐가 아니다. 국민 세금이 투입되는 국가대표 AI 선발전이라면 왜 탈락했는지를 외부에서도 검증할 수 있어야 한다는 것이다. 글로벌 벤치마크와 실제 활용성 가운데 어느 쪽에 더 높은 가치를 둘지는 정책적 선택일 수 있다. 다만 그 선택이 설득력을 가지려면 점수와 기준이 투명하게 공개돼야 한다. 이번 이의 제기가 독파모의 기술 경쟁뿐 아니라 국가 AI 선발 시스템 자체의 신뢰도를 점검하는 계기가 될 전망이다.
2026-08-27 09:38:30
-
'국가대표 AI' 2차 관문, 모티프 탈락…업스테이지·SKT·LG AI연구원 3단계 진출 확정
[경제일보] 정부의 국가대표 인공지능(AI) 모델 선발 프로젝트 '독자 AI 파운데이션 모델(독파모)' 2차 단계 평가에서 모티프테크놀로지스가 18일 탈락했다. 업스테이지와 SK텔레콤, LG AI연구원 3개 팀이 3단계로 넘어간다. 류제명 과학기술정보통신부 2차관이 이날 오전 서울 종로구 정부서울청사에서 열린 브리핑에서 결과를 발표했다. 이번 평가는 LG AI연구원 'K-엑사원 2.0', SK텔레콤 '에이닷엑스 케이투(A.X K2)', 업스테이지 '솔라 오픈 2', 모티프테크놀로지스 '모티프 3' 네 모델을 대상으로 △벤치마크 40점 △전문가 평가 35점 △사용자 평가 25점, 총 100점 만점으로 진행됐다. 가장 눈길을 끈 것은 벤치마크 결과와 최종 순위의 엇갈림이다. 지난 13일 공개된 글로벌 AI 성능 평가기관 아티피셜 애널리시스의 'AAII(Artificial Analysis Intelligence Index)'에서 모티프 3는 47점으로 4개 팀 중 가장 높은 점수를 받았다. 글로벌 거대언어모델(LLM) 가운데 10위, 오픈웨이트 모델 중 4위에 오르며 금융 업무 AI 에이전트와 코딩 부문에서 강점을 보였다. 이어 업스테이지 '솔라 오픈2 250B'가 37점, SK텔레콤 '에이닷엑스-K2'가 35점, LG AI연구원 'K-엑사원 2.0'이 31점 순이었다. 30명 미만 인력이 5개월간 개발한 모델이 대기업 두 곳을 제친 결과였지만, AAII가 벤치마크 40점 중 25점만 차지하는 구조여서 이 점수가 곧바로 최종 순위로 이어지지는 않았다. 전문가 평가에서는 개발 전략·기술(10점), 개발 성과·계획(10점), 파급효과·기여계획(15점)을 심층 평가했다. 특히 독자성과 이를 기반으로 한 성능 향상 수준을 반영했다. 사용자 평가는 AI 스타트업 대표 등 전문 사용자 49명과 일반 국민 평가단 185명이 나눠 참여했다. 벤치마크 평가에서 4개 팀 평균은 22.5점으로 1·4위 격차가 4점, 전문가 평가는 평균 28.8점에 격차 2.4점, 사용자 평가는 평균 17.6점에 격차 5점이었다. 세 항목 모두 격차가 크지 않아 근소한 차이로 순위가 갈렸을 가능성이 크다. 지난 1월 15일 1차 단계 평가에서는 LG AI연구원이 90.2점으로 종합 1위를 차지했고, SK텔레콤과 업스테이지도 관문을 넘었다. 네이버클라우드와 NC AI는 이때 탈락했다. NC AI는 종합 점수에서, 네이버클라우드는 독자성 기준에서 밀렸다. 과기정통부는 이후 추가 공모를 거쳐 모티프테크놀로지스를 합류시켜 현재의 4팀 체제를 만들었다. 2차 평가는 1차와 성격이 달랐다. 1차가 기본 언어 이해·생성 능력과 모델 완성도에 초점을 맞췄다면, 2차는 외부 도구를 호출해 실제 업무를 자율 수행하는 에이전틱 AI 역량과 오케스트레이션 능력 검증 비중이 커졌다. LG AI연구원은 엑사원의 에이전트 작업 수행 능력 강화에 주력했고, 24개 벤치마크 지표 평균 점수를 1차 63.3점에서 70.1점으로 끌어올렸다고 밝힌 바 있다. 과기정통부는 다음 단계에 진출한 3개 팀에 고성능 GPU(B200) 지원을 확대하겠다고 밝혔다. 최종 3개 모델에는 GPU 1000장 지원 등 컴퓨팅 자원과 연구개발(R&D) 지원이 이어질 것으로 예상된다. 업계에서는 정부가 추가 탈락 없이 3개 팀을 그대로 프론티어급 AI 개발 프로젝트로 넘길 가능성도 거론되고 있다. 과기정통부 관계자는 "최근 AI 모델을 둘러싼 글로벌 경쟁이 더 치열해지고, AI 모델의 범분야 성능이 눈에 띄게 도약하는 가운데, 주요 선도국에서 AI 모델의 국가 안보 전략 자산화 움직임이 현실화되고 있다"며 "과기정통부도 AI 모델 개발 필요성을 깊이 인식하고 기존의 방식을 뛰어넘는 새로운 지원 체계를 관계 부처와 논의 중에 있으며, 곧 구체적인 내용을 준비해 발표할 것"이라고 말했다.
2026-08-18 11:23:40
-
독파모 2차 관문 앞…3팀 압축 임박…LG '몸집 키우기' VS '효율형 AI 효율·에이전트'
[경제일보] 정부의 독자 인공지능(AI) 파운데이션 모델 프로젝트(독파모) 2차 평가 결과 발표가 임박했다. LG AI연구원과 SK텔레콤, 업스테이지, 모티프테크놀로지스 4개 팀 가운데 3개 팀만 다음 단계에 진출한다. 독파모는 새 정부의 'AI 3대 강국 도약' 전략 핵심 과제로 지난해 8월 시작됐다. 해외 AI 모델 의존도를 낮추고 기술·경제·안보 리스크를 줄이겠다는 목적으로, 총사업비 1576억원을 들여 팀당 데이터 구축비 30억~50억원과 연간 20억원가량의 연구비, 컴퓨팅 자원을 지원한다. 6개월 단위 평가로 매번 팀을 떨어뜨려 2027년 상반기까지 최종 1~2개 팀만 남기는 구조다. 첫 단추부터 순탄치 않았다. 애초 선정된 5개 팀(네이버클라우드·NC AI·LG AI연구원·SK텔레콤·업스테이지) 가운데 지난 1월 15일 발표된 1차 평가에서 네이버클라우드와 NC AI가 동반 탈락했다. 네이버클라우드는 오픈소스 모델을 차용했다는 의혹이 불거지며 독자성 기준에 부합하지 못한다는 판정을 받았고, NC AI는 종합 점수 경쟁에서 밀렸다. 당초 계획보다 1개 팀이 더 빠지자 정부는 패자부활전을 열었지만 네이버클라우드와 NC AI, 그리고 최초 선정에서 탈락했던 카카오까지 국내 IT 양강이 모두 재도전을 거부했다. 결국 2월 20일 모티프테크놀로지스 컨소시엄이 새 정예팀으로 뽑히며 4개 팀 체제가 만들어졌다. 과학기술정보통신부는 독파모 2차 단계평가를 마무리하고 조만간 결과를 발표할 예정이다. 대상은 △LG AI연구원 'K-엑사원 2.0' △SK텔레콤 '에이닷엑스 케이투(A.X K2)' △업스테이지 '솔라 오픈 2' △모티프테크놀로지스 '모티프3'다. 평가는 벤치마크 40점(글로벌 평가기관 아티피셜 애널리시스 25점, NIA 자체 벤치마크 15점), 전문가 평가 35점, 국민 평가단 200명이 참여하는 사용자 평가 25점으로 구성된다. 외부에 공개된 벤치마크 지표만으로 결과를 예단하기 어려운 것도 이 때문이다. 네 팀의 전략은 두 갈래로 갈린다. 규모로 밀어붙인 쪽은 LG와 SKT다. LG AI연구원의 K-엑사원 2.0은 파라미터 7500억 개(750B)로 1차 모델(236B)보다 3배 이상 커졌고, 코딩·에이전틱 코딩 지표를 이전 대비 약 30% 개선했다고 밝혔다. 장문 이해 평가 OpenAI-MRCR 94.4점, 한국어 장문 이해 Ko-LongBench 89.6점을 기록했고 지원 언어도 10개로 늘렸다. SKT의 에이닷엑스 케이투(688B)는 수학·한국어 추론에 집중해 2026년 국제수학올림피아드(IMO) 평가에서 42점 만점에 29점으로 금메달 기준선을 넘겼고, 고난도 수학 추론 평가 MathArena AIME 2026에서는 97.1% 정확도로 싱킹 머신스랩의 오픈웨이트 모델 '잉클링'과 공동 최고점을 기록했다. 업스테이지와 모티프테크놀로지스는 작은 몸집으로 효율을 택했다. 업스테이지의 솔라 오픈 2(250B)는 실제 연산에는 150억 개만 쓰는 전문가 혼합(MoE) 구조로, 양자화 시 엔비디아 H200 GPU 2장으로 구동할 수 있다. 모티프3(314B)는 은행 업무 처리와 IT 장애 진단 등 실무형 평가에서 강점을 보였다. 공개된 AAII(Artificial Analysis Intelligence Index) 지표에서는 이 구도가 뒤집힌다. 모티프3가 47점으로 1위, 업스테이지 솔라 오픈 2가 37점으로 뒤를 이었고 SKT 35점, LG 31점 순이었다. 모델 규모는 LG와 SKT가 앞서지만 공개 지표에서는 상대적으로 작은 모티프와 업스테이지가 높은 점수를 받은 셈이다. 다만 AAII는 전체 평가의 25%에 불과해 이 순위가 곧 정부 최종 순위로 이어지지는 않는다. 2차 평가를 통과한 3개 팀은 추가 단계평가를 거쳐 최종 2개 팀으로 압축된다. 정부는 이 과정에서 확보한 고성능 GPU 배분과 국가기록원·대법원 판결문 등 공공데이터 제공을 병행해 2027년까지 글로벌 톱10 수준의 모델을 만들겠다는 목표를 세웠다.
2026-08-18 09:40:27