검색결과 총 3건
-
팀네이버, ECCV에 논문 23편 채택…3D·로봇 공간지능 경쟁력 고도화
[경제일보] 네이버가 인공지능(AI)의 시선을 현실 공간으로 넓히고 있다. 생성형 AI 경쟁이 텍스트와 이미지 생성을 넘어 실제 공간을 인식하고 이해하는 공간지능으로 확대되는 가운데 네이버랩스와 네이버랩스 유럽 등이 3차원(3D) 공간 재구성, 자율주행 지도, 로봇 시뮬레이션 기술 개발을 고도화하고 있다. 논문 성과를 넘어 네이버의 로봇·자율주행 사업과 연결될 수 있는 원천기술 확보에 속도를 내는 것으로 분석된다. 28일 네이버는 팀네이버가 발표한 연구 논문 23편이 컴퓨터비전 분야 세계 최고 권위 학회 중 하나인 'ECCV 2026' 정규 논문으로 채택됐다고 밝혔다. 네이버랩스, 네이버랩스 유럽, 네이버 AI Lab, 네이버클라우드 등 여러 기술 조직이 3D 공간 인식과 재구성, 이미지·영상 학습 모델, 로봇 주행 시뮬레이션 등 다양한 분야에서 연구 성과를 낸 것으로 알려졌다. 특히 네이버랩스와 네이버랩스 유럽은 로봇과 자율주행 기술에 활용할 수 있는 공간지능 연구를 대거 선보였다. 공간지능은 AI가 주변 환경의 형태와 구조, 위치 관계 등을 이해하고 이를 바탕으로 현실 세계에서 움직이거나 판단하는 능력을 의미한다. 로봇이 사람처럼 주변 공간을 인식하고 경로를 계획하기 위해서는 이런 기술이 필수적으로 평가된다. 네이버랩스 유럽은 지난 2023년 공개한 3D 재구성 기술 '더스터(DUSt3R)'의 후속 연구인 '블래스터(BLASt3R)'를 공개했다. 블래스터는 여러 이미지를 분석해 3D 공간을 재구성하는 동시에 로봇의 위치를 파악하고 지도를 만드는 SLAM 기술을 결합한 것이 특징이다. 이를 통해 로봇이 주행하면서 주변 환경을 실시간으로 지도화하고, 별도의 고성능 장비에 의존하지 않고 온디바이스 환경에서도 3D 재구성을 수행할 수 있도록 기술을 개선했다. 기존보다 속도와 정확도를 높여 로봇이 실제 환경을 인식하는 데 필요한 연산 부담을 낮추는 데 초점을 맞춘 것이다. 네이버랩스는 360도 파노라마 이미지 한 장만으로 실내 공간을 3D로 생성하는 연구도 선보였다. '인스페이스(InSpace)' 기술은 이미지 속 방의 구조와 사물 배치를 분석해 공간을 입체적으로 재구성하는 방식이다. 자율주행과 연결되는 공간 인식 기술도 개발했다. 네이버랩스는 비전언어모델(VLM)을 활용해 학습하지 않은 물체까지 인식하고 이를 실시간으로 조감도 형태의 BEV 지도에 반영하는 기술을 공개했다. 자율주행 차량이나 로봇이 기존에 학습하지 않은 환경에서도 주변 정보를 파악할 수 있도록 하는 것이 핵심이다. 네이버 AI Lab과 KAIST가 공동 연구한 '서울월드모델'은 이런 네이버의 공간지능 기술의 연장선에 있는 것으로 평가된다. 서울의 파노라마 이미지 등 방대한 공간 데이터를 활용해 실제 도시를 반영한 장거리 영상을 생성하고, 이를 지도 기반 가상 탐색과 디지털트윈, 자율주행·로보틱스 시뮬레이션 등에 활용할 수 있도록 하는 기술이다. 서울월드모델과 3D 공간 재구성 기술을 결합하면 현실 공간을 AI가 이해하고 이를 가상환경으로 재현해 다양한 상황을 시뮬레이션하는 방식으로 확장할 수 있다. 실제 도로나 건물에서 모든 상황을 반복적으로 테스트하기 어려운 자율주행이나 로봇 분야에서 가상환경을 활용한 학습과 검증의 중요성이 커지고 있다. 네이버클라우드 역시 이미지와 영상에 대한 AI의 이해도를 높이는 연구를 진행했다. 영상 속 사물의 움직임을 인식하는 기술과 이미지 공간에 텍스트 기반 추론을 결합해 입체적 정보를 더 정밀하게 파악하는 연구가 이번 학회에서 채택됐다. 네이버는 이를 통해 컴퓨터비전 분야의 기초 기술 경쟁력을 확대한다는 계획이다. 이번 학회에서는 전체 제출 논문 가운데 약 1~2%에 해당하는 'ECCV Spotlight'에도 관련 논문 4편이 선정됐다. 360도 이미지를 활용한 3D 공간 생성 연구와 서울월드모델 등이 포함됐다. 네이버가 공간지능을 강조하는 배경에는 AI 기술의 활용 범위가 디지털 공간에서 현실 세계로 확대되고 있기 때문이다. 생성형 AI가 텍스트와 이미지, 영상을 만들어내는 것을 넘어 로봇이 실제 환경에서 이동하고 작업하도록 하기 위해서는 공간을 이해하고 물리적 세계의 변화를 예측하는 능력이 필요하다. 특히 로봇 산업에서는 카메라로 주변을 보는 것만으로는 충분하지 않다. 사물의 위치와 거리, 공간의 구조를 파악하고 자신의 위치를 지속적으로 추정하면서 장애물을 피해 움직여야 한다. 네이버랩스가 3D 재구성과 SLAM, 자율주행 지도 기술을 동시에 고도화하는 것도 이런 현실 세계의 요구에 대응하기 위한 것으로 풀이된다. 네이버 관계자는 "팀네이버는 3대 비전 학회로 불리는 ECCV, ICCV, CVPR에서 매년 두 자릿수 논문이 채택되는 등 글로벌 기술력을 입증해왔다"며 "팀네이버는 앞으로도 적극적인 연구개발을 이어가며 차세대 AI·공간지능 기술을 확보하고, 이를 다양한 서비스에 접목해 사용자가 일상에서 쉽게 체감할 수 있는 기술 경험을 제공해 나갈 계획"이라고 말했다.
2026-08-28 17:06:10
-
-
SKT, AI로 영상 속 사물 자연스럽게 합성…ECCV 2026 논문 채택
[경제일보] 생성형 인공지능(AI)을 활용한 영상 제작과 콘텐츠 후반 작업이 빠르게 확산되면서 영상 속 사물을 자연스럽게 합성하는 컴퓨터 비전 기술 경쟁도 치열해지고 있다. SK텔레콤은 세계 3대 컴퓨터 비전 학회에서 AI 영상 합성 기술력을 인정받는 동시에 해당 기술을 상용 서비스에도 적용하며 광고·미디어 분야 AI 사업 확대에 나선 것으로 풀이된다. 30일 SK텔레콤은 카이스트 주재걸 교수 연구팀과 공동 연구한 AI 영상 합성 기술 '인서트애니웨어' 관련 논문이 오는 9월 8일부터 12일까지 스웨덴 말뫼에서 열리는 '유럽 컴퓨터 비전 학회(ECCV) 2026'에 채택됐다고 밝혔다. ECCV는 컴퓨터 비전 및 패턴 인식 학회(CVPR), 국제 컴퓨터 비전 학회(ICCV)와 함께 세계 3대 컴퓨터 비전 학회로 꼽힌다. 인서트애니웨어는 기존 영상에 촬영 당시 존재하지 않았던 사물을 AI를 활용해 자연스럽게 삽입하는 기술이다. 광고 영상에 특정 제품을 추가하거나 촬영이 끝난 콘텐츠에 소품과 캐릭터, 브랜드 요소 등을 삽입하는 등 영상 후반 작업에 활용할 수 있도록 개발됐다. 기존 AI 영상 합성 기술은 카메라가 이동하거나 삽입한 사물이 다른 물체에 가려지는 상황에서 위치와 크기가 흔들리거나 실제로는 가려져야 할 사물이 화면에 그대로 노출되는 문제가 있는 것으로 알려졌다. 또한 사물 주변의 그림자와 반사, 조명 효과를 자연스럽게 구현하지 못해 합성한 흔적이 남는 한계도 지적돼 왔다. 이에 SK텔레콤과 카이스트 연구팀은 해당 문제를 해결하기 위해 영상 속 3차원 공간 구조에 시간 정보를 함께 반영하는 '4D 장면 이해' 기술을 적용했다. 사용자가 한 장면에서 원하는 위치를 지정하면 AI가 해당 위치 정보를 전체 영상으로 자동 확장해 카메라 이동이나 장면 변화에도 사물의 위치와 형태를 안정적으로 유지할 수 있도록 구현했다. 또한 AI를 활용해 삽입된 사물 주변의 그림자와 반사, 조명 효과까지 자연스럽게 생성해 실제 촬영한 영상과 유사한 결과물을 구현할 수 있도록 설계했다. SK텔레콤은 이를 통해 별도의 복잡한 후반 작업 없이도 고품질 영상 합성이 가능하다고 설명했다. 이번 연구는 원천 기술 확보에 그치지 않고 실제 서비스에도 적용됐다. SK텔레콤은 해당 기술을 광고·미디어 분야 기업 고객에게 제공 중인 가상 간접광고(VPPL) 솔루션 '애드플럭스'에 적용해 상용화했다. 애드플럭스는 기존 촬영 영상을 다시 제작하지 않고도 원하는 제품이나 브랜드 이미지를 영상에 자연스럽게 삽입할 수 있는 솔루션이다. 관련 기술에 대한 특허 출원도 완료했으며, '끝까지 간다 독박투어', '우리 지금 만나', '박장대소-부르면 언제든 콜' 등 방송 프로그램에도 적용된 바 있다. SK텔레콤은 이번 연구 성과를 계기로 광고와 방송을 비롯해 커머스, 콘텐츠 제작 등 다양한 분야로 AI 영상 합성 기술 적용 범위를 확대할 계획이다. 산학 공동 연구를 통해 확보한 컴퓨터 비전 원천 기술을 기반으로 기업 고객 대상 AI 미디어 솔루션 경쟁력을 지속 강화하고, 상용 서비스를 고도화해 AI 기반 콘텐츠 제작 시장 공략을 이어간다는 방침이다. 양승지 SK텔레콤 엔터프라이즈기술지원담당은 "이번 ECCV 2026 논문 채택은 SKT의 AI 영상 합성 기술이 세계적 무대에서 인정받은 성과"라며 "앞으로도 광고·미디어 분야에서 바로 활용할 수 있는 고품질 AI 영상 합성 기술을 지속 고도화해 나갈 것"이라고 말했다.
2026-06-30 08:44:42