
< (왼쪽부터) KAIST 강태웅 박사과정, 형준하 박사과정, 주재걸 교수, 박민호 박사과정 (우상단 네모 왼쪽부터) KAIST 김기남 박사과정, 서울대 김도현 학부연구생 >
만약 영화 다크나잇을 보면서 화면 속 조커를 바라보는 것이 아니라, 내가 조커가 되어 고담시를 직접 바라본다면 어떨까. 관객의 시선이 아닌 등장인물의 눈으로 세상을 경험하는 영상 기술이 현실이 되고 있다. 우리 대학 연구진이 일반 영상만으로도 사용자가 직접 보는 시점의 영상을 생성하는 새로운 인공지능 모델을 개발했다.
으리 대학은 김재철AI대학원 주재걸 석좌교수 연구팀이 관찰자 시점의 영상만을 활용해 영상 속 인물이 실제로 보고 있었을 장면을 정밀하게 생성하는 인공지능 모델 ‘에고엑스(EgoX)’를 개발했다고 23일 밝혔다.
최근 증강현실(AR), 가상현실(VR), AI 로봇 기술이 빠르게 발전하면서 ‘내가 직접 보는 장면’을 그대로 담은 1인칭 시점 영상(Egocentric video)의 중요성이 커지고 있다. 그러나 고품질의 1인칭 영상을 얻기 위해서는 사용자가 고가의 액션캠이나 스마트 글래스를 직접 착용해야 하는 한계가 있었다. 또한 이미 촬영된 일반 영상(제3자 시점, Exocentric video)을 1인칭 시점으로 자연스럽게 변환하는 데에도 기술적 제약이 존재했다.
이번 기술은 단순히 화면을 회전시키는 수준을 넘어, 인물의 위치와 자세, 주변 공간의 3차원(3D) 구조를 종합적으로 이해한 뒤 이를 기반으로 1인칭 시점 영상을 재구성한다는 점이 특징이다.

< 3인칭 시점 영상을 1인칭 시점 영상으로 변환한 예시 >
기존 기술은 정지 이미지만 변환하거나 4대 이상의 카메라 영상이 필요한 경우가 많았다. 또한 빛의 방향이나 움직임이 복잡한 동영상에서는 화면이 어색해지는 문제가 있었다.
반면 EgoX는 단 하나의 3인칭 시점 영상만으로도 고품질의 1인칭 영상을 생성할 수 있다. 연구팀은 특히 인물의 머리 움직임과 실제 시야 사이의 상관관계를 정밀하게 모델링함으로써, 고개를 돌릴 때 시야가 자연스럽게 전환되는 모습까지 사실적으로 구현하는 데 성공했다.
이 기술은 특정 환경에 국한되지 않고 요리, 운동, 작업 등 다양한 일상 상황에서도 안정적인 성능을 보였다. 이를 통해 별도의 웨어러블 장치를 착용하지 않고도 기존에 축적된 영상으로부터 고품질의 1인칭 시점 데이터를 확보할 수 있는 새로운 가능성을 열었다는 평가를 받고 있다.
EgoX는 향후 다양한 산업 분야에 상당한 파급력을 미칠 것으로 기대된다. AR·VR 및 메타버스 분야에서는 일반 영상을 사용자가 직접 체험하는 듯한 몰입형 콘텐츠로 전환해 사용자 경험을 극대화할 수 있다.
또한 로봇이 사람의 행동을 보고 학습하는 모방 학습(Imitation Learning)의 핵심 데이터로 활용될 수 있어 로봇과 AI 학습 분야에도 기여할 것으로 전망된다. 스포츠 중계나 브이로그를 선수나 주인공의 시점으로 전환하는 등 새로운 형태의 영상 서비스도 가능해질 것으로 기대된다.

< 3인칭 시점을 1인칭으로 변환하는 EgoX기술(AI생성이미지) >
주재걸 석좌교수는 “이번 연구는 단순한 영상 변환 기술을 넘어, 인공지능이 사람의 ‘시야’와 ‘공간 이해’를 학습해 재구성했다는 점에서 의미가 크다”며 “앞으로는 기존에 촬영된 영상만으로도 누구나 몰입형 콘텐츠를 제작하고 경험할 수 있는 환경이 열릴 것으로 기대한다”고 말했다. 이어 “KAIST는 생성형 AI 기반 비디오 기술 분야에서 세계적 경쟁력을 확보해 나갈 것”이라고 덧붙였다.
이번 연구는 강태웅, 김기남 KAIST 박사과정, 김도현 서울대 학부연구생이 제 1저자로 참여했으며, 논문은 2025년 12월 9일 arXiv에 선공개되어 미국 NVIDIA 및 Meta 등의 빅테크들을 비롯한 AI 산업 및 학계의 큰 주목을 받았으며, 2026년 6월 3일 미국 콜로라도에서 열리는 국제 학술대회인 The IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)에 공식 발표될 예정이다.
※ 논문명: EgoX: Egocentric Video Generation from a Single Exocentric Video, 논문링크: https://keh0t0.github.io/EgoX/
※ 저자: 강태웅(제1저자, KAIST), 김기남(제1저자, KAIST), 김도현 (제1저자, 서울대학교), 박민호 (공동저자, KAIST), 형준하 (공동저자, KAIST), 주재걸(교신저자, KAIST)
한편, 이번 연구는 과학기술정보통신부 재원으로 한국연구재단의 지원을 받은 개인기초연구사업 ‘생성형 인공지능 기술을 통한 사용자 중심 콘텐츠 생성 및 편집 기술 연구’ 과제와, 슈퍼컴퓨터 5호기 초고성능컴퓨팅 기반 R&D 혁신 지원 사업 ‘디퓨전 모델 기반 비디오 촬영 시점 변환 연구’ 과제의 지원을 받아 수행됐다.
우리 대학 인공지능반도체대학원은 2026년 7월 2일 호텔 오노마 대전 5층 그랜드볼룸홀에서 「제6회 한국인공지능시스템포럼 조찬 강연회」를 개최했다. 이번 강연회는 한국인공지능시스템포럼(KAISF)이 주관하고, 정보통신기획평가원(IITP), 한국전자통신연구원(ETRI), PIM반도체설계연구센터, 우리 대학 인공지능반도체대학원이 공동 주최했다. 행사에는 관련 산학연 연구자 및 종사자, 정부부처와 공공기관 관계자 등이 참석해 인공지능과 모빌리티 산업의 기술 변화 및 발전 방향을 공유했다. 이날 강연은 카카오모빌리티 김진규 부사장이 맡아 Physical AI 시대의 모빌리티 혁신과 자율주행 상용화 방향을 중심으로 진행했다. 김 부사장은 서울 강남구 심야 자율주행 택시 ‘서울자율차’ 운영 사례를 바탕으로, 카카오 T 플랫폼이 시민의 이동 경험을 혁신하고 있는 방식과 자율주행 상용화를 위한 기술적·산업적 과제를 소개했다. 또한 자율주행 상용화가 단일
2026-07-06생쥐의 몸짓을 단어처럼 읽고 의미를 이해하는 인공지능이 등장했다. 우리 대학 연구진은 행동 데이터를 언어처럼 학습해 자폐 모델 생쥐의 사회적 행동 결함을 스스로 찾아내는 AI 모델 ‘비헤이버트(BehaVERT)’를 개발하며 해석 가능한 뇌과학의 새로운 패러다임을 제시했다. 우리 대학 뇌인지과학과 김대수 교수 연구팀이 동물의 움직임을 언어처럼 읽고 해석하는 인공지능(AI) 모델을 개발했다고 1일 밝혔다. 연구팀은 생쥐의 골격 움직임을 자연어의 단어에 해당하는 ‘토큰(token)’으로 변환해 학습시키는 방식으로 행동의 의미를 이해하는 AI 모델 ‘비헤이버트'를 구현했다. 이 모델은 별도의 사전 지식 없이도 자폐 모델 생쥐의 핵심 사회행동 결함을 스스로 발견할 수 있음을 확인했다. 이번 연구는 동물 행동을 언어처럼 분석하는 새로운 인공지능 접근법을 제시한 것으로 평가된다. 특히 AI가 단순한 행동 분류를 넘어 행동의 의
2026-07-01챗GPT와 같은 생성형 인공지능의 답변에는 사회적 편견이 반영되어 있을까? 우리 대학 연구진이 생성형 인공지능의 답변에 내재된 연령 관련 고정관념을 정량적으로 분석해 규명했다. 이번 연구는 인공지능의 은밀한 편향이 사회적 인식에 미칠 영향을 조명하고, 향후 포용적 인공지능 개발을 위한 방향성을 제시했다. 우리 대학은 과학기술정책대학원 최문정 교수 연구팀이 생성형 인공지능 모델인 오픈AI(OpenAI)의 챗GPT-4o가 생성하는 문장 속에 노인에 대한 미묘한 고정관념이 내재되어 있음을 정량적으로 분석했다고 28일 밝혔다. 생성형 인공지능은 일상 속 정보 탐색과 의사결정 과정에 폭넓게 활용되고 있지만, 학습 데이터에 포함된 사회적 편견을 재생산할 수 있다는 우려도 제기돼 왔다. 기존 연구들이 주로 성별이나 인종 관련 편향에 집중해 온 반면, 홍완 박사과정 연구원이 제1저자로 수행한 이번 연구는 전 세계적인 인구 고령화 속에서 중요성이 커지고 있는 연령차별(Ageism, 나이를
2026-07-01인공지능(AI)이 디지털 혁신을 이끌었다면, 자율 로보틱스는 그 혁신을 현실 세계로 확장하는 핵심 기술로 주목받고 있다. 이러한 흐름 속에서 자율 로봇의 미래를 조망하는 세계적 학술행사가 우리 대학에서 열린다. 우리 대학은 세계적 학술지 네이처(Nature)와 공동으로 오는 10월 13일부터 15일까지 대전 본원에서 ‘2026 네이처 컨퍼런스: 자율 로보틱스(2026 Nature Conference: Autonomous Robotics)’를 개최한다고 26일 밝혔다. 네이처가 로보틱스를 단독 주제로 컨퍼런스를 개최하는 것은 이번이 처음이다. 그동안 네이처는 프린스턴대, 칭화대 등 세계 유수 연구기관과 함께 인공지능, 바이오, 에너지 등을 주제로 50여 차례 학술행사를 개최해 왔다. 우리 대학은 국내 최초의 로봇 팔 ‘카이젬(KAISEM)’과 초기 지능형 서비스 로봇 ‘아미(AMI)’, 대한민국 휴머노이드 로봇의
2026-06-26스마트폰의 안면 인식부터 휴머노이드 로봇까지, 인공지능(AI)의 눈 역할을 하는 컴퓨터 비전 기술은 우리 일상에 널리 활용되고 있다. 우리 대학과 국제 공동연구진은 적은 메모리만으로도 AI가 세상을 더욱 선명하게 볼 수 있는 기술을 개발해 GPU(그래픽처리장치) 메모리 효율을 최대 16배 높였다. 이번 성과는 휴머노이드 로봇과 온디바이스 AI 시대를 앞당길 핵심 기술로 평가된다. 우리 대학은 전기및전자공학부 김창익 교수 연구팀이 미국 MIT 및 마이크로소프트 연구진과의 공동 연구를 통해, 제한된 GPU 메모리만으로도 AI의 시각 성능을 높일 수 있는 범용 기술 ‘업샘플 애니띵(Upsample Anything)’을 개발했다고 17일 밝혔다. 이번 성과는 인공지능 및 컴퓨터 비전 분야 세계 최고 권위 학회인 ‘CVPR 2026’ 논문 채택에 이어, 계산 자원의 효율적 활용을 인정받아 전체 1위인‘CVPR 컴퓨트 골드 스타(
2026-06-17